Allgemeiner Plauderchat über das Thema DC Part IV

Hier sind vorerst alle GPUs down. Die Bude wird einfach zu heiß. Außerdem steht eine kleine GPU Umstellung an.
 
Im Keller stört mich das zum Glück nicht - hab' jetzt auch beim 9950X den Boost der CPU deaktiviert - direkter drop von fast 20° bei der CPU-Temperatur! :o *chatt*
CPU jetzt bei ~ 75°, GPU (Hostspot) bei ca. 65° - damit kann der erstmal weiterlaufen...
 
Kurze Frage: wie erkläre ich Boinc, dass nur die verbaute dGPU (9070x) verwendet werden soll, aber nicht die APU (8500G)?
 
Kurze Frage: wie erkläre ich Boinc, dass nur die verbaute dGPU (9070x) verwendet werden soll, aber nicht die APU (8500G)?
Einfach die iGPU deaktivieren in der cc_config (-d0)

<exclude_gpu>
<url>project</url>
<type>ATI</type>
<device_num>0</device_num>
<app>xy</app>
</exclude_gpu>
 
Also für SRBase z.B.:

<exclude_gpu>
<url>http*s://srbase.my-firewall.org/sr5/</url>
<device_num>1</device_num>
</exclude_gpu>

Die CPU 1 ist die iGPU. Boinc meckert dann bei dem Tag <exclude_gpu>
 
Du meinst wohl Device 1 ist die IGP dann müsste die 9070x Device 0 sein, aber was macht der Stern da im https
und hast du vielleicht ein <use_all_gpus>1</use_all_gpus> in der cc_config.
 
War SRBase nicht das Projekt das bei mehr als einer aktiven GPU rumsponn weil es nur mit einer GPU umgehen konnte und dann alle GPU WUs auf eine GPU schmiss oder war das ein anderes Projekt bzw. das Problem ist inzwischen Geschichte?

Wenn es nur Radeons sind hatte ich bei mir diese Variante für die cc_config.xml genommen.

<cc_config>
<options>
<use_all_gpus>1</use_all_gpus>
<ignore_ati_dev>0</ignore_ati_dev>
</options>
</cc_config>

Welche GPU was ist kann man der Ereignisanzeige von BOINC entnehmen, in dem Fall war GPU 0 die IGP.
 
Irgendwas war da glaube ich bei SRBase ... ich meine aber das er eine WU auf 2 GPUs hat laufen lassen ...
 
Moo! und SRBase LL-dc lassen die ATI WUs bei Mischbestückung auf der NV laufen.
 
Danke, ich glaube unter Fedora läuft nun die 9070XT, welche die ID 1 hatte. Der Link war nur angepasst, damit das keine echter Link ist.
Ich warte mal ab, was de genau berechnet wird.

Hardware: AMD Ryzen 5 PRO 8500G mit einer 9070XT auf einem Pro WS B850M-ACE SE, welches ja sogar noch IPMI bietet. Damit kommt Fedora nicht oob richtig klar.
 
LHC scheint grad alle WUs gekilled zu haben, egal ob CMS, Theory oder Atlas. Bei mir sieht das so aus:


22943 LHC@home 24.06.2026 14:59:12 Result c46851ea9306_0 is no longer usable
22944 LHC@home 24.06.2026 14:59:12 Result c4b357def694_0 is no longer usable
22945 LHC@home 24.06.2026 14:59:12 Result da367d9f98dd_0 is no longer usable
22946 LHC@home 24.06.2026 14:59:12 Result dabc747049aa_0 is no longer usable
22947 LHC@home 24.06.2026 14:59:12 Result f8ddb1fc719c_0 is no longer usable
22948 LHC@home 24.06.2026 14:59:12 Result f8ddc12ec1c2_0 is no longer usable
22949 LHC@home 24.06.2026 14:59:12 Result daa2e7be728c_2 is no longer usable
22950 LHC@home 24.06.2026 14:59:12 Result f9f6ae58fde9_0 is no longer usable
22951 LHC@home 24.06.2026 14:59:12 Result 13216c440104_0 is no longer usable
22952 LHC@home 24.06.2026 14:59:12 Result 1321176b4f7e_0 is no longer usable
22953 LHC@home 24.06.2026 14:59:12 Result 1331ffbc00a8_0 is no longer usable
22954 LHC@home 24.06.2026 14:59:12 Result 13d6bed7b1e3_0 is no longer usable
22955 LHC@home 24.06.2026 14:59:12 Result 13d616ab3221_0 is no longer usable
22956 LHC@home 24.06.2026 14:59:12 Result 13e406f0746a_0 is no longer usable
22957 LHC@home 24.06.2026 14:59:12 Result 2ca6db661537_0 is no longer usable
22958 LHC@home 24.06.2026 14:59:12 Result 2c9ffefeb0c7_0 is no longer usable
22959 LHC@home 24.06.2026 14:59:12 Result 2cc51547f5cf_0 is no longer usable
22960 LHC@home 24.06.2026 14:59:12 Result 45e42cb290dd_0 is no longer usable
22961 LHC@home 24.06.2026 14:59:12 Result 45f1e9a085f2_0 is no longer usable
22962 LHC@home 24.06.2026 14:59:12 Result 4653282c66a2_0 is no longer usable
22963 LHC@home 24.06.2026 14:59:12 Result 4660ad461e48_0 is no longer usable
22964 LHC@home 24.06.2026 14:59:12 Result 593876add806_0 is no longer usable
22965 LHC@home 24.06.2026 14:59:12 Result 593114e7707c_0 is no longer usable
22966 LHC@home 24.06.2026 14:59:12 Result 59403183a15b_0 is no longer usable
22967 LHC@home 24.06.2026 14:59:12 Result 59f63752bf41_0 is no longer usable
22968 LHC@home 24.06.2026 14:59:12 Result 59f6b667db3b_0 is no longer usable
22969 LHC@home 24.06.2026 14:59:12 Result 59f0ed1cc316_0 is no longer usable
22970 LHC@home 24.06.2026 14:59:12 Result 5a062af6270f_0 is no longer usable
22971 LHC@home 24.06.2026 14:59:12 Result 7836d55079e3_0 is no longer usable
22972 LHC@home 24.06.2026 14:59:12 Result 78665d2d4a20_0 is no longer usable
22973 LHC@home 24.06.2026 14:59:12 Result 788063d91f5d_0 is no longer usable
22974 LHC@home 24.06.2026 14:59:12 Result 78ec29eb20d6_0 is no longer usable
22975 LHC@home 24.06.2026 14:59:12 Result 78edf52d0bef_0 is no longer usable
22976 LHC@home 24.06.2026 14:59:12 Result 931217cc4dd4_1 is no longer usable
22977 LHC@home 24.06.2026 14:59:12 Result 93211fb512ab_0 is no longer usable
22978 LHC@home 24.06.2026 14:59:12 Result 78fab827044a_1 is no longer usable
22979 LHC@home 24.06.2026 14:59:12 Result 933150fceb25_0 is no longer usable
22980 LHC@home 24.06.2026 14:59:12 Result 93c4ffa28671_0 is no longer usable
22981 LHC@home 24.06.2026 14:59:12 Result aa62bb605983_0 is no longer usable
22982 LHC@home 24.06.2026 14:59:12 Result aa6feace00b8_0 is no longer usable

Siehe auch
 
SRBase unter Windows fängt mit der Nummerierung bei 1 an. Unter Linux geht die Nummerierung bei 0 los.

Gemäß meiner Aufzeichnungen, lege ich noch eine app_config.xml an, und ändere noch etwas in einer der Job-TF Dateien.
Richtig wild wird es bei mehr als 2 GPUs. Ich habe noch aus Zeiten, als ich Sompes 8 GPU-Rechner zeitweise in Hannover hatte, noch die Einträge für die cc_config.xml in den Unterlagen.
 
Habt ihr mal ein Projekt/Unterprojekt zur Hand das vom erweiterten L3 Cache der X3Ds profitiert und mit dem ich den Ryzen 9 9950X3D2 warmlaufen lassen kann?
 
Vielleicht WUs, die von der Größe des verwendeten Arbeitsspeichers auch in den Cache passen würden?
Yoyo Siever ist 60MB groß, WCG MCM ist 80MB groß.
Das andere Extrem wäre Yoyo ecm P20 20GB mit bis zu 20GB RAM-Belegung. Hier wird der Cache vielleicht auch voll ausgeschöpft.
 
Bei PrimeGrid steht in den Projekteinstellungen bei den Subprojekten bei, wie viel Cache die benötigten. Da könnte der X3D bei mehreren WUs gleichzeitig im Vorteil sein.
 
@enigmation
Leidern nein, bei WCG war MIP ein Projekt das pro WU wohl 4 MB L3 wollte (siehe Penta 2021) aber das scheint beendet zu sein. War der nicht ausreichend groß führte der Umweg über den RAM zu Leistungseinbußen.
Um die ECM WUs mache ich wegen dem RAM Bedarf eher einen Bogen denn das System hat "nur" 32 GB RAM, zu wenig für WUs auf allen Threads.

@FritzB
Da schaue ich gleich mal rein.

Edit:
Ich fürchte da dürfte die Vergleichbarkeit oder die Laufzeit zum Problem werden.

Mal als Beispiel:
Extended Sierpinski Problem LLR (ESP)
Deadline: 14 days (up to 56 days)

Recent average CPU time: 244:33:34
FFT sizes: 2880K to 3072K (uses up to 24576K cache per task)

Rechnerisch müßte das für 8 WUs mit je 4 Threads reichen welche dann 2-3 Tage lang laufen würden. Bei einer SMT Skalierung die gegen 0 geht wäre ich schätzungsweise eher bei 4-5 Tagen.
Selbst wenn ich die durchlaufen lassen würde, womit würde ich die vergleichen?
 
Zuletzt bearbeitet:
Moin, mal zum Bettelscript ... ich würde das gerne für GPU Grid haben weil sonst scheint man dort ja nichts zu bekommen denn es gibt immer wieder Arbeit allerdings scheinbar nur für einen erlesenen Kreis an Menschen ...
 
Due musst doch jeweils nur die Projektadresse anpassen.
 
Habs gefunden, umgebastelt und läuft ^^
 
Jemand kurz ne app_config dafür wie ich bei SiDock dafür sorge das er maximal 16WUs gleichzeitig abarbeitet statt mir die PCs immer mit 32 bzw dem maximalen voll zu ballern ...
 
<app_config>
<project_max_concurrent>16</project_max_concurrent>
</app_config>
 
Nächstes Problem ... der GPU Cruncher hat sein Linux geschrottet ... irgendwas stimmt nicht, nach jedem Neustart sind alle bereits gestarteten WUs kaputt ... kp warum

Den 7950X zerreist es auch immer mehr ... irgendwie ist der Wurm drin ...
Ich werde beide PCs mal mitnehmen nach Wilhelmshaven :]

Da habe ich zumindest für den AM5 PC noch einen PC wo ich alles mögliche mal gegentauschen kann auch wenn das bedeutet ich muss meinen PC da auch noch zerlegen ... aber es kann ja eigentlich nicht schon wieder die CPU sein ... es ist also der Speicher oder das Board ...
Aber ich bin auch echt ratlos, ich habe nicht geändert und den PC gestern Abend ausgemacht und wollte ihn heute morgen starten und dann ging wieder nichts mehr ... startet bis Windows und zack BUMM neustart und das produziert er in Dauerschleife ...
Dann startet er irgendwann und läuft wieder Stundenlang stabil ...
 
Zuletzt bearbeitet:
Ich würde noch eine NV GPU suchen, am liebsten mit 3 Lüftern ...
Der BOINC Cruncher ist in ein neues Gehäuse umgezogen und hätte jetzt noch etwas Platz für eine dritte GPU auch auf die Gefahr hin das ich dann das NT nochmal tauschen müsste weil das aktuelle mit 1000W und nur 2 GPU Anschlüssen etwas dünn bestückt ist :P
Wenn also jemand günstig was abzugeben hat gerne per PN melden ;)
 
Die c't hatte in der Ausgabe 14/2026 auf S. 120 Boinc mit Primegrid als Thema. Darin wurde die Optimierung Hardwarebeschleunigte GPU-Planung auf Aus stellen empfohlen:
1785850866607.png
Die Laufzeiten von GPU-WUs sollen sich demnach von 220 Sekunden auf 160 Sekunden reduzieren.
Ich habe es noch nicht ausprobiert. Vielleicht hat es auch Auswirkungen auf andere Projekte.
 
Zurück
Oben Unten