Einstein@home - allgemeiner Austausch (News, Forenfunde, HowTo, etc.)

Anhang anzeigen 59337

Wie gesagt, die 9070Xt rackert ...
40-60 Minuten laufen die bei 4 gleichzeitig ... 5 habe ich noch nicht getestet

1,2 Mio am Tag *noahnung*
Bei 16GB kannst Du da sicherlich auch gleich weiter probieren mit 6 und 7.
Erst bei 8 habe ich ein paar Minuten mehr Laufzeit als mit 7. Aber die Ausbeute ist trotzdem höher. Und noch mehr passt ja nicht mehr in den VRAM.
 
Nachdem wieder ein paar kalte Nächte angekündigt sind dürfen die beiden GPU Cruncher im Keller das Treppenhaus wieder mitheizen. *oink*
 
Die haben die Punkte schon wieder erhöht, jetzt gibt es 18.000Cr pro WU

Ich habe mal umgestellt auf 5 ... mal sehen
 
Bei mir landet gerade sehr viel beim Lagerverwalter. Soweit ich das gelesen habe, sind die Projektbetreiber immer noch am Feintuning des Validators.
 
Mich stört das die Lokale Konfig einfach ignoriert wird ... bei mir zieht nur die von E@H von der Website ...
Weiß nicht obs am Update von BOINC liegt oder an E@H

Und ja, bei mir wandert auch fast alles zum Chinesen ...

Interessant ist, ich habe 3 WUs die als invalid makiert sind ... gegen gecheckt von 2 mal NV ...
Das 2 NV ein ähnliches oder gleiches Ergebnis liefern ist mir klar ... die Frage ist, hätte eine AMD gegenprobe zu einem ungültigen Ergebnis auf der NV statt auf meiner AMD geführt ^^
 
Zuletzt bearbeitet:
Mich stört das die Lokale Konfig einfach ignoriert wird
Gibt es wenigstens eine Meldung von Boinc Manager, dass eine xml Datei für Einstein gefunden wurde?
Ich hatte mal den Fall, dass der Editor die Datei als app_config.xml.txt abgespeichert hat. *admin*
 
Das bei Einstein ein geringer Prozentsatz der WUs ausfällt ist doch eher normal, ebenso das nach längerere Auszeit locker 3/4 der WUs im Pending landen. Der Anteil sinkt im laufe der Zeit von selbst, wobei immer wieder WUs verdammt lange dort hocken bleiben weil User sie vergammeln lassen.

Das Quer validieren ist eher positiv zu bewerten weil so Berechnungsprobleme eines Clients nicht unentdeckt bleiben sondern sofort auffallen. Bei der normalen Ausfallrate treten diese übrigens auch beim VErgleich der Ergebnisse innerhalb einer Plattform auf.
 
Mein Invalid ist auf 0. Das war früher schlimmer auf AMD.

Und der output war vor ein paar Tagen schon mal viel höher. Die aktuellen WUs sind nur 5 Tage haltbar und der Rechner läuft schon mindestens so lange. Manchmal erwischt man leider einen wingman, der viel bunkert und wenig rechnet. Und wenn dann noch das Projekt am Validator optimiert, gibts eben manchmal Stau.
 
Einige meiner unbestätigsten WUs gammels seit über 2 Wochen vor sich hin.
Eine davon wurde erst nach 2 Wochen abgeschossen (10.1. - 24.1.) und beim nächsten gammelt sie auch schon seit dem 24.1. rum und läuft erst am 7.2. aus.
Ich rechne übrigens die MeerKAT WUs.
 
Mehr als 7 sorgen für wiederholte Treiberabstürze und der PC wird total laggy, vermutlich weil der VRAM überläuft ...
Sind es halt 7 und gut, ich lasse es mal jetzt erst so laufen und gucke mal wie es so aussieht
*noahnung*

Ab morgen läuft aber eh PG
 
Hab auf der 4090 jetzt wieder nur eine WU am laufen. Last liegt zwar nur bei ~60%, Laufzeit ca. 15 Min. Bei zwei gleichzeitig und 99% ganze 50 Min. Die Pro VII schafft in 2:18 Std 7 WUs, also ca. 20 Min/WU.
 
9070XT -> ~1:15h -> 7 WUs -> ~11 Min/WU
 
Hab auf der 4090 jetzt wieder nur eine WU am laufen. Last liegt zwar nur bei ~60%, Laufzeit ca. 15 Min. Bei zwei gleichzeitig und 99% ganze 50 Min. Die Pro VII schafft in 2:18 Std 7 WUs, also ca. 20 Min/WU.
Liefen die 2 zur gleichen Zeit los? Eigentlich nimmt man bei Nvidia nur 2 Stück, um den Teil zu überbrücken, der auf der CPU läuft. Dazu müssen die WUs aber zeitversetzt laufen, sonst klauen sie sich nur gegenseitig die Ressourcen.

Dass die VIIpro langsamer als meine VII ist, kommt mir seltsam vor. Sind da evtl. nicht genug CPU-Kerne reserviert oder ist die CPU nicht die Schnellste? Mit dem 5950X @4GHz gehts jedenfalls besser als nur mit 3GHz. Denn die WUs auf den AMD-Karten haben trotzdem immer noch gut 60% CPU-Last bei mir.
 
Welche WUs sind denn genau am laufen?
Binary Radio Pulsar Search (MeerKAT BRP7), All-Sky Gravitational Wave search on O4 (O4AS) oder Multi-Directional Gravitational Wave search on O4 data (O4MDG)?
In jedem Fall sollte ein ganzer Kern für die WU reserviert werden und sich diesen nicht mit einem anderen Projekt teilen.
SMT wegen der CPU Lastigkeit also besser ausschalten.
 
Stimmt, dass müsste man jeweils dazu schreiben. Bei mir ging es die ganz Zeit immer um O4AS.
 
Bei denen wechselten sich meiner Erinnerung nach die Phasen mit CPU bzw. GPU Lastigkeit immer wieder ab, entsprechend wichtig ist deshalb auch die Leistungsfähigkeit der CPU für die WU Laufzeit.
 
Ich habe fast nur die O4AS, jede WU eine CPU und die CPU ist auch nicht gedrosselt oder dergleichen und der 9600X läuft daher bei ~5,2GHz sowie die GPU bie ~3,4GHz läuft bei ~230W
 
Bei den alten FGBRP oder so, reichte ein freier CPU-Thread nicht, es musste ein ganzer Kern sein, also bei AMD 2 Threads. Bei den O4AS hab ich noch nicht weiter geschaut, ob es da auch zwingend nötig ist.
 
Ich würde sagen es reicht ein Thread, zumindest sagen meine Zeiten das ^^
Die 9070XT gehört ja scheinbar hier mit zu den schnellsten wenn die mehr Cr pro Stunde macht als ne 4090 :P
 
Dei Frage ist immer ob z.B. noch CPU Projekte parallel laufen.
Gerade im Zusammenspiel mit SMT hatte ich zu oft die Erfahrung gemacht dass die CPU WUs den Vorrang bekommen und der GPU WU auf dem zweiten Thread die CPU Laufzeit wegfressen.
Das kann dann die WU Laufzeit der Einstein WUs erheblich verlängern.

Edit:
Bei den Gravitational Wave search WUs mußte ich wiederum die Erfahrung machen das sie für meinen Cruncher mit den Pro Duos völlig unbrauchbar waren weil die selbst mit 2 parallel laufenden WUs den 4 GB großen VRAM sprengten.
Bei 7 GPUs und lediglich 16 GB RAM quoll letzterer dann auch noch über und blähte die Auslagerungsdatei auf bevor die Kiste abschmierte. Was das für die WU Laufzeit bedeutete brauche ich wohl nicht weiter zu erörtern.
 
Zuletzt bearbeitet:
Ja es laufen auch noch CPU WUs, stimmt schon das die Auslagerungsdatei recht voll ist, liegt aber nicht direkt daran das der RAM voll ist bei mir, da wären noch über 14GB frei 🤷‍♂️
 
Bei mir war es da ziemlich eindeutig.
Der RAM war zu 95% gefüllt und jede nach Fortschritt der WU waren pro GPU mehr als 1 GB gemeinsamen GPU Speicher (in RAM ausgelagerter Teil) fällig. Das Auslagern des VRAMs in den RAM verlängerte die WU Laufzeit bereits erheblich und das Sprengen des RAMs brachte das System letztendlich zum Absturz.
Das Gemeine daran war das die VRAM Belegung nicht sofort stattfand sondern erst mit der Zeit das kritische Level erreichte.

Hast du also mal den Füllstand des VRAMs beobachtet wenn die WUs deutlich länger benötigen als sie sollten?

Der andere Punkt war wie gesagt das sich die WUs den CPU Kern nicht mit anderen teilen sollten. Selbst bei den MeerKAT WUs liegt die CPU Auslastung der beiden Ripper (1900x, 1950x) bei ca. 45-50%.....bei 8 bzw. 14 parallel laufenden WUs, einem reservierten Thread/virtuellen Kern pro WU und aktivem SMT.

Die Radeon VIIs (4x, 1900x) benötigen dabei ca. 10 Minuten pro MeerKAT WU, die Fiji Chips der Pro Duos (6x, 1950x) sind mit ca. 20-25 Minuten dabei und die 290x (1x, Ersatz für durchgebrannte Pro Duo) benötigt ca. 30 Minuten.
 
Liefen die 2 zur gleichen Zeit los? Eigentlich nimmt man bei Nvidia nur 2 Stück, um den Teil zu überbrücken, der auf der CPU läuft. Dazu müssen die WUs aber zeitversetzt laufen, sonst klauen sie sich nur gegenseitig die Ressourcen.

Dass die VIIpro langsamer als meine VII ist, kommt mir seltsam vor. Sind da evtl. nicht genug CPU-Kerne reserviert oder ist die CPU nicht die Schnellste? Mit dem 5950X @4GHz gehts jedenfalls besser als nur mit 3GHz. Denn die WUs auf den AMD-Karten haben trotzdem immer noch gut 60% CPU-Last bei mir.
Aktuell rechne ich O4AS.
Das versetzte Starten hilft auf der 4090 immer nur 1-2 WUs lang, dann pendeln die sich so ein, dass die wieder gleichzeitig laufen. Einzel brauchen die inzwischen 9:40 Min, im 2er Pack 5x so lange.

Hatte anfangs noch Gaia@Home auf der CPU laufen lassen. Damit war die Laufzeit insb. am Ende der WU ab 75% unendlich lang. Teilweise 30 Min statt 5. Beim Pausieren von Gaia (Projekt anhalten) hab ich irgendwann bemerkt, dass die WUs trotzdem weiter die Kerne mit 100% belasten. Jetzt ist Gaia aus und ich komme auf die o.g. Zeiten (Linux Mint, 7950X, 64GB).

Die Pro VII sitzt im 7900X, 32GB, Win11. Da läuft nur Einstein. Einzige Begrenzung in dem System ist die CPU Temperatur auf 80 Grad, womit 5,3GHz erreicht werden.
 
Bei mir auf der VII laufen die O4AS-WUs (4 parallel) > 2h - der 5900X ist zwar auf 65W gedrosselt, boostet damit aber auch auf ca. 4,5GHz., weil sonst nix läuft...
Braucht's da auch noch hohen RAM-Durchsatz? (RAM ist nämlich auf 2,666 GHz gedrosselt, damit der MC sparsamer laufen kann und die CPU mehr Saft kriegt) *kopfkratz
Eine 5. WU will nicht parallel starten, obwohl der BM korrekt anzeigt, dass eine WU 0,2 GPUs belegen soll(te).. *noahnung*
Wobei die GPU in der Spitze schon auch über 90% Auslastung kommt - dabei aber auch kaum mehr als 50W zieht...

Sehr seltsam diese WUs... :]
 
Zurück
Oben Unten