All-Sky Gravitational Wave search on O4ab v2.15 (GW-opencl-nvidia-2G)

Na da werde ich wohl gleich mal neue Arbeit aufnehmen.
 
Na dann mal Angriff :P

Ich will mal sehen ob ich noch nen Punkt beim FB Marathon bei Einstein abgreifen kann aber denke eher nicht

RTX5080 -> 3,5 Mio am Tag
2x RTX3060Ti -> 4,5Mio am Tag

Aber ACHTUNG, die App von Ian&Steve hat keine Checkpoints, wenn man die also anhält starten die wieder bei 0
 
Zuletzt bearbeitet:
Mit der neuen App unter Windows mehr als deutlich schneller. Ca 4,2 Mio Cr für diese Windows Version pro Tag
h1_0169.20_O4abC00Cl1In0__O4abAS1_169.50Hz_455_010300200372 Aug 2026 10:38:54 UTC2 Aug 2026 11:14:42 UTCCompleted, waiting for validation1.4491.9820All-Sky Gravitational Wave search on O4ab Anonymous platform
 
Läuft bei dir eine oder 2 WUs gleichzeitig?
 
Nein, nur 1 WU
P.S. Unter Linux hat sich nichts getan. Dort sind die Zeiten wie vorher.
 
Stell mal 2 an ;)
Dann brauchst 200-300s länger pro WU aber hast eben 2 fertig, ich wollte es nochmal mit 3 probieren

Habs mal umgestellt ... mal sehen
 
Auf meiner 4070 lohnen sich 2 WUs nicht.
Eine braucht ja 1472s, 2 parallel ergeben 3120s. Also sogar mehr als die doppelte Zeit. Dazu schwankt der GPU-Takt ziemlich heftig. die 12GB VRAM wurden im Maximum zu 71% belegt.
Es mag vielleicht besser werden, wenn die beide nicht zur gleichen Zeit starten. Aber mehr als Gleichstand 1 WU vs. 2 WU erwarte ich da auch nicht.
Mit CUDA hatte ich bisher noch nie wirklich sinnvoll 2 WUs parallel laufen - egal in welchem Projekt.
 
Naja die 5080 macht aber halt fast doppelte Punkte *noahnung*
Und bei mir starten auch beide gleichzeitig, daher kann ich nur sagen unter Windows hats was gebracht ... ich lasse jetzt mal 3 laufen probehalber aber denke das keinen Vorteil mehr bringt, zumal sie jetzt alle zur gleichen Zeit starten ...
Allerdingts liegt die Buslast auch bei 100% ... das zeigt meistens dass das Problem an anderer stelle liegt

3 Bringen nichts sondern werden langsamer
 
Zuletzt bearbeitet:
h1_0171.20_O4abC00Cl1In0__O4abAS1_171.50Hz_444_110308191945 Aug 2026 11:54:11 UTC5 Aug 2026 12:18:08 UTCCompleted, waiting for validation1.4191.4150All-Sky Gravitational Wave search on O4ab Anonymous platform
h1_0171.20_O4abC00Cl1In0__O4abAS1_171.50Hz_443_110308191955 Aug 2026 11:54:11 UTC5 Aug 2026 12:18:08 UTCCompleted, waiting for validation1.4211.4160All-Sky Gravitational Wave search on O4ab Anonymous platform

Dauert zwar noch bis die validiert sind aber für 2 gleichzeitig gestartete WUs eine gute Leistung. Da würden wohl so 8 Mio Credits bei rausspringen bei 24h mit 2 WUs.
 
Jo sind auch so 200-300s würde ich sagen, ich habs bei dem anderen PC noch nicht umgestellt ... hatte noch kein Bock auf neustarten, werde ich dann nachher evtl mal machen.
Hast du so mal gezockt und Probleme oder nachteile feststellen können?

Wenn ich dran denke werde ich es mal mit der 9070XT testen wenn ich Sonntag wieder zuhause bin, scheinbar hat hier sonst ja kaum noch jemand ne AMD Karte im Einsatz ^^
 
Zuletzt bearbeitet:
Allerdingts liegt die Buslast auch bei 100% ... das zeigt meistens dass das Problem an anderer stelle liegt
In meinem Fall ist es noch ein X470 Board, also nur PCIe3.0.
Dafür werkelt die RadeonVII (PCIe3.0) auf einem B550er Board mit PCIe4.0. Ist vielleicht nicht optimal verteilt...
 
Naja gut auf meiner 5070 starten auch beide gleichzeitig, dort liegt die BUS-Last aber unter garantie auch bei 100% bei 2 gleichzeitig ist durch den schnelleren Link aber vllt nicht ganz so problematisch
 
Doch - aber die 6900XT konnte ich gerade erst erfolgreich überreden, die angepasste App zu verwenden (und ich musste sie Temperaturbedingt noch etwas weiter drosseln)...
Und die VII will die angepasste App überhaupt erst gar nicht verwenden - inzwischen kommen im Log zwar keine Fehler mehr - aber der BM lädt einfach die Standard-App von Einstein runter und cruncht mit dieser - die andere App lässt er einfach links liegen... *noahnung*
Die Umstellung dieser "Timing-Funktion" bietet wiederum nur der Rechner mit der VII an (und ich reboote ja so schrecklich ungern)....
Es ist kompliziert... *chatt*
(Und den Rechner mit der 5060TI will ich jetzt nicht anwerfen, sonst knacke ich die 30° im Büro - ich mag's zwar warm, aber "dauerhaft" > 30° im Büro sind sogar mir ETWAS zu viel.. ;D
 
Bei mir im Wohnzimmer gehts eigentlich, sind 25°C hier aber es scheint auch den ganzen Tag die Sonne hier drauf und die beiden PCs heizen mit fast 1KW xD
Dann bin ich ja mal gespannt was du sagst ob und wieviel es auf der 6900XT bringt :)
 
Dann bin ich ja mal gespannt was du sagst ob und wieviel es auf der 6900XT bringt :)
Die berechneten WUs sind noch nicht validiert - aber die Zeiten sind DRASTISCH nach unten gegangen :o :
Von gut 12.000s pro WU (immer 2 parallel!) auf so ca. 2.500 - 3.500s - und das auch noch bei ~ 10% weniger Takt (jetzt 2 GHz)!

Nur die VII lässt sich immer noch nicht zu ihrem Glück zwingen:
Jetzt nimmt er zwar die optimierte App, dafür crashen die WUs nach 1-2 Minuten... :]
"hipfft.dll not found" --> da scheint wohl ein File zu fehlen...
Kennt jemand das Problem?
Woher bekomme ich die passende Version - und würde es reichen, das einfach ins Projektverzeichnis zu kopieren? *kopfkratz
 
Allerdingts liegt die Buslast auch bei 100% ... das zeigt meistens dass das Problem an anderer stelle liegt
Das beobachte ich bei den RTX 5000 regelmäßig. Die 4000er machen das nicht *noahnung*
 
Das beobachte ich bei den RTX 5000 regelmäßig. Die 4000er machen das nicht *noahnung*
Seh' ich bei der 5060TI auch - allerdings hat die nur 8 PCIe5.0 Lanes und steckt in einem 16x 4.0 Slot, deswegen hab' ich mir da nie viel gedacht. Ich merke bei der "kleinen" Karte auch keinen nennenswerten Performanceverlust dadurch...
 
Heute hat Smart App controle aus heiterem himmel die App kurzerhand blockiert, allerdings nur auf dem Intel, auf dem AMD lief das problemlos durch ...
Das verstehe wer will ....
 
Die VII will einfach nicht mit der optimierten App:
Ich hab' inzwischen das HIP SDK von AMD runtergeladen (in einer älteren Version, die Gemini für die VII vorgeschlagen hatte) und installiert. Die fehlende dll-Datei ist darin enthalten - zur "Sicherheit" hab' ich sie auch ins Projekt-Vz kopiert. Aber die WUs crashen trotzdem noch mit einer Access-Violation - hier z.B.:
Ist Vega also doch nicht supported? Oder welche Version dieses HIP bräuchte ich dafür genau? Hat da jemand evtl. eine Doku? *noahnung*

Die 5060TI rennt dagegen mit der optimierten App (genaue Laufzeit-Vergleiche hab' ich nicht - aber es dürfte knapp das 3x sein!)!
Nur ist die GPU mit einer WU schon nicht ganz ausgelastet - hier scheinen die 8 Lanes, die am X570 halt nur mit PCIe 4.0 laufen der Bottleneck zu sein (100% Busauslastung - sehe ich oft bei der Karte). 2 parallele WUs - leicht zeitversetzt gestartet - verschlimmern die Laufzeiten eher, als dass sie (unter'm Strich) Besserung bringen...

Hat jemand schnellere Blackwells an PCIe 4.0 am laufen? Oder alternativ eine x8-Karte an PCIe 5.0?
Mich würde da die Busauslastung und in Folge die GPU-Auslastung interessieren...
Oder hat jemand eine 5090 an PCIe 5.0 am Start? *oink*
Die sollte ja die gut 4fache Rechenleistung der 5060Ti haben - bei der dann 4x Bandbreite...
 
Die 5080 hängt schon an PCIe 5.0 durchgängig bei 100% Buslast mit 2 WUs und selbst die 5070 hängt mit 2 WUs bei 100% Buslast trotz PCIe 5.0
 
Das beobachte ich bei den RTX 5000 regelmäßig. Die 4000er machen das nicht *noahnung*
Seh' ich bei der 5060TI auch - allerdings hat die nur 8 PCIe5.0 Lanes und steckt in einem 16x 4.0 Slot, deswegen hab' ich mir da nie viel gedacht. Ich merke bei der "kleinen" Karte auch keinen nennenswerten Performanceverlust dadurch...
Scheinbar ist die angezeigte Buslast bei GPU-Z oder HWInfo64 nur ein Fehler beim Auslesen. Der ist bekannt und soll angeblich mit einem Treiberupdate behoben werden. Schrieb jemand von NV vor 7 Monaten. *buck*


Kann natürlich auch an der Arbeitsweise der Tools liegen. Irgendwo hab ich auch gelesen, man soll PCIe von "Auto" auf "4.0" im BIOS umstellen, weil das bei einigen Chipsätzen die Signalqualität verbessern und die Last durch Fehlerkorrektur verringern soll. Keine Ahnung ob das stimmt.

Nächste Woche kann ich das nochmal vergleichen. Hab zwei fast identische 7950X Systeme mit gleichem Mainboard. Einmal mit 4070 Ti Super und einmal mit 5080.
 
Nächste Woche kann ich das nochmal vergleichen. Hab zwei fast identische 7950X Systeme mit gleichem Mainboard. Einmal mit 4070 Ti Super und einmal mit 5080.
Systeme: 7950X, Gigabyte Gaming X AX B650, AGESA 1.3.0.1c, NV Treiber 610, Win 11
Test WU: SRBase LL-dc (hab gerade keine Einstein bekommen)
GPU-Z 2.70.0

RTX 5080 16 GB GDDR7, 64GB DDR5-6000CL32
GPU load: 94%
Memory Controller load: 41%
Bus Interface load: 83%
Board Power Draw: 288W

RTX 4070 Ti Super 16GB GDDR6X, 64GB DDR5-5600CL30
GPU load: 95%
Memory Controller load: 76%
Bus Interface load: 0%
Board Power Draw: 185W

Die Werte schwanken ein wenig. Ob ich im BIOS PCIe Gen 4 oder 5 einstelle macht keinen Unterschied.
 
Scheint also irgendwie ein auslesefehler oder sowas zu sein ...
Anders ist das ja fast nicht zu erklären so wie ich das sehe
 
Zurück
Oben Unten