Grafikkartentreiber stürzt ständig ab

@LukS
Ich habe hier mal einen Screenshot erstellt, kurz nach dem das letzte Mal der Grafikkartentreiber abgestürzt ist.
Vielleicht könnt ihr mir ja durch diesen Screenshot weiterhelfen.

Ich habe außerdem im Internet gelesen, dass man bei diesem Fehler MPO deaktivieren soll. Auch wenn das hier von NVIDIA ist, scheint es laut Reddit unabhängig vom Grafikkartenhersteller geschweige denn der Grafikkarte zu sein. Ich habe das mal deaktiviert, da durch läuft es wohl nur noch softwareseitig. Bisher noch kein neuer Fehler, aber ich habe auch noch nicht all zu viel gemacht.

https://nvidia.custhelp.com/app/ans...ady-driver-461.09-or-newer,-some-desktop-apps

mpo_disable.reg:
Windows Registry Editor Version 5.00

[HKEY_LOCAL_MACHINE\SOFTWARE\Microsoft\Windows\Dwm]
"OverlayTestMode"=dword:00000005

--

mpo_restore.reg:
Windows Registry Editor Version 5.00

[HKEY_LOCAL_MACHINE\SOFTWARE\Microsoft\Windows\Dwm]
"OverlayTestMode"=-
 

Anhänge

  • Image.png
    Image.png
    52,6 KB · Aufrufe: 26
redjack1000 schrieb:
Was steht in den Dateien?

Anhang anzeigen 1749696

Cu
redjack
Bin etwas verunsichert die Dateien zu schicken, weil da wirklich jede Menge sensible Daten drin stehen und das hier ja alles öffentlich ist. Hast du eine Idee wie ich das machen kann? Kann ich sie dir privat schicken?
 
@redjack1000 Hm ok, schade. Ich hoffe jetzt erstmal das mit dem MPO, was ich oben erwähnte war die Lösung. Bin mal gespannt.
 
Du sollst auch mal deiner GPU eine Stütze vorne geben die hängt schon sehr durch. Nicht das dir irgendwann der PCI Konnektor abreißt.
 
  • Gefällt mir
Reaktionen: qiller
@qiller Es gibt aktuell nur Workarounds. Die Lösung muss von AMD kommen. Auf die warten wir ja seit 2019. Seitdem ist das Problem mit Driver Timouts nicht vollständig treiberseitig und seitens der Display Engine behoben.
 
Also keiner der AMD Grafikkarten, die ich die letzten Monate und Jahre vor der Nase hatte und nicht defekt waren, hatten irgendwelche Treiberabstürze. Und der TE offensichtlich auch nicht, sonst würde er ja nicht das hier schreiben:
2002david schrieb:
Seit einiger Zeit habe ich mit ständigen Abstürzen meines Grafikkartentreibers zu kämpfen.
Sprich, es funktionierte ja vorher - trotz aktivierter Hardwarebeschleunigung bzw. MPO. Wenn dem nicht so wäre, würden solche Foren wie hier ja regelrecht geflutet werden. Denn aktiviertes MPO und Hardwarebeschleunigung ist nunmal der Standard.
 
  • Gefällt mir
Reaktionen: Hibbelharry, LukS und Detti55
Ich hatte mit meiner bisher auch keine Treiberabstürze :)
 
@2002david:


Das stinkt ggfls. nach RAM!
Danach ggfls. Netzteil - hast du 2 x 8 PIN PCIe einzelne Kabel an die GPU gesteckt und sind das 2 x einzelne Stecker am Netzteil selbst?
Ein Kabel mit 2 x 8 PIN Stecker reichen nicht!


Du nutzt als Mainbaord / Sockel: Intel 1700 (LGA1700) - schau mal Bitte auf die QVL deines Motherboards:
https://www.gigabyte.com/Motherboard/B660-GAMING-X-DDR4-rev-10/support#Support-Memory-Support

Sollen das hier deine RAMs sein = Part / Modulnumber BL8G36C16U4BL?
https://geizhals.eu/crucial-ballistix-rgb-schwarz-dimm-8gb-bl8g36c16u4bl-a2271459.html

Gerne direkt mal Foto machen von den ausgebauten einen RAM Riegel (Aufkleber & Typenbezeichnung).

Falls es genau die RAMs sind, teste im BIOS diese RAM Settings nur mit einen Ram Riegel! mehr geht mit dem RAM im Test bei Gigabyte wohl nicht sauber / stabil ~ wird man sehen / ggfls. je nach BIOS Version).
3600BALLISTIX8GB1Rx8BL8G36C16U4BLSSMicron16-18-18-381.35vVv2666v
2026-07-30 19_36_22-.png

Hier ist dein Motherboard Handbuch für den Ram Einbau (Slots) je nach Modul Menge (Riegel Anzahl) - Seite 13 - bei einem RAM Modul zweiter (A2) oder letzten RAM Slot (B2) nutzen (gilt wohl auch für 2x Riegel / Dual Channel Mode diese Slots!):
https://download.gigabyte.com/FileL...e_1001.pdf?v=ef338cab8a08d5dc1c788ea213ed7b5b
2026-07-30 19_47_29-Einstellungen.png

Bitte BIOS Fotos machen (Bereich OC + RAM).

Danach bitte mal nur 1 Ram Riegel stecken + testen (AUTO BIOS Settings oder RAM Settings nach oben anpassen, falls es genau der RAM nach Aufkleber sein sollte ~ passende 65 W TPD auswählen für deinen CPU Kühler falls es das noch gibt - für RAM OC / RAM Taktraten und CPU OC Settings zeigen = Bestenfalls OC zuerst einmal deaktivieren / sonst läuft alles außerhalb der Standard Spezifikationen).

Dann mal ausgiebig testen.

Danach können wir das Setting als Standard Profil sichern und erst danach OC betreiben + neues BIOS Profil!

BIOS Handbuch (falls wir das brauchen sollten u.a. für OC und die richtigen Einstellungen finden können):
https://download.gigabyte.com/FileL...s_e_v3.pdf?v=e176cfcc0bb7f8b739252e4d3b0b9101

Hast du das Verhalten erst nach einen bestimmten Ereignis / Änderung (Hardware / BIOS)?

Was ist das für eine PCIE Karte unterhalb der GPU (nur falls die neu verbaut wurde)?

Zeig mal bitte später die Ereignisanzeige / kritische System Meldungen (als Admin ausführen / starten) - kann man dann filtern rechts.
2026-07-30 18_27_39-Ereignisanzeige.png 2026-07-30 18_27_06-Ereignisanzeige.png

Auch bitte mal die Sensoren von HWInfo zeigen (Temps) via rechte Maustaste - HWInfo Symbol - Sensoren.


---
Ich habe auch so viele AMD GPUs und NVIDIA GPUs gehabt in den letzten 20 Jahren / jede neue Gen ~ lasst die Leute wie @Bono35 labern.
Ich habe nie Probleme mit Standard Settings (Kein GPU OC / UV).
 
Zuletzt bearbeitet:
@Blaze1987
das war mein Screenshot und das war nur ein Beispiel. Der ist nicht vom TE
 
  • Gefällt mir
Reaktionen: Blaze1987
Bono35 schrieb:
@qiller Es gibt aktuell nur Workarounds. Die Lösung muss von AMD kommen. Auf die warten wir ja seit 2019. Seitdem ist das Problem mit Driver Timouts nicht vollständig treiberseitig und seitens der Display Engine behoben.

Das halte ich so für Quatsch. Das Fenster mit dem Treibertimeout kommt immer dann, wenn die GPU irgendwo hängen bleibt. Dafür gibts zig tausend Gründe, die das aulösen könnten, sehr sehr viele. Nach vorne raus siehts aber immer gleich aus, das immerselbe Fensterchen kommt. Dann zu behaupten alles wäre immer gleich, AMD muss etwas oder am besten eine bestimmte Sache tun, nur dann läufts, ist ziemlich plump. PCs und GPUs sind komplexe Biester.

Das ist grob wie die Motorkontrolleuchte im Auto. Die sagt fahr in die Werkstatt, denn die leuchtet auch für 1000 Ursachen immer gleich auf und du weisst nicht welche. Vielleicht ist kein ÖL mehr drin, eine Zündspule ist kaputt, es zieht Nebenluft oder der Turbolader erreicht seinen Solldruck nicht. Zig verschiedene Fehler, nur eine Lampe.

Mal ein Beispiel aus meiner IT Welt hier: Ich betreibe hier ein Setup mit einer Ryzen 9000 CPU und einer RX9070XT, 2 Monitro mit unterschiedlichem Refresh und Windows 11. Direkt nach dem Einbau war das Driver Timeout Tool mein bester Freund, wir haben uns oft gesehen. Da der Rechner vorher mit einer anderen AMD GPU soweit lief, habe ich zuerst an einen Hardwaredefekt geglaubt. Aber ein schnell veranlasster Austausch brachte genau gar keine Besserung. Und ein dann gemachter Gegencheck meiner Grafikkarte in einer anderen Kiste, an die ich herankommen konnte, zeigte dort keine Auffälligkeiten. Das Ding lief dort.

Also hab ich Sachen auf meiner Kiste ausprobiert. Viele Sachen. Es gab dort den sporadischen Crash beim spielen, dann mal einen Freeze des Desktops. Insbesondere Videos im Browser schauen, nachdem der PC zuvor im Suspend Modus war, war ein relativ brauchbarer Trigger. Ich hab dann mal mein Netzteil ausgetauscht, das brachte nichts. Neue Treiber für Chipsatz und GPU senkten die Frequenz der Ausfälle, aber brachten die nicht auf 0. Das Abschalten von HAGS brachte nichts, das Abschalten von MPO senkte die Frequenz der Probleme aber nochmal deutlich spürbar weiter. Ich hab ein MSI Board, da liest man auch gerne von PCIE Problemen, wenn Spread Spectrum nicht an ist. Das aktivieren davon, brachte mich dann Richtung 0. Immernoch ein leicht ungutes Gefühl, aber ich war gewillt damit zu leben. Das waren mir zuviele Faktoren auf einmal, die ich beachten muss.

Dann hab ich nochmal ein BIOS Update für mein MSI Mainboard gemacht, das hat mich einen ganzen Abend gekostet. Erstmal kam die Kiste ums verrecken nicht mehr durch den UEFI POST. UEFI zurückgesetzt. Dann hab ich versucht Expo wieder zu aktivieren und die Spannungen sahen dann teilweise komisch aus. Ich hab dann nochmal die Defaults geladen und nichtmal Expo aktiviert und das einfach mal so probiert. Noch mehr Generve! Aber das lief.

Aus purem "nochmal neu eingrenzen"-wollen, hab ich dann mal MPO in WIndows wieder aktiviert, kein Problem. Dann hab ich Spread Spectrum im Bios deaktiviert, kein Problem. Dann habe ich Expo wieder aktiviert, und zack gings wieder los. Aber 0 Fehler in Memtest86 oder Prime95, etc. Auch keine fühlbar abstürzenden Desktopapps. Ich hab dann mal die SOC Spannung der CPU von Standard 1.2V auf 1.25V angehoben, und seitdem sind alle Probleme weg. Ich kann machen was ich will, solange ich die SOC Spannung der CPU nicht unter 1.25V senke, das ist jetzt der einzige Parameter bei mir den ich noch beachten muss.

Ich würde nun sagen, ich hab schon sauviele PCs vor mir gehabt zur Fehlersuche, ich hab diverse Jahre als IT Techniker gearbeitet. Das mache ich nicht mehr, aber ich weiss ein bisschen was. Bei der Fehlersuche hier hab ich mich verrannt. Ich hatte auch nicht mehr als die allgemein Timeout Meldungen, die sagen es gab irgendeinen Fehler. Aus den Dumps wurde ich nicht schlau, da war kein Muster. Ich habe dann irgendwas geändert, und aus einer folgenden Änderung der Häufigkeit der Fehler darauf geschlossen, dass ich auf dem richtigen Weg bin. Und dann hab ich für mich behauptet MPO ist im AMD Treiber buggy, das Powermanagement wie ASPM wohl auch, ganz schön übel. Und MSI Mainboards waren auch schon mal besser. Da war ich zum grossen Teil auf dem Holzweg. Die SOC Spannung der CPU macht GPU Crashes, aber sonst nichts spürbares? Echt wieder was gelernt...
Ich kann jetzt AMD Treiber nehmen wie ich Lust habe, läuft. Ich kann 2 Tage durchzocken oder alle Folgen von lustigen Katzenvideos am Stück im Browser schauen, bei aktiver Hardwarebeschleunigung. Der Weg war k*cke, aber jetzt isses easy.

Und mit all dem aus dem Beitrag hier, glaubst du da wirklich immernoch du schaust auf 1 oder 2 singuläre Probleme, die immer im Einfluss von AMD GPUs liegen?

Am Ende auch nochmal was für den Threadautor.: Deine Kiste sieht auch recht staubig aus. Tut die Kühlung noch was die soll? Check auch mal die Hotspottemperaturen deiner GPU unter Last. Wenn da die Paste ausgetrocknet ist und ein kleiner Teil der Oberfläche trocken gefallen ist, passiert auch der grösste Käse. Hohe Hotspot Temperaturen geben da oft ein Indiz. Müsstest du als Sensor in Adrenalin einblenden können.
 
  • Gefällt mir
Reaktionen: Blaze1987 und LukS
Sapphire Forum
Zurück
Oben