AMD Radeon RX 7900 XT - LiveKernelEvent 141 - vor allem im Browser

emulbetsup

Lieutenant
Registriert
Feb. 2008
Beiträge
617
EDIT: Gerade gesehen, dass ich falschen Subforum gepostet habe. Könnte ein Mod bitte den Thread entsprechend verschieben? Danke!


1. Nenne uns bitte deine aktuelle Hardware:

Prozessor (CPU): Ryzen 9 5900X
Arbeitsspeicher (RAM): 32 GiByte Kingston Server Premier DDR4-3200 mit ECC enabled
Mainboard: ASUS Pro WS X570-ACE, BIOS 5002
Netzteil: Seasonic Focus GX-850
Gehäuse: Fractal Design Define R6
Grafikkarte: AMD Radeon RX 7900 XT im Referenzdesign von XFX
HDD / SSD: Lexar NM790 4 TByte NVMe und SanDisk Ultra 3D 4 TByte SATA

Die Hardware läuft komplett auf Default.

Weitere Hardware, die offensichtlich mit dem Problem zu tun hat: Monitor von Viewsonic mit 3440 × 1440, FreeSync vorhanden, aber aktuell deaktiviert. Die RX 7900 XT hängt mit 2× 8-Pin am Netzteil. Bis 06/2025 lief im selben System eine Nvidia RTX 2070 unauffällig.

2. Beschreibe dein Problem. Je genauer und besser du dein Problem beschreibst, desto besser kann dir geholfen werden:

Ich versuche gerade ein Problem mit meiner RX 7900 XT einzugrenzen. Das System läuft unter klassischer 3D-Last nach bisherigem Eindruck stabil. Probleme treten bzw. traten vor allem im Browserbetrieb mit aktivierter Hardwarebeschleunigung auf, am Zuverlässigsten zu Triggern in Chrome/Firefox auf X/Twitter.

Das Fehlerbild:
  • Mit aktivierter Hardwarebeschleunigung im Browser kam es wiederholt zu Grafikfehlern/Mosaikmustern bzw. blockartigen Artefakten. Außerdem kommt es immer wieder zu Treibertimeouts.
  • Diese Artefakte und Treibertimeouts verschwinden, wenn ich die Hardwarebeschleunigung im Browser deaktiviere.
  • Im Zuverlässigkeitsverlauf bzw. in den WER-Daten tauchen nach den Treibertimeouts dazu LiveKernelEvents auf, insbesondere 141.
  • Bei einem aktuellen Test mit deaktiviertem MPO und wieder aktivierter Chrome-Hardwarebeschleunigung auf X/Twitter kam es erneut zum Fehler. Der Rechner startete dabei neu.
  • Im Zuverlässigkeitsverlauf standen danach mehrere Hardwarefehler, u. a. mit den Codes 141, a2000002, a1000001, 124, 124, a2000002.
  • Der WHEA-Logger zeigte passend dazu Event ID 18 mit:
    • ErrorSource 3
    • ApicId 8
    • MCABank 5
    • MciStat 0xbea0000001000108
    • ErrorType 9
    • TransactionType 2
  • Nach meinem Verständnis spricht ErrorType 9 eher für Bus/Interconnect als für einen klassischen CPU-Cache- oder RAM-Fehler.
  • Wichtig: Der WHEA/124-Fehler kam nicht als erstes, sondern im Zusammenhang mit einem bereits instabilen Grafik-/Treiberzustand. Meine Vermutung wäre daher, dass der Grafik-/Recovery-Pfad eventuell den PCIe-/Interconnect-Pfad mit in den Fehlerzustand reißt.
  • Der Fehler ist sehr selten, solange Browser-Hardwarebeschleunigung deaktiviert ist. Einen Neustart hatte ich in dieser Form nur zweimal. Die Browser-Artefakte bzw. Probleme mit Hardwarebeschleunigung lassen sich dagegen deutlich besser einordnen bzw. reproduzieren.

Beispiel für die Artefakte ziemlich bald nach der Installation aus 06/2025. Es machte dabei ein Unterschied, ob der Text markiert wurde oder nicht. Seit der Deaktivierung der Hardwarebeschleunigung im Browser habe ich diese Artefakte nicht mehr gesehen.
1781778856024.png


Letzte große Eskalation mit den Fehlern 141, a2000002, a1000001, 124, 124, a2000002. Normalerweise kommt lediglich ein Treibertimeout. Dass das ganze System mitgerissen wird, hatte ich vor dem Event hier noch einmal im Januar. Daraufhin habe ich den Treiber aktualisiert.
bf5ae30a-7c1a-4190-b331-fa5a3dea4e34.png


Was mich verunsichert: Es gibt im Netz einige Berichte über AMD/RDNA3-Probleme mit Browser-Hardwarebeschleunigung, insbesondere Chromium/Chrome/X/Twitter/Video/WebView. Daher halte ich ein Treiber-/Browser-/Hardwarebeschleunigungsproblem für plausibel. Gleichzeitig möchte ich natürlich keine tatsächlich teildefekte Grafikkarte im System behalten.

Die Frage ist daher:
Spricht das Gesamtbild eher für ein bekanntes AMD-/Chromium-/Hardwarebeschleunigungs-/Treiberproblem, oder sollte ich die RX 7900 XT aufgrund von Artefakten + LiveKernelEvent 141 + zweimaligem WHEA 124/Neustart eher als verdächtig bzw. reklamationswürdig ansehen?

3. Welche Schritte hast du bereits unternommen/versucht, um das Problem zu lösen und was hat es gebracht?

  • Browser-Hardwarebeschleunigung deaktiviert:
    Danach verschwanden die Treibertimeouts im Browser vollständig bzw. traten nicht mehr reproduzierbar auf.
  • Browser-Hardwarebeschleunigung wieder aktiviert:
    Probleme auf X/Twitter wieder provozierbar bzw. zumindest erneut aufgetreten.
  • MPO deaktiviert per Registry:
    HKLM\SOFTWARE\Microsoft\Windows\Dwm
    OverlayTestMode = 5
    Danach Neustart.
    Ergebnis: MPO scheint nicht die alleinige Ursache zu sein, da der Fehler mit aktivierter Chrome-Hardwarebeschleunigung trotzdem erneut auftrat.
  • FreeSync/VRR geprüft:
    FreeSync ist vorhanden, war aber bereits deaktiviert. Monitor wird mit 144Hz angesteuert.
  • PCIe-Verbindungszustand-Energieverwaltung in Windows deaktiviert:
    Energieoptionen → PCI Express → Verbindungszustand-Energieverwaltung → Aus.
    Ob das langfristig hilft, ist noch offen.
  • FurMark 2 getestet:
    Vulkan bei 3440 × 1440 lief mit hoher Last ohne Artefakte. Artifact Scanner zeigte über 30 Minuten 0 Artefakte.

    Werte mit Standardlüfterkurve (66% maximale Drehzahl) waren ungefähr:
    GPU ca. 81 °C
    Hotspot ca. 102 °C
    VRAM ca. 99 °C
    Power ca. 309 W
    Lüfter ca. 67 %

    Mit angehobener Lüfterkurve (80% maximale Drehzahl):
    GPU ca. 73 °C
    Hotspot ca. 94 °C
    VRAM ca. 92 °C
    Power ca. 310 W
    Lüfter ca. 82 %
    weiterhin 0 Artefakte

    Thermisch wirkt die Karte unter FurMark daher für mich nicht offensichtlich defekt. Der Kühler scheint auf höhere Lüfterdrehzahl normal zu reagieren.

  • 3D/Gaming:
    Nach bisherigem Eindruck keine Probleme unter 3D-Last. Das Problem sitzt eher im Desktop-/Browser-/Hardwarebeschleunigungs-/DWM-/WebView-/Chromium-Pfad.
  • Treiber:
    Das System wurde beim Wechsel von Nvidia auf AMD sauber neu installiert. Außerdem wurde der AMD-Treiber einmal sauber deinstalliert und neu installiert. Aktuell ist der neuste AMD-Treiber installiert. Das Problem scheint also nicht nur an einem sehr alten Treibern aus 05/2025 oder 01/2026 zu hängen. Artefakte im 2D hatte ich aber auch direkt nach der Erstinstallation 05/2025.
  • Autostart:
    Ich prüfe gerade zusätzlich Autostart-Programme, weil eventuell auch andere Apps mit WebView/Electron/Hardwarebeschleunigung den gleichen Pfad triggern könnten. Kandidaten wären z. B. Edge, Copilot, WhatsApp, Spotify, Adobe/Creative-Cloud-Komponenten, AMD Noise Suppression usw.
  • Noch nicht getestet:
    PCIe/PEG im BIOS fest auf Gen3 stellen. Das wäre noch ein möglicher Test, um PCIe-4.0-Link/Signalqualität/Recovery-Verhalten einzugrenzen. Die vorherige RTX 2070 war nur PCIe 3.0, die RX 7900 XT ist PCIe 4.0.
Mich würde interessieren, wie ihr das Fehlerbild einschätzt:

  • eher AMD-/Chromium-/Hardwarebeschleunigungs-/Treiberproblem oder eher diese konkrete RX 7900 XT?
  • kann der WHEA 124 in so einer Kette sekundär durch einen scheiternden GPU-Reset entstehen?
  • lohnt sich der PCIe-Gen3-Test noch?
  • oder würdet ihr die Karte bei diesem Fehlerbild nicht mehr behalten?
Die Hardware läuft sonst unauffällig. ECC ist beim RAM vorhanden und aktiv. Klassische RAM-/CPU-Probleme halte ich wegen des sehr GPU-/Browser-nahen Triggers aktuell eher für unwahrscheinlich, aber natürlich nicht völlig ausgeschlossen.
 
Zuletzt bearbeitet:
Sieht für mich nach VRAM Problemen der GPU aus. Dass die Deaktivierung der Hardwarebeschleunigung hilft, spricht dafür. Weil dann alles über die CPU läuft.
Du kannst es mal noch auf einem Linux-Live-USB testen, da musst du nichts installieren. Treiber sind dank AMD Karte sowieso schon im Kernel vorhanden.
Wenn das dort auch auftritt -> GPU Reklamieren.

Noch eine Anmerkung:
Falls du ein PCI 4.0 Riser-Kabel verwendest, versuch im Bios mal auf 3.0 umzustellen. Das war früher ein größeres Problem, unabhängig der GPU.
 
  • Gefällt mir
Reaktionen: emulbetsup und Schwobaseggl
@Wolfgang.R-357: Nein, die Karte ist normal eingebaut.

b4ca6b1a-490c-4729-bf9a-8df412f922e2.png



Mit angehobener Lüfterkurve (80% maximale Drehzahl) sind die Temperaturen besser.

GPU ca. 73 °C
Hotspot ca. 94 °C
VRAM ca. 92 °C
Power ca. 310 W
Lüfter ca. 82 %
weiterhin 0 Artefakte
 
Zuletzt bearbeitet:
Also die Temperaturen sind zu hoch. Das Delta von der GPU-Temperatur zum Hotspot ist mit 20 °C noch im Rahmen, aber die 102 °C sind doch ein bisschen zu viel. Die 92 °C auf dem VRAM sind ebenfalls sehr knackig. Laut Specs ist zwar beides noch im „grünen“ Bereich, aber doch schon sehr nahe an der 110-°C-Kotzgrenze.

Bezüglich der Temperaturen würde ich dir raten, einen besseren Airflow im Gehäuse zu schaffen und dir zu überlegen, die Wärmeleitpaste der Karte inklusive Putty oder Pads zu erneuern. PTM, MX, Dronaut – bei Igor gibt es eine super Tabelle. Statt Pads würde ich dir zu Putty raten, das bedeutet einfach weniger Stress beim Zuschneiden, Ausmessen etc.

Den Airflow bekommst du versuchsweise in den Griff, indem du das Seitenteil testweise offenlässt und einen Ventilator reinblasen lässt.

Zum Thema Kernel-Fehler kann ich dir leider weniger helfen, ich könnte mir aber gut vorstellen, dass es zum Teil mit den Temperaturen zusammenhängt.
 
  • Gefällt mir
Reaktionen: Wolfgang.R-357: und emulbetsup
@emulbetsup Sind deine genannten Temparaturen im Idle ohne Last? Dann ist das in der Tat viel zu hoch. Unter Last wäre es zwar auch zu hoch, aber noch im Rahmen. Wenn du im Browser ohne Last normale Temps hast und Software durch den Live-Linux-Stick ausschließen konntest, liegt es ziemlich sicher an einem Hardwaredefekt.
 
  • Gefällt mir
Reaktionen: emulbetsup
Zumindest bei AMD Grafikkarten ist bekannt, dass bei aktivierter Hardwarebeschleunigung im Browser zumindest auf manchen PCs Probleme auftreten können. Egal welcher Browser.
Wie es bei anderen Herstellern jetzt ist, weiss ich nicht. Die hatten aber wohl auch schon ab und an damit zu kämpfen.
Tritt angeblich wohl auch unter Linux auf, sagt das Netz.

Wenn es ohne Hardwarebeschleunigung nicht auftritt, lass sie einfach aus oder brauchst Du sie dringend?

Cunhell
 
  • Gefällt mir
Reaktionen: Schwobaseggl und emulbetsup
@FreshLemon Die Werte sind aus Furmark2. Die Temperaturen im Idle müsste ich heute Abend nachreichen.

Linux werde ich heute Abend ebenfalls mal ausprobieren.
 
  • Gefällt mir
Reaktionen: Schwobaseggl
Abgesehen davon gibt es wohl unter AMD Probleme mit Chromium-Browsern.
Habe ich selbst nicht erlebt, aber sie sind wohl da (laut Reddit).

Was du da versuchen kannst, ist, die Hardwarebeschleunigung auszuschalten oder gegebenenfalls den Browser zu wechseln.
 
  • Gefällt mir
Reaktionen: emulbetsup
Schwobaseggl schrieb:
Also die Temperaturen sind zu hoch. Das Delta von der GPU-Temperatur zum Hotspot ist mit 20 °C noch im Rahmen, aber die 102 °C sind doch ein bisschen zu viel. Die 92 °C auf dem VRAM sind ebenfalls sehr knackig. Laut Specs ist zwar beides noch im „grünen“ Bereich, aber doch schon sehr nahe an der 110-°C-Kotzgrenze.

Bezüglich der Temperaturen würde ich dir raten, einen besseren Airflow im Gehäuse zu schaffen und dir zu überlegen, die Wärmeleitpaste der Karte inklusive Putty oder Pads zu erneuern. PTM, MX, Dronaut – bei Igor gibt es eine super Tabelle. Statt Pads würde ich dir zu Putty raten, das bedeutet einfach weniger Stress beim Zuschneiden, Ausmessen etc.

Den Airflow bekommst du versuchsweise in den Griff, indem du das Seitenteil testweise offenlässt und einen Ventilator reinblasen lässt.
Fast 20° Luft nach oben soll knapp sein?
Ich mein ja, die Temps snd etwas hoch, aber nichts besorgniserregendes und erst Recht nichts, was den Kern des Threads erklären würde.
Schwobaseggl schrieb:
Zum Thema Kernel-Fehler kann ich dir leider weniger helfen
Eben.
Schwobaseggl schrieb:
, ich könnte mir aber gut vorstellen, dass es zum Teil mit den Temperaturen zusammenhängt.
Absolut unwahrscheinlich, ich wette die Karte drosselt noch nichtmal, geschweige denn, dass sie wegen den Temps abstürzt.
Natürlich alles in der Annahme, dass es sich hier um Lastwerte handelt.
Sind das Idle Temps läuft etwas gehörig schief.

@emulbetsup

Ich hab jetzt rausgelesen, das Problem tritt zwar sehr selten aber auch ohne aktivierte Hardwarebeschleunigung auf.
In dem Fall triggert die Hardwarebeschleunigung zwar am meisten den zugrundeliegenden Fehler, aber verursacht ihn nicht.
Tricky. Wie oben schon gesagt wurde, teste mal im Live Linux obs auftritt und wenn ja: Retoure.
 
  • Gefällt mir
Reaktionen: emulbetsup
Mit aktivierter Hardwarebeschleunigung im Browser kann ich den Fehler auf Twitter relativ leicht reproduzieren. Mal tritt er schnell auf, mal erst später, aber irgendwann kommt er. Die Artefakte aus dem Thread habe ich aber nach der deaktivierten Hardwarebeschleunigung (min. seit 06/2025) nicht mehr gesehen. Treibertimeouts hatte ich immer noch. Dann habe ich festgestellt, dass diese auch von der Hardwarebeschleunigung von Firefox getriggert werden können. Die habe ich auch jetzt deaktiviert.

Meistens erscheint dann nur die Meldung, dass der Treiber-Watchdog einen Treiber-Timeout festgestellt hat. Im Zuverlässigkeitsverlauf finden sich anschließend immer drei Events: zuerst 141, gefolgt von a2000002 und a1000001. Wenn es ganz schlecht läuft, reißt der Timeout allerdings das System in den Neustart — einmal passiert am 12.06.2026 — oder das System friert komplett ein und muss hart ausgeschaltet werden. Das ist einmal im Januar 2026 passiert.

Ich hatte aber auch mindestens einmal direkt nach der Anmeldung Probleme, also ohne geöffneten Browser. Danach habe ich MPO deaktiviert. Allerdings werden beim Systemstart vermutlich bereits Programme über den Autostart geladen, die ebenfalls Hardwarebeschleunigung nutzen könnten. Das Gruseligste, was ich gesehen habe, war einmal im Druckdialog eines PDFs: Dort erschienen Grafikfehler auch außerhalb des Browsers. Das Auftreten der Artefakte war dabei von der Position der Maus abhängig. Wenn man den Druckdialog geschlossen hat, war der Bildschirm wieder normal.

Den VRAM hatte ich bereits einmal eine Stunde lang mit OCCT getestet. Der Test war ohne Fehler.

EDIT: Die Krux ist eigentlich: Wenn der Fehler sicher mit irgendeiner Besonderheit des AMD-Treibers in Kombination mit dem Windows-Subsystem zusammenhängen würde und mit deaktiviertem MPO sowie deaktivierter Hardwarebeschleunigung sicher nicht mehr aufträten würde, könnte ich damit leben.

Wenn die GPU aber einen Teildefekt haben sollte, möchte ich sie nicht weiter betreiben. Das Problem ist, dass der Fehler so schwer zu fassen ist und sich die Beschreibung zumindest in weiten Teilen mit dem deckt, was man im Internet in Kombination von (AMD) GPUs mit Browserhardwarebeschleunigung und MPO lesen kann.
 
Zuletzt bearbeitet:
Ich kenn solche Fehlermeldungen mit

141, a2000002, a1000001, 124, 124, a2000002

Treiber wurde sauber im abgesicherten Modus mit DDU bereinigt

und die Grafikkarte läuft auf stock?

Der Prozessor hat kein Curve Optimizer an?

Es ist nicht das erste mal das ich solche Fehler im Zuverlässigkeitsmodus sehe auch mit einer 9070 XT.

Nimmt Aufjedenfall die neusten AMD TREIBER


Windows 11 neuinstallation mit daten behalten kann auch nicht schaden
 
Zuletzt bearbeitet:
Mach mal bitte folgenden Test:

  • Starte ein Game o. Benchmark im Fenstermodus und lasse dieses im Hintergrund laufen. Damit die Karte voll läuft, muss ein Spiel/Benchmark gesucht werden, die die Hintergrund-FPS nicht einschränken o. wo man die Beschränkung aufheben kann (ich nehm immer gern den alten FF XV Benchmark)
  • Benutze jetzt deinen gewünschten Browser mit Hardwarebeschleunigung

Gibts in diesem Szenario immer noch Probleme?
 
  • Gefällt mir
Reaktionen: emulbetsup und jo0
Ich würde den Treiber mal mit dem AMD Cleanup Utility löschen und den Treiber wieder installieren.

Vielleicht wäre auch eine Windows neuinstallation eine Option, die helfen könnte, wenn irgendwas anderes im System zerschossen ist. Eine andere Möglichkeit wäre, das mal auf Linux zu testen.

Ansonsten könnte es auch ein Hardwareproblem sein. Die Karte hat verschiedene Powerstates und wenn du die Hardwarebeschleunigung anhast, wird die nicht auf Volllast laufen, sondern irgendwo zwischen Idle und Volllast. Jedes Powerstate hat eigene Werte, was Stromaufnahme und Taktung angeht. Vielleicht macht da der Speicher irgendwas nicht mit? Aber so viel Ahnung habe ich da auch nicht.

Wie sieht es denn aus, wenn du die Karte auf Volllast laufen lässt (Furmark) und es dann mit aktiver Hardwarebeschleunigung im Browser provozierst?

Ich selbst habe 2 verschiedene Systeme, einmal mit einer 7900XTX und einer 9070XT und habe keine Probleme auf Win11

Schwobaseggl schrieb:
Also die Temperaturen sind zu hoch. Das Delta von der GPU-Temperatur zum Hotspot ist mit 20 °C noch im Rahmen, aber die 102 °C sind doch ein bisschen zu viel. Die 92 °C auf dem VRAM sind ebenfalls sehr knackig. Laut Specs ist zwar beides noch im „grünen“ Bereich, aber doch schon sehr nahe an der 110-°C-Kotzgrenze.
20 Grad delta zwischen der GPU und Hotspottemperatur sind noch im Rahmen.
Kann man verbessern, indem man neue Wärmeleitpaste aufträgt, führt aber nicht zu diesen Problemen
 
  • Gefällt mir
Reaktionen: Schwobaseggl, emulbetsup und qiller
therealcola schrieb:
Ich kenn solche Fehlermeldungen mit

141, a2000002, a1000001, 124, 124, a2000002

Treiber wurde sauber im abgesicherten Modus mit DDU bereinigt

und die Grafikkarte läuft auf stock?

Der Prozessor hat kein Curve Optimizer an?

Es ist nicht das erste mal das ich solche Fehler im Zuverlässigkeitsmodus sehe auch mit einer 9070 XT.

Nimmt Aufjedenfall die neusten AMD TREIBER


Windows 11 neuinstallation mit daten behalten kann auch nicht schaden

BIOS ist optimized Defaults, aber mit aktiviertem AMD SVM (Secure Virtual Machine) + angepasster Lüfterkurve.

Grafikkarte ist komplett stock. Die erhöhte Lüfterkurve setzt er mir wohl nach jedem Treibertimeout zurück. Das war die einzige Änderung, die ich da je vorgenommen habe.
 
Zuletzt bearbeitet:
Bei mir zickt seit einigen wochen meine XTX ebenfalls, hab überall die beschleunigung aus, es ist besser geworden, aber heute nacht hatte ich wieder so kurzzeitig aufploppende komische graue breite artefakte, meine vermutung meine karte stirbt langsam. Ansich hätte ich kein Problem wenn die stirbt, einschicken und danach verkaufen und was anderes holen, nur gibts keine alternativen zur XTX. Nur ne exorbitant teurer 5090 oder diese ganzen 16GB Krüppelkarten
 
  • Gefällt mir
Reaktionen: xXDariusXx
@emulbetsup
Dein Leschzitat ist gut! Ich schmunzel immer noch...

Viel Glück bei deinem Problem!
 
  • Gefällt mir
Reaktionen: emulbetsup
Hast du eventuell zwei Bildschirme (oder Endpunkte wie nen AV Receiver) mit unterschiedlicher Wiederholfrequenz angeschlossen? Das hatte bei mir unter Windows vor einiger Zeit ähnliche Artefakte ausgelöst.
 
@DHundt Habe einen einzelnen iiyama GB3461WQSU-B1 mit 3440x1440 bei 144Hz über Display-Port angeschlossen. Displayport-Kabel kam im September neu.
 
  • Gefällt mir
Reaktionen: DHundt
Sapphire Forum
Zurück
Oben