Backup Strategie TrueNAS

Die Smart Test werden bei mir auch automatisch durchgeführt. Gibt's als Option im TrueNAS.
Das mit der Option mit der Smarten Steckdose müsste dann auch über ein Skript laufen, damit diese sicher ausgeworfen wird. Das ist schon klar soweit.

Btw hab die Rechnung von den Platten gefunden.....
HDSA 4TB Seagate Factory Recertified IronWolf Pro NAS ST4000NE001 7.200U/min 256MB 3.5" (8.9cm) SATA 6Gb/ 3 59,00 € 177,00
 
  • Gefällt mir
Reaktionen: LiniXXus
So neue Platte kam an, resilver Prozess läuft...
Bis 15.74%, hängt da die ganze Zeit und ich habe noch die Fehlermeldungen auf dem Screenshot.

Kann es sein, dass ich gef**** bin?

Hab per system -> Shell mit zpool status -v hdd-pool den status auszulesen aber ich komme nicht mal in die Shell. Connection Time Out. Die storage Seite läd auch nicht.

Bin ich Gerade einfach nur zu panisch, weil das NAS einfach voll ausgelastet mit dem resilver Prozess ist oder hab ich ein Problem 🤯
Ergänzung ()

Ein Kern läuft auch am Limit
 

Anhänge

  • Screenshot_2026-09-18-16-28-59-144_org.mozilla.firefox.jpg
    Screenshot_2026-09-18-16-28-59-144_org.mozilla.firefox.jpg
    212,8 KB · Aufrufe: 21
  • Screenshot_2026-09-18-17-03-42-089_org.mozilla.firefox.jpg
    Screenshot_2026-09-18-17-03-42-089_org.mozilla.firefox.jpg
    177,1 KB · Aufrufe: 14
Arbeiten die Platten noch? Also Zugriffsgeräusche. Mit ein Grund warum ich mir lieber selber meiner Server baue statt der Komplettlösungen ist, dass man dann einen Monitor anschließen kann und sieht was da steht ohne dass ein Remote-Dienst noch funktionieren muss.
Wie lange läuft das nun überhaupt?

Nachtrag:
Verschaff dem armen Burschen mal Frischluft:
1789744478812.png
 
Zuletzt bearbeitet:
Die Platten höre ich noch, ja. Monitor hab ich abgeschlossen bekomme aber keine Bild:/
Das läuft jetzt seit ca 2h. Die 15% gingen aber Recht schnell. So ca 30min vllt
Ja den Filter hab ich schon abgenommen...
 
Mein letztes Resilvering ist schon länger her, aber ich meine, dass das auch 2 oder 3x bei einem Stand festzuhängen schien. Aber das nur aus dem fernen Gedächtnis ohne Gewähr. Solange Du aber Zugriffsgeräusche und nicht nur Laufgeräusche hörst, dann einfach mal laufen lassen.
 
Nachdem ich keine Zugriffsgeräusche mehr gehört hatte, und die temp wie festgenagelt auf 100°C fest hing, bin ich mal mit Chatti auf die Fehlersuche gegangen. Nach diversem hin und her und Diagnosen kamen wir auf das Ergebnis, dass ein softlock beim resilver ist.
Also so wie ich's verstanden hab, hat sich das komplett aufgehängt.
Ein Neustart via web Oberfläche ging nicht, und auch ein runterfahren erzwingen via Knopf gedrückt halten hat nicht funktioniert. Stecker ziehen dann schon. Ich weiß, dass das nicht beste ist was man in der Situation tun kann, aber es ging einfach nichts mehr.

Jetzt läuft alles wieder und ich bin bei 22%
Hftl läuft alles jetzt mal durch, dass ich wieder ein funktionierendes RAID habe. Danach geht's an die Backups. Ich werde dann erstmal die eine 6TB Platte Ausbauen und als externe Platte manuell ein Backup ziehen
 
  • Gefällt mir
Reaktionen: Banned
Die grafische Oberfläche war zumindest in der Vergangenheit auch nicht immer das Gelbe vom Ei bei sowas. Ich hatte es auch schon, dass bei nem Scrub die Anzeige ewig hing bzw. verzögert war.

Geh bei sowas, wenn es hängt, am besten in die Shell und gib
Code:
zpool status
ein. Damit bist du eigentlich immer auf dem Laufenden.

Error_4o4 schrieb:
Ich werde dann erstmal die eine 6TB Platte Ausbauen und als externe Platte manuell ein Backup ziehen

Oder du machst es einfach, solange sie noch eingebaut ist.
 
Banned schrieb:
Ich hatte es auch schon, dass bei nem Scrub die Anzeige ewig hing bzw. verzögert war.
Ich kenne das wenn nur von QNAP her.
Allerdings kann es da auch ziemlich dauern, bis die Prozentanzeige beim Scrubbing mal einen Punkt nach oben klettert.
Gleiches gilt beim Wiederaufbau eines RAIDs.
 
Kleiner Auszug aus dem KI-Chat:

Besonders wichtig ist diese Stelle:

vdev_path = /dev/disk/by-partuuid/18748e72-78f2-4908-b3cb-3ddb80aa9a8
vdev_read_errors = 0x0
vdev_write_errors = 0x0
vdev_cksum_errors = 0x89e
zio_err = 0x34

0x89e sind 2190 Checksum-Fehler. Das ist erheblich. Zusammen mit

pool I/O is currently suspended
txg_sync Soft-Lockup auf CPU0
~100 °C CPU0
Load Average ~39
WebUI-Seiten, die hängen
und jetzt abbrechender SSH-Verbindung

würde ich jetzt nicht weiter versuchen, ZFS-Kommandos auszuführen.

Es ging garnichts mehr. In dem Fall war mal wieder "Reboot tut gut" xD
Auch wenn ich hoffe, dass ich das nie wieder machen muss. War ganz schön am schwitzen...
 
Alternate 3
Zurück
Oben