Rootserver platte defekt



Neogreen

Member
Hallo,

Seit einigen Tagen fing der Root an zu läggen nun haben wir die Platten via smartctl getestet, nun kahm bei einer Platte folgendes raus:

PHP:
root@Debian-60-squeeze-64-minimal ~ # smartctl -l error -d ata /dev/sdb
smartctl 5.40 2010-07-12 r3124 [x86_64-unknown-linux-gnu] (local build)
Copyright (C) 2002-10 by Bruce Allen, http://smartmontools.sourceforge.net

=== START OF READ SMART DATA SECTION ===
SMART Error Log Version: 1
ATA Error Count: 93 (device log contains only the most recent five errors)
        CR = Command Register [HEX]
        FR = Features Register [HEX]
        SC = Sector Count Register [HEX]
        SN = Sector Number Register [HEX]
        CL = Cylinder Low Register [HEX]
        CH = Cylinder High Register [HEX]
        DH = Device/Head Register [HEX]
        DC = Device Command Register [HEX]
        ER = Error register [HEX]
        ST = Status register [HEX]
Powered_Up_Time is measured from power on, and printed as
DDd+hh:mm:SS.sss where DD=days, hh=hours, mm=minutes,
SS=sec, and sss=millisec. It "wraps" after 49.710 days.

Error 93 occurred at disk power-on lifetime: 3754 hours (156 days + 10 hours)
  When the command that caused the error occurred, the device was active or idle.

  After command completion occurred, registers were:
  ER ST SC SN CL CH DH
  -- -- -- -- -- -- --
  40 51 00 58 03 90 01

  Commands leading to the command that caused the error were:
  CR FR SC SN CL CH DH DC   Powered_Up_Time  Command/Feature_Name
  -- -- -- -- -- -- -- --  ----------------  --------------------
  60 00 00 18 00 90 41 00   6d+04:54:34.263  READ FPDMA QUEUED
  ef 10 02 00 00 00 a0 00   6d+04:54:34.263  SET FEATURES [Reserved for Serial ATA]
  27 00 00 00 00 00 e0 00   6d+04:54:34.263  READ NATIVE MAX ADDRESS EXT
  ec 00 00 00 00 00 a0 00   6d+04:54:34.262  IDENTIFY DEVICE
  ef 03 46 00 00 00 a0 00   6d+04:54:34.262  SET FEATURES [Set transfer mode]

Error 92 occurred at disk power-on lifetime: 3754 hours (156 days + 10 hours)
  When the command that caused the error occurred, the device was active or idle.

  After command completion occurred, registers were:
  ER ST SC SN CL CH DH
  -- -- -- -- -- -- --
  40 51 00 58 03 90 01

  Commands leading to the command that caused the error were:
  CR FR SC SN CL CH DH DC   Powered_Up_Time  Command/Feature_Name
  -- -- -- -- -- -- -- --  ----------------  --------------------
  60 00 00 18 00 90 41 00   6d+04:54:31.312  READ FPDMA QUEUED
  ef 10 02 00 00 00 a0 00   6d+04:54:31.312  SET FEATURES [Reserved for Serial ATA]
  27 00 00 00 00 00 e0 00   6d+04:54:31.312  READ NATIVE MAX ADDRESS EXT
  ec 00 00 00 00 00 a0 00   6d+04:54:31.312  IDENTIFY DEVICE
  ef 03 46 00 00 00 a0 00   6d+04:54:31.312  SET FEATURES [Set transfer mode]

Error 91 occurred at disk power-on lifetime: 3754 hours (156 days + 10 hours)
  When the command that caused the error occurred, the device was active or idle.

  After command completion occurred, registers were:
  ER ST SC SN CL CH DH
  -- -- -- -- -- -- --
  40 51 00 58 03 90 01

  Commands leading to the command that caused the error were:
  CR FR SC SN CL CH DH DC   Powered_Up_Time  Command/Feature_Name
  -- -- -- -- -- -- -- --  ----------------  --------------------
  60 00 00 18 00 90 41 00   6d+04:54:28.362  READ FPDMA QUEUED
  60 00 00 18 04 90 41 00   6d+04:54:28.362  READ FPDMA QUEUED
  ef 10 02 00 00 00 a0 00   6d+04:54:28.362  SET FEATURES [Reserved for Serial ATA]
  27 00 00 00 00 00 e0 00   6d+04:54:28.361  READ NATIVE MAX ADDRESS EXT
  ec 00 00 00 00 00 a0 00   6d+04:54:28.361  IDENTIFY DEVICE

Error 90 occurred at disk power-on lifetime: 3754 hours (156 days + 10 hours)
  When the command that caused the error occurred, the device was active or idle.

  After command completion occurred, registers were:
  ER ST SC SN CL CH DH
  -- -- -- -- -- -- --
  40 51 00 58 03 90 01

  Commands leading to the command that caused the error were:
  CR FR SC SN CL CH DH DC   Powered_Up_Time  Command/Feature_Name
  -- -- -- -- -- -- -- --  ----------------  --------------------
  60 00 00 18 04 90 41 00   6d+04:54:25.403  READ FPDMA QUEUED
  60 00 00 18 00 90 41 00   6d+04:54:25.403  READ FPDMA QUEUED
  ef 10 02 00 00 00 a0 00   6d+04:54:25.403  SET FEATURES [Reserved for Serial ATA]
  27 00 00 00 00 00 e0 00   6d+04:54:25.403  READ NATIVE MAX ADDRESS EXT
  ec 00 00 00 00 00 a0 00   6d+04:54:25.402  IDENTIFY DEVICE

Error 89 occurred at disk power-on lifetime: 3754 hours (156 days + 10 hours)
  When the command that caused the error occurred, the device was active or idle.

  After command completion occurred, registers were:
  ER ST SC SN CL CH DH
  -- -- -- -- -- -- --
  40 51 00 58 03 90 01

  Commands leading to the command that caused the error were:
  CR FR SC SN CL CH DH DC   Powered_Up_Time  Command/Feature_Name
  -- -- -- -- -- -- -- --  ----------------  --------------------
  60 00 00 18 00 90 41 00   6d+04:54:22.436  READ FPDMA QUEUED
  60 00 00 18 04 90 41 00   6d+04:54:22.436  READ FPDMA QUEUED
  60 00 00 18 08 90 41 00   6d+04:54:22.436  READ FPDMA QUEUED
  60 00 80 18 0c 90 41 00   6d+04:54:22.436  READ FPDMA QUEUED
  ef 10 02 00 00 00 a0 00   6d+04:54:22.436  SET FEATURES [Reserved for Serial ATA]
Meiner meinung wäre die Platte "defekt" darauf nun auch ein Techniker gefragt der mir das bestätigt hatte.
Das ging auch an Hetzner allerdings wurde die Platte nicht ausgetauscht.
Nun ist die Platte nun defekt?
 
Last edited by a moderator:
Nun, warum hat Hetzner die Festplatte nicht getauscht? Gab es denn keine Antwort von Hetzner?
 
Mehr oder weniger ist der Kollege dem der Root gehört grade unterwegs und ich habe eben nur Root zugriff und musste festellen das die Seriennummer noch die selbe ist und der smart test das selbe ergibt. Da haben wir wohl umsonst die platte ausgebunden. Nun also ihr könnt auch bestätigen das die Platte nicht ganz ok ist?
 
Normalerweise bekommt man vom Hetzner-Support einen Termin genannt, zu dem man den Server runterfahren soll. Dann tauschen sie die Platte aus, und fahren ihn im Rescuemode wieder hoch.

Hattet ihr nen Termin bekommen?
 
Klar, Server wurde von Hetzner auch neugestartet und wir konnten uns eben in den zeitfenster nicht einloggen. Also im Resouce modus ist der Server nicht wir konnten uns danach normal einloggen, sonst sollte der Root ja unter Port 22 erreichbar sein.
Allerdings ist der home ordner nun leer, hatt wer eine lösung dafür?
 
Last edited by a moderator:
Es bringt nicht hier lange darüber zu spekulieren was sein könnte. Alleine Hetzner kann dir sagen was oder was sie eben nicht aus welchen Gründen gemacht haben.
 
Nicht unbedingt, die Fehler können auch durch defekte/lose Kabel oder Motherboard-Probleme entstehen.
Was sagt denn SMART selbst?

Allerdings ist der home ordner nun leer, hatt wer eine lösung dafür?
Ich hoffe mal dass ihr einen Raid hattet und nicht der Home auf einer sowie der Rest der Platte auf dem anderen Datenträger lag.
 
Hetzner wird mit einer Wahrscheinlichkeit oberhalb der 99,99% auf eure Supportanfrage auch geantwortet haben...
 
Nun Hetzer hatte sich gemeldet, die Platten seine in Ordnung....
Es war die Standart auslieferung sprich Raid 1 spiegeln wieso der home ordner leer ist.....
Nun ich versuche grad wieder die Platten einzubinden allerdings funktioniert es nicht:

root@Debian-60-squeeze-64-minimal ~ # mdadm /dev/md0 -a /dev/sdb1
mdadm: Cannot open /dev/sdb1: Device or resource busy

Hatt wer ein vorschlag?
 
Sicher dass die Platte nicht schon im Raid ist?
Wenn sie nie gewechselt wurde und du sie nicht manuell aus dem Raid geworfen hast ist sie noch immer drin. Zeige mal den Status des RAID's
 
root@Debian-60-squeeze-64-minimal ~ # mount
/dev/md2 on / type ext4 (rw)
tmpfs on /lib/init/rw type tmpfs (rw,nosuid,mode=0755)
proc on /proc type proc (rw,noexec,nosuid,nodev)
sysfs on /sys type sysfs (rw,noexec,nosuid,nodev)
udev on /dev type tmpfs (rw,mode=0755)
tmpfs on /dev/shm type tmpfs (rw,nosuid,nodev)
devpts on /dev/pts type devpts (rw,noexec,nosuid,gid=5,mode=620)

Wir haben die platte ja aus dem Raid geworfen.. aufgrund des gewollten platentauschs


root@Debian-60-squeeze-64-minimal ~ # cat /proc/mdstat
Personalities : [raid1]
md124 : active (auto-read-only) raid1 sdb1[1]
12581816 blocks super 1.2 [2/1] [_U]

md125 : active (auto-read-only) raid1 sdb2[1]
524276 blocks super 1.2 [2/1] [_U]

md126 : active (auto-read-only) raid1 sdb3[1]
1073740664 blocks super 1.2 [2/1] [_U]

md127 : active (auto-read-only) raid1 sdb4[1]
1843414335 blocks super 1.2 [2/1] [_U]

md3 : active (auto-read-only) raid1 sda4[0]
1843414335 blocks super 1.2 [2/1] [U_]

md2 : active raid1 sda3[0]
1073740664 blocks super 1.2 [2/1] [U_]

md1 : active (auto-read-only) raid1 sda2[0]
524276 blocks super 1.2 [2/1] [U_]

md0 : active (auto-read-only) raid1 sda1[0]
12581816 blocks super 1.2 [2/1] [U_]

unused devices: <none>
 
Du hast ganz offensichtlich auf beiden Platten "eigene" RAIDs laufen in welche die jeweils andere Platte nicht eingehängt ist...
Stoppe die RAID-Arrays auf der ausgetauschten (oder halt nicht ausgetauschten) Platte und versuch's dann noch mal mit dem Einhängen.
 
Könntest du mir sagen wie? bin im bereich software raid noch relativ neu...

Theoretisch ging das doch das ich eben die eine ausgehängte platte formatiere und einbinde?
Sprich nach der Hetzner Wiki eben so behandeln als wäre es die neue platte
Die frage wäre dann nur auf welcher isses nun gebooted?
 
Last edited by a moderator:
Es sind fast alle draussen allerdings will md124 nicht wirklich:

root@Debian-60-squeeze-64-minimal ~ # mdadm --stop --force /dev/md124
mdadm: failed to stop array /dev/md124: Device or resource busy
Perhaps a running process, mounted filesystem or active volume group?
root@Debian-60-squeeze-64-minimal ~ # mdadm --force /dev/md124 -r /dev/sdb1
mdadm: hot remove failed for /dev/sdb1: Device or resource busy

PHP:
Personalities : [raid1]
md124 : active raid1 sdb1[1]
      12581816 blocks super 1.2 [2/1] [_U]

md3 : active (auto-read-only) raid1 sda4[0]
      1843414335 blocks super 1.2 [2/1] [U_]

md2 : active raid1 sda3[0]
      1073740664 blocks super 1.2 [2/1] [U_]

md1 : active (auto-read-only) raid1 sda2[0]
      524276 blocks super 1.2 [2/1] [U_]

md0 : active raid1 sda1[0]
      12581816 blocks super 1.2 [2/1] [U_]

unused devices: <none>

PHP:
root@Debian-60-squeeze-64-minimal ~ # cat /etc/fstab
proc /proc proc defaults 0 0
none /dev/pts devpts gid=5,mode=620 0 0
/dev/md/0 none swap sw 0 0
/dev/md/1 /boot ext3 defaults 0 0
/dev/md/2 / ext4 defaults 0 0
/dev/md/3 /home ext4 defaults 0 0

edit wir konnte in Resouce booten allerdings ist das so richtig?
PHP:
Personalities : [raid1]
md3 : active raid1 sda4[0] sdb4[2]
      1843414335 blocks super 1.2 [2/1] [U_]
        resync=DELAYED

md2 : active raid1 sda3[0] sdb3[2]
      1073740664 blocks super 1.2 [2/1] [U_]
      [>....................]  recovery =  1.7% (19325952/1073740664) finish=317.1min speed=55405K/sec

md1 : active raid1 sda2[0] sdb2[2]
      524276 blocks super 1.2 [2/1] [U_]
        resync=DELAYED

md0 : active (auto-read-only) raid1 sda1[0] sdb1[2]
      12581816 blocks super 1.2 [2/1] [U_]

unused devices: <none>
 
Last edited by a moderator:
Back
Top