同じ RAID グループ内の老朽化したディスクの故障が増加
環境
- ONTAP 9
- 通電時間が50,000時間を超えるHDDs
問題
- ディスクにメディアエラーが検出され、ディスクに障害が発生し、再構築が実行されます
Sat Dec 17 11:31:22 -0800 [node01: disk_server_0: disk.ioMediumError:notice]: Medium error on disk 1a.10.5: op 0x2f:012cf400:0400 sector 19723448 SCSI:medium error - Unrecovered read error - If the disk is in a RAID group, the subsystem will attempt to reconstruct unreadable data (3 11 0 2d) (2730) Disk 1a.10.5 Shelf 10 Bay 5 [NETAPP X316_HAKPE06TA07 NA01] S/N [1234567] UID [5000CCA2:4D33CF14:00000000:00000000:00000000:00000000:00000000:00000000:00000000:00000000]
Thu Jun 25 19:19:54 +0800 [node01: scsi_cmdblk_strthr_admin: scsi.cmd.notReadyCondition:notice]: Disk device 0b.20.53: Device returns not yet ready: CDB 0x28:00000000:0008: Sense Data SCSI:not ready - Drive spinning up (0x2 - 0x4 0x1 0x2)(0).
- その後、同じ RAID グループ内の同年代のディスク 2 台でも中程度のエラーが発生し始め、最終的に故障しました。