QNAP ts-1679u-rp RAID 6的重build顺序错误

我有一个在RAID 6上运行的qnap ts-1679u-rp。它有2个磁盘错误。 因此,我用相同型号和容量的新磁盘replace了2个磁盘(磁盘3和磁盘13)。

它没能重build。
我试着把旧盘放回去,但是我忘记了这个命令。 所以我无论如何插入到(磁盘3和磁盘13)。
2.启动失败。
我换了位置,然后再试一次。 它未能启动。
4.我将VGA连接到QNAP以查看控制台屏幕。
它说,因为磁盘6读取错误,所以无法连接。
6.我试图拔出所有3个磁盘(磁盘3,磁盘13,磁盘6)。 它启动和Web界面终于可用,但磁盘格式无法识别。 我无法访问我的磁盘。
7.用电源,我把磁盘3,磁盘13,磁盘6插入,仍然无法访问我的磁盘。

我想我已经搞糟了我的RAIDconfiguration。 我会丢失我的数据吗? 我怎样才能从这个失败中恢复?

共有16个磁盘。 我用全部16个磁盘为RAID 6. 16x4TB。

通常不用RAIDarrays,如果你不能重build它自己,你就完成了。 这听起来像磁盘6也可能失败了。 随着三个磁盘的丢失(即使RAID控制器导致了这种损失),您的数据几乎没有了。

我看到你没有备份。 这太糟糕了。 但是,对于你的其他职业,我想你可能会开始正确使用RAID。 这是很多事情 – 分配工作负载以提高性能的一种方法,以及减less故障的直接操作影响的方法,否则这些故障将需要从备份中恢复。 它甚至可以用来限制数据在发生故障时的丢失,即短时间(即小于备份间隔)。 但是,RAID 不是 :

  1. 替代备份。 您可能会遇到严重的磁盘故障,或者RAID控制器可能会失败,或者由于无数其他原因导致软件或性质破坏您的数据,您的数据可能会丢失。
  2. 忽略磁盘故障或使用可疑磁盘的许可证 。 当您怀疑磁盘发生故障时,您必须立即纠正。

在将来你deviseRAIDarrays时,你应该仔细考虑发生灾难性故障的可能性,然后才能纠正它。 使用两个磁盘的RAID 1arrays,两者同时出现故障的几率相当低,但在您的设置中,只有三分之一(19%)不得不失败。 基本概率表明arrays是脆弱的。 使用磁盘数量较less或容忍失败次数较多的arrays。 多卷可能有帮助; 使用像RAID 10和RAID 60这样的复合级别来聚合RAID卷。一个RAID 60arrays最多可以容忍4个故障(其中一半多达2个故障),而且很可能是OK的。

为了扩展这个概念,当你使用RAID时,考虑使用热备份。 热备件非常棒,因为arrays可以立即开始重build,快速退出降级状态。 他们基本上是将磁盘添加到arrays的容错function中,只要故障没有如此紧密地聚集在一起,以免及时重build。

另外,请考虑重buildarrays所需的时间。 复制一个4TB磁盘需要一段时间,这是磁盘arrays通常用比这个更小的磁盘构build的原因之一(还有其他原因)。

最后:

  • 使用高质量的磁盘 。 检查出MTTF,如果报价。 使用企业级的。 高价是有原因的。 避免“绿色”过度循环以节省电力,或类似的。
  • 标记您的磁盘 。 那么,你不会忘记他们进入的顺序。

希望这个教训不是太昂贵。

幸运的是,我设法恢复了我的数据。 下面是我如何做到这一点:

  1. 我inputvi /etc/raidtab来查看磁盘顺序。 我设法交换磁盘顺序为磁盘3和磁盘13
  2. 错误是
 [ 984.796055] ata1.00: cmd 25/00:20:60:04:5a/00:00:5a:00:00/e0 tag 2 dma 16384 in [ 984.796055] res 40/00:01:00:00:00/00:00:00:00:00/00 Emask 0x14 (ATA bus error) [ 984.796058] ata1.00: status: { DRDY } [ 984.796066] ata1.00: hard resetting link [ 985.520017] ata1.01: hard resetting link [ 985.996057] ata1.00: SATA link up 3.0 Gbps (SStatus 123 SControl 300) [ 985.996068] ata1.01: SATA link down (SStatus 4 SControl 300) [ 986.012323] ata1.00: configured for UDMA/133 [ 986.012331] ata1.00: device reported invalid CHS sector 0 [ 986.012340] ata1: EH complete 

驱动器6有问题设置链接。 所以我怀疑链接是松散的。 所以我用更大的力量稍微推动一下,然后再试一次。 有趣的是,这个环节已经到了! 所以我只剩下2个驱动器故障。

  1. 键入mdadm -E /dev/sda3来检查磁盘的状态。 我为所有16个磁盘做这个。 sda3到sdp3。 磁盘3和磁盘13被标记为失败。

  2. 键入storage_boot_init 2来组装所有16个磁盘。 非常幸运,数据最终在\share\MD0_DATA和\share\文件夹中可用。

以前我必须承认,我对RAID 6不太了解,并盲目地使用它。 现在我可以回收数据了,在重build2个错误的磁盘之前,我会将其备份到其他地方。 我已经标记了所有的磁盘顺序。 学到了我的教训! 这对我来说是一个真正的数据噩梦!