几年前,我被告知要避免像鼠疫这样的SMART。 原因是testing对驱动器施加的压力实际上会导致失败。 这仍然是这样吗? 如果不是,运行testing的频率是多less? 如果我仍然应该避免这种情况,有什么更好的方法来监视我的硬盘驱动器的健康状况?
我有一个刚刚超过一个月的NAS设备。 它被configuration为通过电子邮件发送从硬盘驱动器的SMART数据生成的警报。 有一天,其中一个硬盘报告说一个部门坏了,被重新分配。 在第一周内,这个数字攀升到硬盘驱动器总数的六倍。 一个月后,这个数字是九个重新分配的部门。 速度肯定似乎在减速。 NASconfiguration了6个1.5 TB的RAID-5configuration的驱动器。 有了这样的高容量驱动,我预计会有一个部门不时地失败,所以我并不担心前几个部门何时搬迁。 这让我感到困扰,但其他磁盘都没有报告任何问题。 搬迁的次数或总搬迁次数,我是否应该开始担心车辆的健康? 这可能会根据驱动器的容量而变化吗?
我的Linux系统已经开始在系统日志中抛出SMART错误。 我追查下来,并相信问题是磁盘上的一个单一的块。 如何轻松获得磁盘重新分配一个块? 我想知道在这个过程中被破坏了什么文件。 (我知道,如果一个磁盘在磁盘上出现故障,其他人可能会遵循;我有一个很好的持续备份,只是想保持这个磁盘的工作。) search网页会导致Bad block HOWTO ,它描述了一个卸载磁盘上的手动过程。 看起来很复杂,容易出错。 有没有一种工具在Linux中自动执行这个过程? 我唯一的select是制造商的诊断工具 ,但我认为这会打破坏块没有任何报告被毁坏。 最糟糕的情况是,它可能是文件系统元数据。 有问题的磁盘是主要的系统分区。 使用ext3fs和LVM。 这里是syslog的错误日志和smartctl的相关位。 smartd[5226]: Device: /dev/hda, 1 Currently unreadable (pending) sectors Error 1 occurred at disk power-on lifetime: 17449 hours (727 days + 1 hours) … Error: UNC at LBA = 0x00d39eee = 13868782 在pastebin 上有一个完整的smartctl转储。
在Debian 6.0.6系统中,有74个2TB Toshiba DT01ABA200驱动器。 这些驱动器标识为运行固件版本MZ4OAAB0的Hitachi HDS5C3020BLE630驱动器。 64驱动器通过HP SAS扩展卡连接到LSI 2008 SAS控制器,另外5个驱动器直接连接到主板,4个驱动器连接到基于Sil的PCI控制器,最后1个驱动器仅通电,没有连接数据电缆。 控制器LSI和Sil卡的板载BIOS都被禁用,mpt2sas和sata_sil模块从Linux debian 2.6.32-5-amd64#1 SMP Sun Sep 23 10:07:46 UTC 2012 x86_64 GNU / Linux内核。 在启动后使用/etc/rc.local中的modprobe命令加载mpt2sas模块。 这74个驱动器没有分区,既没有格式化,也没有安装。 系统消耗: 0驱动器 :70.6 – 70.9瓦特(开机15分钟后); 与74个驱动器 :330 – 360瓦特,在引导之后(相当于3.5 – 3.9W每个驱动器在空闲状态); 74个驱动器 :420 – 466瓦,每次正常运行15分钟 (相当于空闲状态下每个驱动器4.7 – 5.3瓦)。 驱动器规格列出4.7W读/写,3.3W空闲功耗。 增加的功耗最有可能在5V线上,因为在大约1分钟之后,电源(PSU)的“过电stream保护”(OCP)closures电源。 所使用的PSU是单线轨道模型,在12V线路上OCP> 122A,在5V线路上> 55A。 回归: 驱动器的APM值是否被设置为禁用或1(最大功率节省)无关紧要。 操作系统在/proc/diskstats不logging读/写活动。 这些值在modprobe操作之后是相同的(28个读取,0个写入操作)。 无法testing引导到主板的BIOS时发生了什么 – […]
man smartctl国家(简写为嗤之以鼻): 第一类称为“在线”testing。 第二类testing称为“离线”testing。 通常情况下,磁盘将在磁盘访问发生时挂起脱机testing,然后在磁盘空闲时自动恢复。 第三类testing(以及“testing”这个词真是一个合适的select)是“自我”testing。 启用或禁用SMART自动脱机testing,该testing每四小时对磁盘缺陷进行一次扫描。 该命令可以在正常的系统操作期间给出。 谁运行testing驱动器固件? 什么样的testing是这样的 – 固件读取/写入磁盘 – 究竟发生了什么? 在操作系统(linux)中调用testing是否安全或者是否可以在以后安排testing – 这是如何发生的 – 当您在BIOS提示符('脱机testing')重新启动操作系统时? 结果在哪里显示 – SMART日志?
SMART (用于自我监测分析和报告技术)是一项非常棒的技术,可以在发生硬盘故障之前检测硬盘故障。 但SMART是否与SSD相关?
我只是试图在我的硬盘上运行一个testing,它不想完成一个自我testing。 结果如下: smartctl –attributes –log=selftest /dev/sda smartctl 6.2 2013-07-26 r3841 [x86_64-linux-3.13.0-32-generic] (local build) === START OF READ SMART DATA SECTION === SMART Attributes Data Structure revision number: 16 Vendor Specific SMART Attributes with Thresholds: ID# ATTRIBUTE_NAME FLAG VALUE WORST THRESH TYPE UPDATED WHEN_FAILED RAW_VALUE 1 Raw_Read_Error_Rate 0x002f 200 200 051 Pre-fail Always – 697 3 […]