我在运行FreeNAS的机器上安装了Lycom PE-115 SATA 3 2端口6Gbps超薄型PCI-e 2.0主机适配器 。 SanDisk SSD Plus的SMART连接到它似乎有一些麻烦。 我已经看到有人报告说,人们不得不根据PE-115使用类似的芯片对USB控制器进行固件更新,但我找不到任何下载和说明如何执行此类更新。 Lycom的网页相当差,似乎没有提供固件更新。 任何人看到这个控制器的行动,也许有机会进行固件升级?
我今天醒来发现我的CentOS服务器的文件系统已经设置为只读模式。 我正在这台服务器上运行RAID 1。 # mkdir test mkdir: cannot create directory `test': Read-only file system 我做了一些研究,发现这通常是由硬件问题引起的,即硬盘即将失效。 我如何确定这是硬件问题而不是软件问题? 如果是硬件问题:如何找出两个驱动器中哪一个发生故障,需要更换? Smartctl为两个驱动器显示“PASSED”,尽pipe显示了678个重新分配的扇区,另一个显示了33个重新分配的扇区。 (我再次使用RAID 1) dmesg输出 ata2.00: exception Emask 0x0 SAct 0x4000000 SErr 0x0 action 0x0 ata2.00: irq_stat 0x40000008 ata2.00: failed command: READ FPDMA QUEUED ata2.00: cmd 60/08:d0:58:11:38/00:00:01:00:00/40 tag 26 ncq 4096 in res 51/40:02:5e:11:38/00:00:01:00:00/40 Emask 0x409 (media error) <F> […]
我正在寻找一种方法来使用smartctl单独监视ServeRAID设备上的磁盘arrays。 Ubuntu 12.04 LTS将RAID视为单个磁盘/ dev / sda。 ServeRAID是一个ServeRAID – 5i(Adaptec),来自IBM eServer seriv x345 SCSI磁盘。 我已经尝试过使用smartctl的各种方式,因为它可以使用3ware RAID来完成。 我还浏览了网页,看到人们通过/ dev / sgX条目进行监控。 但这些尝试是不成功的。 这个背后的想法是能够监视SMART的每个磁盘arrays,以便能够获得有关Munin,Icinga和smartd的数据。 任何解决scheme
我在不同的数据中心有很多服务器。 最近我有一些磁盘故障,我可能事先已经检测到,所以我开始在每个磁盘上定期自动运行smartctl -t 。 我每周testing两次磁盘,每周testing一次。 这会给磁盘带来什么样的压力,并且可能会缩短它们的年龄? smartctl对磁盘有什么影响?
我正在修理一个团队成员,我知道我有一个坏的磁盘。 这个对话框出现了几百次(每当有任何东西碰到与坐骑有关的东西时,新的裁剪就会结束,因此closures它们并不好): 检查,得到它。 我怎样才能让这个消失? 具体系统是Ubuntu 12.04 LTS。
我在这里有一个奇怪的情况。 在一台低stream量的服务器上使用了三年之后,一台RAID1中的两个三星硬盘之一昨天失败了: Personalities : [raid1] md0 : active raid1 sdb1[2](F) sda1[0] 732572608 blocks [2/1] [U_] 由于smartd没有任何报告,我检查了聪明的属性和唯一可疑的读数是不同的sdb(失败)与sda相比是: sda: 191 G-Sense_Error_Rate 0x0022 252 252 000 Old_age Always – 0 sdb: 191 G-Sense_Error_Rate 0x0022 098 098 000 Old_age Always – 27650 服务器机架中的G-sense错误? 也许传感器失败了? 但是在这两个驱动器上还有另一个时髦的阅读:最近的短线离线testing是“中断(主机复位)”,如果我用smartctl –test=short /dev/sda启动一个新的testing,select性自检日志显示: SPAN MIN_LBA MAX_LBA CURRENT_TEST_STATUS 1 0 0 Self_test_in_progress [90% left] (0-65535) 然而,这个短暂的testing永远不会结束,甚至几个小时后,情况依然如此 […]
我可以使用以下命令列出所有megaraid适配器上的物理驱动器: megacli -PDList -aALL 这将显示每个适配器的适配器号,然后列出附加到它们的物理驱动器。 PDList输出中的各个设备也具有用于例如设备ID为3的smartctl命令的设备ID: smartctl -a -d sat+megaraid,3 /dev/sda 这两个命令使用相同的设备ID,所以没有问题。 但是,我们如何正确地将适配器映射到设备节点呢? 在CentOS 6上运行smartmontools-5.43-1.el6。看看源代码,它似乎需要从命名设备节点上的ioctl SG_GET_SCSI_ID或SCSI_IOCTL_GET_BUS_NUMBER获得的总线号/ host_no。 这与MegaCLI输出中的“适配器#”相同吗? 其实在我的情况下,我可能会硬编码到/ dev / sda,但我想知道是否有更好的方法。
我有两台HP DL380 G7服务器+ P812控制器+ D2700机箱。 他们是144 Gb RAM的数据库服务器。 P812固件是6.40,D2700是0147 他们与18个OWC Mercury Extreme固态硬盘(SATA)一起工作得非常好。 在两个D2700机箱中添加了6个SSD后,在每个机箱中生成了24个SSD后,其中一台服务器的磁盘性能与其升级前相比非常差,并与其他服务器相比较。 所以我怀疑添加到性能较差的服务器的6 SSD中的一个是错误的。 但是哪一个? HParraysconfiguration实用程序不会显示任何问题,并且在POST时不会显示任何问题。 即使是很长的ACU报告也没有显示任何内容。 所以我想看看这些驱动器的SMART属性,看看我能否挑出一个失败的。 是否有一个Windows工具,可以让我查看这个configuration中的SMART属性? 在HP Proliant服务器中的第三方SSD驱动器的一个非常类似的问题- 监测驱动器的健康状况 ,build议使用smartmontools中的smartctl。 不幸的是,我没有看到P812 + D2700背后的固态硬盘 – 我怎样才能使smartctl工作? C:\Program Files\smartmontools\bin>smartctl -a /dev/sdc,0 -T permissive -s on smartctl 6.3 2014-06-23 r3922 [x86_64-w64-mingw32-2012r2] (cf-20140623) Copyright (C) 2002-14, Bruce Allen, Christian Franke, www.smartmontools.org === START OF INFORMATION […]
我看到smartctl的输出,对于某些属性,VALUE比WORST要小得多。 这有道理吗? 这是什么意思? 我读过的一切都表明: 原始值(smartctl输出中的RAW_VALUE)是制造商特定的,但有时是有用的 标准化值(smartctl输出中的VALUE)被标准化到0..254的范围,总是意味着更好,但是以制造商特定的方式 跟踪驱动器看到的最差值(smartctl输出中的最差值) 如果当前/最差值低于阈值(smartctl输出中的THRESH),并且该属性是预失败属性,则这是一个不好的迹象 我有一个(相信健康的,如果有点老)驱动器有: ID# ATTRIBUTE_NAME FLAG VALUE WORST THRESH TYPE UPDATED WHEN_FAILED RAW_VALUE 1 Raw_Read_Error_Rate 0x000f 200 200 051 Pre-fail Always – 0 3 Spin_Up_Time 0x0003 185 181 021 Pre-fail Always – 3725 4 Start_Stop_Count 0x0032 100 100 000 Old_age Always – 38 5 Reallocated_Sector_Ct 0x0033 200 200 140 […]
我最近收到了一批6个全新的HGST He8硬盘,当他们进行最初的长时间自检时,我注意到扩展的自检程序推荐的轮询时间performance出非常大的变化性。 for f in /dev/sd[uz]; do sudo smartctl -i $f | grep "Model"; done Device Model: HGST HUH728080ALN600 Device Model: HGST HUH728080ALN600 Device Model: HGST HUH728080ALN600 Device Model: HGST HUH728080ALN600 Device Model: HGST HUH728080ALN600 Device Model: HGST HUH728080ALN600 for f in /dev/sd[uz]; do sudo smartctl -a $f | grep -A1 "Extended self-test"; done Extended […]