Articles of 智能

使用smartd来监控eSATA硬盘?

我正在使用smartd来监视我的文件服务器上的内部硬盘驱动器的SMART健康状况,并提醒我即将到来的厄运迹象。 我也想监视我将使用的外部eSATA硬盘驱动器,但我不知道如何克服这些障碍: 作为用于异地备份的外部驱动器,它可能存在也可能不存在。 当驱动器“消失”时,我怎样才能使smartd不被“吓坏”,并将我的电子邮件收件箱中的垃圾邮件? (注意:我还没有testing过,但是假设smartd会突然找不到驱动器的灾难性故障。) 出于与上述相同的原因,驱动器并不总是例如/ dev / sdf(实际上,一旦我移除了当前连接的USB HDD,下一次连接其中一个就是/ dev / sdg!) ,但是我的理解是,UUID和朋友引用分区 ,而我需要引用smartd 设备 。 如何可靠地指向这些外部驱动器,而不必在每次插入时手动更新/ dev / sd *参考? 在configuration文件中使用DEVICESCAN似乎是一个明显的select,因为无论如何我对所有的驱动器都使用相同的configuration,但是我的理解是,smartd只会在启动时扫描设备,而且我宁愿避免每次都重新启动守护进程我插入其中一个驱动器(除非这是最优雅的解决scheme)。

奇怪的smartctl输出。 我的磁盘有危险吗?

我有一个磁盘,这让我有点奇怪的smartctl输出。 我从来没有见过其他磁盘上的这么大的成员。 现在有人如何解释这些? 磁盘可能有问题吗? SMART Attributes Data Structure revision number: 10 Vendor Specific SMART Attributes with Thresholds: ID# ATTRIBUTE_NAME FLAG VALUE WORST THRESH TYPE UPDATED WHEN_FAILED RAW_VALUE 1 Raw_Read_Error_Rate 0x000f 118 099 006 Pre-fail Always – 188529080 3 Spin_Up_Time 0x0003 093 093 000 Pre-fail Always – 0 4 Start_Stop_Count 0x0032 100 100 020 Old_age Always […]

智能长时间testing – 对繁忙的服务器有什么影响?

我有一个RAID 1设置繁忙的服务器。 应用程序(以PHP运行)对数据库(MariaDB)非常敏感。 cronjob每天运行smartctl短testing并检查smartctl -H和mdadm -D的输出。 我想经常进行长时间的testing,但是我担心它对性能的影响。 我读过这可能需要几个小时才能完成。 如果在运行时导致服务器性能下降,我的用户将受到影响超过5个小时。 所以,这里有几个问题: 1)长时间的智能testing通常会影响对用户有意义的性能吗? 2)由于我有RAID 1并做了短暂的testing,是否还需要长时间的testing? 3)如果我发现它在服务器性能上造成麻烦,是否有办法停止长时间的testing?

为什么在WD RE4上收到“设备不支持SMART”?

我使用Ubuntu操作系统在戴尔R200服务器上远程设置我的硬盘。 当我试图validation磁盘规格(这应该是在RAID1arrays中设置的WD RE4)时,我收到以下消息: “设备不支持SMART” 究竟是什么原因导致了这个问题呢?如何解决这个问题呢? 谢谢

如何远程更改Dell Bios设置?

我最近注意到在一个客户端,他们的戴尔笔记本电脑默认情况下在BIOS中禁用SMART。 我注意到了这一点,而在没有任何警告的情况下在桌面上交换磁盘,想知道为什么我们没有得到任何东西。 🙂 任何人都知道如何脚本在戴尔机器上的BIOS变化? 这甚至有可能吗? 这个特定的客户端有大量的笔记本电脑,可能有50-75%的公司在任何一天都会离开办公室 – 这使得更新变得困难和昂贵 – 除非我可以编写脚本。 戴尔网站提到他们提供/出售的开放式pipe理软件包,但这看起来像是矫枉过正的这样一个简单的需求。

如何检查CoreOS中的SMART HDD状态

如何检查CoreOS中硬盘( SMART )的状态? smartd和smartctl不是CoreOS的一部分。 所以下面的CoreOS哲学smartd将在容器内部运行,因为systemd单元和smartctl将从工具箱中使用 。 我无法从工具箱访问硬盘驱动器。

如何解释由SMART和zfs提供的故障数据

在一个小型服务器系统中,我有一个zfs文件系统,带有一对镜像消费级驱动器(希捷Barracudas)。 最近,在定期擦洗操作中,给出了以下结果: pool: storage state: ONLINE status: One or more devices has experienced an unrecoverable error. An attempt was made to correct the error. Applications are unaffected. action: Determine if the device needs to be replaced, and clear the errors using 'zpool clear' or replace the device with 'zpool replace'. see: http://zfsonlinux.org/msg/ZFS-8000-9P scan: scrub repaired […]

HP智能arraysP400 – 故障磁盘 – 热备份

我在HP DL380 G5智能arraysp400中遇到了故障磁盘问题。 arrays设置是RAID 5,7磁盘+热备份。 一个磁盘在几个星期前失败了,热备份自动接pipe了,好长时间。 我更换了失败的驱动器,但我不确定数组是否处于正常状态。 如果我运行hpaducli(操作系统是RHEL 5),输出状态: 合并错误报告: 控制器:插槽1中的Smart Array P400 设备:逻辑驱动器1 消息:背景奇偶校验初始化当前正在排队 或正在进行这个逻辑驱动器。 如果背景平价 初始化排队,它将在执行I / O时启动 在驱动器上。 当后台奇偶校验初始化完成时, 逻辑驱动器的性能会提高。 (它被这样报道了一个多月,实际上似乎没有发生“排队”的后台奇偶校验初始化)。 用hpacucli检查: # hpacucli ctrl all show config physicaldrive 1I:1:5 (port 1I:box 1:bay 5, SAS, 72 GB, OK) physicaldrive 1I:1:6 (port 1I:box 1:bay 6, SAS, 72 GB, OK) physicaldrive 1I:1:7 (port 1I:box […]

为什么在RAID 1下的一对磁盘温度会出现较大的温差?

对我来说,看起来很奇怪,从一个磁盘的SMART得到的温度读数不同于其在RAID 1configuration中的两倍高达9°C : # smartctl -d scsi -A /dev/sg1 === START OF READ SMART DATA SECTION === Current Drive Temperature: 34 C Drive Trip Temperature: 68 C # smartctl -d scsi -A /dev/sg2 === START OF READ SMART DATA SECTION === Current Drive Temperature: 43 C Drive Trip Temperature: 68 C 服务器是1U戴尔PowerEdge R210的规格在这里 。 可能是这种exception的原因是什么?

硬盘的使用时间(开机时间)是否有必要进行更换?

我有几个存储arrays,其中大量的驱动器已经在25,000 – 30,000小时(2.8 – 3.4年)之间通电。 这些驱动器没有其他问题或错误。 我想知道的是: 即使驱动器工作正常并且没有错误 ,是否有一个驱动器时代本身就是一个足够重要的因素来取代驱动器? (我很好奇,看看人们倾向于运行驱动器,直到他们失败或开始抛出错误,或者如果有人采用开机时间作为度量标准,采取主动的替代方法。) Drive制造商通常会在100万到1,500,000小时的时间内在企业级驱动器上引用MTBF,但这些数字在现实世界中并没有多大的意义。 我确实在2007年完成了这项研究: 现实世界中的磁盘故障:1,000,000小时的MTTF对您意味着什么? http://www.cs.cmu.edu/~bianca/fast07.pdf 这项研究表明,1年到5年到7年之间的“甜蜜点”,你可以预期失败的次数更less。 这些时间之前/之后的驾驶年龄往往要高得多。