我有一个服务器与RAID中的2个磁盘,其中一个失败。 称为提供商,让他们改变磁盘。 重新启动后,我仍然只能看到一个磁盘: cat /proc/mdstat Personalities : [raid1] [linear] [multipath] [raid0] [raid6] [raid5] [raid4] [raid10] md2 : active raid1 sda3[0] 1073610560 blocks super 1.2 [2/1] [U_] md3 : active raid1 sda4[0] 1839089920 blocks super 1.2 [2/1] [U_] md0 : active raid1 sda1[0] 16768896 blocks super 1.2 [2/1] [U_] md1 : active raid1 sda2[0] 523968 blocks […]
我有一个使用Promise FastTrack TX2650的RAID1,由2个SAS驱动器组成。 什么是他们的Linux设备名称? 像sda是第一个SATA驱动器。 我有Windows服务器,所以我不能直接看,但需要这些信息的smartctl使用。 UPDATE。 我发现如何访问RAID: smartctl -d scsi sdb (因为我也有一个SATA驱动器)。 但在这种情况下,我只是得到一个关于RAID控制器的信息,虽然我想获得关于驱动器本身的信息。 可能吗? 承诺的控制面板只提供有关他们的健康状态(布尔)的信息,我想要更多。 现在大部分我需要关于温度的信息。
几个星期以来,smartd一直在报告说,它周末正在跳过一些预定的自检: 4月24日18:29:32 calvin smartd [4758]:设备:/ dev / sda,跳过预定的离线即时testing; 目前的自检剩余40%。 4月24日18:29:33 calvin smartd [4758]:设备:/ dev / sdb,跳过预定的离线即时testing; 目前的自检剩余50%。 这个RAID-1arrays中的驱动器设置为每天运行四次离线testing,每天凌晨两点进行一次短暂自检,并在周六凌晨两点进行长时间自检。 由于某种原因,看起来长时间的自检时间更长,导致其他计划的testing被跳过。 第一个问题:这是否是一个可能的驱动器故障的迹象? 那么今天,smartd报告说自测失败了。 以下是smartctl -a /dev/sdb的输出: smartctl版本5.38 [i686-pc-linux-gnu]版权所有(C)2002-8布鲁斯·艾伦 主页是http://smartmontools.sourceforge.net/ ===信息部分的开始=== 型号系列:Seagate Barracuda 7200.8系列 器件型号:ST3250823AS 序列号:3ND1GNBC 固件版本:3.03 用户容量:250,059,350,016字节 设备是:在smartctl数据库[详细使用:-P显示] ATA版本是:7 ATA标准是:精确的ATA规范草案版本没有标明 当地时间是:2010年4月25日13:15:34 EDT SMART支持是:可用 – 设备具有SMARTfunction。 SMART支持是:已启用 ===开始读取智能数据部分=== SMART全身健康自我评估testing结果:PASSED 一般SMART值: 离线数据收集状态:(0x82)离线数据收集活动 完成没有错误。 自动离线数据收集:已启用。 自检执行状态:(0)完成上一个自检程序 没有错误或没有自检过 已经运行。 完成离线的总时间 数据收集:(430)秒。 […]
smartmontools在RAID1configuration中使用的驱动器上报告越来越多的不可读扇区。 我以为LSI MegaRAID控制器也检查其磁盘驱动器的SMART状态,因此应该将驱动器识别为故障,并将其标记为脱机? smartctl -d sat + megaraid输出,7 -a / dev / sda: … 197 Current_Pending_Sector 0x0022 100 100 000 Old_age Always – 69 … Error 11 occurred at disk power-on lifetime: 9704 hours (404 days + 8 hours) When the command that caused the error occurred, the device was active or idle. After command […]
我在我的cron rsync激活,并开始在每个rsync后收到电子邮件 这是从mdadm自动生成的邮件消息 在titan707上运行 在md设备/ dev / md / 2上检测到降级数组事件。 忠实的你等等 PS / proc / mdstat文件当前包含以下内容: 个性:[线性] [多重] [raid0] [raid1] [raid6] [raid5] [raid4] [raid10] md1:激活raid1 sdb3 [1] sda3 [0] 7995840超级块1.2 [2/2] [UU] md0:激活raid1 sdb2 [1](F)sda2 [0] 499712块超级1.2 [2/1] [U_] md2:active raid1 sdb4 [1](F)sda4 [0] 968130304块超级1.2 [2/1] [U_] 未使用的设备: 但后来smartctl和mdadmin不显示任何问题,请参阅下面的mdadm,smartctl的日志。 $ cat / proc / mdstat […]
我目前的mdstat: $ cat /proc/mdstat Personalities : [raid6] [raid5] [raid4] [linear] [multipath] [raid0] [raid1] [raid10] md0 : active raid6 sde[8] sdh[4] sdg[1] sdd[6] sdb[5] sdc[7] 9766914560 blocks super 1.2 level 6, 512k chunk, algorithm 2 [7/6] [UUUUU_U] unused devices: <none> 这里是mdadm –detail: $ sudo mdadm –detail /dev/md0 /dev/md0: Version : 1.2 Creation Time : Fri Apr […]
我让自己变成了一个有趣的声音。 我想检查错误,我想使用smartctl, 这个命令 [root@defiant ~]# smartctl -V 产生一个错误: bash: smartctl: command not found… yum install smartctl不起作用。 我如何安装smartctl?
我已经smartctl -t long驾驶了大约2天,而且似乎停滞在10%。 短暂和传递都通过了。 我必须发送2个驱动器中的一个购买回来我发现badblocks badblocks(没有在这个驱动器上,我已经通过了通过)。 我只是想知道我是否应该关心这一点。 smartctl 5.39.1 2010-01-28 r3054 [x86_64-unknown-linux-gnu] (local build) Copyright (C) 2002-10 by Bruce Allen, http://smartmontools.sourceforge.net === START OF INFORMATION SECTION === Device Model: WDC WD10EARS-00Y5B1 Serial Number: WD-WMAV51582123 Firmware Version: 80.00A80 User Capacity: 1,000,204,886,016 bytes Device is: Not in smartctl database [for details use: -P showall] ATA Version is: […]
驱动器上的SMART属性是: SMART Attributes Data Structure revision number: 16 Vendor Specific SMART Attributes with Thresholds: ID# ATTRIBUTE_NAME FLAG VALUE WORST THRESH TYPE UPDATED WHEN_FAILED RAW_VALUE 1 Raw_Read_Error_Rate 0x000f 200 200 051 Pre-fail Always – 391 3 Spin_Up_Time 0x0003 181 165 021 Pre-fail Always – 5916 4 Start_Stop_Count 0x0032 100 100 000 Old_age Always – 259 5 […]
我有一个RAID 1设置繁忙的服务器。 应用程序(以PHP运行)对数据库(MariaDB)非常敏感。 cronjob每天运行smartctl短testing并检查smartctl -H和mdadm -D的输出。 我想经常进行长时间的testing,但是我担心它对性能的影响。 我读过这可能需要几个小时才能完成。 如果在运行时导致服务器性能下降,我的用户将受到影响超过5个小时。 所以,这里有几个问题: 1)长时间的智能testing通常会影响对用户有意义的性能吗? 2)由于我有RAID 1并做了短暂的testing,是否还需要长时间的testing? 3)如果我发现它在服务器性能上造成麻烦,是否有办法停止长时间的testing?