Articles of RAID

古代服务器中的坏盘

我有一个1998年的Netware 3.12服务器,它运行在我们校园的一切 :总账,采购,工资,学生信息,成绩,你的名字。 该服务器有一个Adaptec RAID控制器,具有两个卷: RAID 1,2个17GB scsi磁盘,希捷ST318417W RAID 5,3个4GB scsi磁盘,2个希捷ST34573W和1个ST34572W。 目前我们正在进行一个项目的早期阶段来取代这个系统,但是你不要只是跳到这样一个新的系统,所以我需要保持这个服务器运行,直到2011年11月。 本周我们没有一个,但两个硬盘驱动器失败。 幸运的是,它们来自不同的卷,我们能够继续运行,但鉴于这些失败的密切性质,我有严重的疑虑,我将能够通过11月的目标,以避免这台服务器的灾难性故障恢复RAID冗余 – 在任何地方只会发生一次驱动器故障,而且我完全被洗了。 我们有幸能够在两个驱动器之间有精确匹配的“备件”,但是备件处于未知状态。 我尝试交换他们,但RAID控制器不够聪明来处理这个,它使系统无法启动。 至于RAID控制器本身,我可以在POST期间通过Ctrl-A快捷键进入实用程序,但是我从这里做不了多less有用的工作。 要实际pipe理卷,我必须首先引导到Netware,此时我可以使用CI/O Array Management Software Version 2.0来查看卷信息。 我怀疑pipe理事物的正常方法是从一个特殊的软盘启动它的控制器软件,但是这个软盘早已不复存在。 通过RAID软件中的选项,我认为replace现有RAID卷中唯一受支持的方式是物理添加磁盘,启动并将其configuration为卷的“备用”,强制卷使用备用来更换现有的磁盘(此时我只是猜测),以便磁盘成为备用磁盘,修复磁盘空间,清除磁盘空间,然后closures并取出磁盘。 然后从另一个失败的磁盘开始。 所有这些都意味着大量的停机时间,假设我可以使其工作,而且我的备件还是不错的。 至于寻找可靠的备件,我不知道从哪里开始寻找一个新的4GB scsi驱动器,甚至是我正在寻找的确切scsi系统,因为它随着时间的推移经历了几次不同的迭代。 另一个select是将其迁移到虚拟机(hyper-v),但是我们之前在这个领域所做的所有尝试都没能实现。 安装这台机器的时候,我刚刚从高中gradle,所以它需要比以前更低级别的软件和dos的知识,或者如果我确实已经被遗忘了(我也不是什么新手)。 我的部分问题是这是一个高使用率的服务器,并把它放下几天来弄清楚事情不会飞得很好。 至于这个问题,我正在寻找任何在这种情况下可能会有所帮助的build议:关于在这个时代寻找好备件的build议,个人经验,使用类似的控制器修复RAID卷,或者从一个类似的控制器构build一个hyper-v虚拟机旧的netware服务器,软盘上的一行,RAID控制器有更好的软件,在内布拉斯加州有一个好的Novell顾问的build议,能够把事情做好,还有一个我还没有考虑过的其他select,等等。 更新: 对于备份,我们只有数据备份(最近通过恢复进行了validation),对于实际运行的软件没有任何影响。 更新2: 只是一个进展报告,我目前有一个工作在VMware虚拟服务器2.0的Netware 3.12安装,主要是我在这里find的指南: http://cerbulescubogdan.blogspot.com/2010/11/novell-netware-312-on-vmware.html 接下来的步骤是准备空的netware卷,以匹配现有服务器上的额外卷,将C:\驱动器上的所有内容以及我现有服务器上的netware卷进行转储,然后从该信息中找出哪些模块需要添加到netware,安装我的许可证(我们还有这个磁盘,如果有的话),以及移动数据。 我曾经批准在第一年之后把服务器closures一个星期(可惜不是以前),所以除了创build空的卷之外,其余的工作都要等到那个时候。 最终更新(2011年1月5日): 我可以在本周没有数据丢失的情况下在两个RAIDarrays中使用备件。 这两个现在都被控制器列为“FAULT TOLLERANT”(耶!)。 我也能够build立在我上次更新的进度上,现在在VMWare Server 2.0中有一个function“备用”服务器。 备件可以运行和使用我们的erp软件,但是我不能投入生产,因为我还不能从那个盒子打印(我不知道为什么)。 即使如此,如果我没有别的select,这个虚拟机将会勉强维持,而且在它和修复后的RAIDarrays之间,我很自在地适应这种情况,直到十一月份我才能把机器弄脏。 结语(2012年1月16日): 用一个全新的系统replace这个服务器的项目确实按计划进行。 万岁不再netware! […]

我应该使用RAID 5configuration运行数据库吗?

我听说RAID 5的写入性能有时会令人震惊。 虽然我想要它提供的冗余,我不想牺牲我的数据库插入/更新时间。 这是我应该担心的事情吗?如果是这样的话,那么build议如何在冗长的写作performance上取得成功呢?

Linux mdadm软件RAID 6 – 它是否支持位损坏恢复?

维基百科说:“除了RAID 6的一些实现之外,RAID 2是唯一的标准RAID级别,它可以自动从数据中的一位损坏中恢复准确的数据。 有谁知道Linux中的RAID 6 mdadm实现是否可以自动检测并从单一位数据损坏中恢复。 这与CentOS / Red Hat 6有关,如果这些与其他版本不同的话。 我尝试在网上search,但没有太多的运气。 在1E14位的SATA错误率为1,包含1.6E13位的2TB SATA磁盘的情况下,这对于防止数据损坏尤为重要。 编辑17-Jun-2015 我相信这不是我原本以为的担心 – 请参阅硬盘/ SSD – 检测和处理错误 – 可靠地阻止无提示数据损坏? 更多细节

大型NAS的RAIDconfiguration

我正在考虑构build一个24个1TB磁盘NAS盒,但是我不确定最佳的驱动器configuration是什么。 我正在使用槟榔ARC-1280ML-2G控制器,并挂上所有24个驱动器。 由于我们存储在其上的数据types,我希望将它们全部安装为一个卷。 我们的一个疯狂的想法是configuration6个4磁盘RAID 5卷,然后在这6个卷上执行软件RAID 5。 这意味着任何一卷可能会死在我们身上,我们仍然不会丢失数据。 我应该注意到,这是一个研发项目,我们有一个即将到来的应用程序,我们将需要几十TB的存储空间,以便快速和高可用性。 但是对于最初的研发阶段,我们可以接受一些风险。 什么是这种configuration的最佳解决scheme? 使用24个1TB磁盘,很可能会有多个磁盘同时出现故障(或在第一次故障后重build磁盘的时间内),所以我很难find一个好的解决scheme。

什么是(RAID控制器)BBU的?

我想知道BBU的目的是什么。 我的第一个理解是,它允许caching在电源故障期间将数据写入光盘。 但有些规格说BBU可以保存72小时的数据。 我希望数据可以在几毫秒内写入光盘(因为光盘还有电源)。 所以BBU不仅要保护caching,还要保护整个光盘几秒钟? 难道这不是更安全,因为caching数据写入光盘,而不是在caching中,并再次等待电源? 一秒钟左右后,光盘可以closures。

硬件RAID控制器caching电池故障频率/寿命?

我处于一个包含许多配备了Adaptec和LSI MegaRAID硬件RAID控制器的Supermicro服务器的环境中。 这些控制器包含电池支持的caching模块,以帮助提高写入性能并保护数据传输。 频繁的支持问题是RAID控制器电池故障。 这将数组从回 写模式转换为直 写模式。 当系统以降低的写入速度运行时,显然会有负面的性能影响。 这种情况一直存在,直到可以build立停机时间窗口来closures系统并更换电池。 对我们来说,这是一个非常常规的操作。 几乎每周都有几千台物理服务器…我们甚至有充电站准备更换电池,以便在没有充电周期的情况下进行更换。 也许我被HP ProLiant服务器和智能arraysRAID控制器宠坏了很久,但惠普系统的电池寿命通常为4 – 6年。 他们最终在2009年左右淘汰了使用RAID电池。它们被replace为超级电容支持的内存模块(闪存支持的写caching或FBWC),不需要更换,处理或长时间的初始充电周期。 由于我看到Adaptec和LSI控制器的电池故障有时会发生在服务时间不到 12个月的系统上,所以我想知道这在其他环境中是否常见。 如果这是常见的,其他大型服务器环境如何处理? 处理RAID电池更换的任何提示或技巧? 有没有任何configuration参数可以帮助? 这对你的环境中的操作有什么破坏性? 可怜的机箱冷却和温度是一个因素? 我们做错了什么? 戴尔PERC控制器由LSI制造。 戴尔环境是否会遇到同样短的电池寿命? 大规模集成电路产品文献概述了一种新一代电池,可以在一年内维持更长的使用寿命。 HP ProLiant DL585 G2服务器,拥有超过1000天的正常运行时间和开心的RAID电池… # uptime 05:38:08 up 1031 days, 44 min, 31 users, load average: 0.49, 0.64, 0.99 # hpacucli Cache Board Present: True Cache Status: OK […]

由于性能下降,我应该避免将两个SSD放入RAID1configuration中吗?

我有一个工作站系统,将有两个64GB的工业固态硬盘,并计划将两个磁盘在RAID1configuration冗余,这是在kickstart设置。 系统将运行CentOS 7.在研究这个问题时,我发现RHEL存储pipe理指南并不推荐SSD1使用RAID1。 红帽还警告说,不推荐在SSD上使用软件RAID级别1,4,5和6。 在这些RAID级别的初始化阶段,一些RAIDpipe理实用程序(如mdadm)会写入存储设备上的所有块,以确保校验和正常运行。 这将导致SSD的性能迅速下降。 这是我应该认真关注的吗? 我可以使用冗余吗? 再次根据RHEL文档 ,LVM镜像现在利用MD软件RAID,所以RAID警告也适用于此。 更多信息:SSD是Swissbit X-200系列(SATA),看起来过度configuration是40%。 根据硬件团队的说法,硬件RAID不会成为一种select。

为SQL Server推荐的磁盘/分区设置

我正在寻找关于为SQL Server设置我的磁盘/分区的最佳方法的一些build议。 以下是我的一些主要问题: SQL文件应该如何分离(数据文件,日志,临时文件)? 对RAID进行大量的硬盘分区和分区,或者为每个RAID使用更less的磁盘来创build多个RAID,会更好吗? 数据和日志文件应该是不同的RAIDtypes? 如果默认的数据库(master,msdb等)位于C:或者应该与其他数据/日志文件在同一个地方?

如何备份存储服务器?

我正在考虑实现一个非常大的存储服务器作为其他几个服务器(所有基于Linux的)的现场NAS。 非常大,我的意思是介于4TB和20TB之间的可用空间 (尽pipe实际上我们不太可能把它做成20TB)。 存储服务器为了保证数据的安全性和性能,将采用RAID 10,但我们仍然需要备份解决scheme,包括非现场备份。 我的问题是: 你如何备份这么多的数据!? 这不像我可以连接一个便携式硬盘驱动器,并传输文件。 我们目前没有其他设备有这么多的存储空间。 我是否需要为第二个非现场存储服务器预算,还是有更好的解决scheme?

在这个RAID 5configuration中有多less个磁盘太多?

惠普2012i SAN, RAID 5中有7个磁盘,有1个热备份, 花了好几天的时间把容量从5个扩大到7个300GB的SAS硬盘。 寻找什么时候以及如何确定在SAN中有两个卷的build议,每个都有RAID 5,会更好? 有一天,我可以在控制器上增加3个驱动器,SAN用于ESX / vSphere虚拟机。 谢谢…