全文连接服务器
1. 故障描述
本案例是HP P2000的存储vmware exsi虚拟化平台,由RAID-5由10块lT硬盘组成,其中6号盘是热备盘,因为故障致使RAID-5磁盘阵列的两块盘掉线,表现为两块硬盘亮黄灯。 经用户方维护人员检测,故障硬盘应为物理故障,表现为:序列号没法读取,在SAS扩展卡上硬盘没法识别。ide
2. 数据备份与修复
故障发生后用户方工程师与我公司联系,通过详细咨询,了解到故障比较严重,必须把RAID-5磁盘阵列带到我公司进行检测,检测RAID-5的每块成员盘是物理故障(磁头损坏或者盘片划伤)仍是逻辑故障。因为状况紧急,工程师在接到原盘之后,当即着手准备检测。对能识别的好盘用链接到北亚镜像服务器上使用WinHex作扇区级镜像,同时对不能识别的坏盘进行检测。
首先将坏盘链接到外部的SAS扩展卡上,加电后经过硬盘工做声音判断硬盘电机可以起转,可是磁头没有进行寻道操做,因而尝试把硬盘PCB分离下来对HDA组件氧化部分进行清洁操做,将PCB还原后故障依旧。因而和客户沟通使用6号热备盘的好PCB替换到故障盘上进行尝试性修复,再将故障盘PCB上的ROM芯片替换到6号盘的好PCB上面后硬盘工做时起转和磁头寻道声音都正常,可是在寻道结束后,有明显的敲盘声音,因而判断有可能磁头损坏。在和用户沟通后尝试使用6号热备盘中的好磁头对故障盘进行替换操做以读取数据。在无尘室对故障盘进行开盘更换磁头操做后,将故障盘链接到专业硬盘维修工做上进行检测,发现故障盘已经不能识别,数据没法读取。
由于用户有两块故障盘,以前尝试修复的都是其中一块,再次和客户沟通尝试对另外一块故障盘进行修复操做。和先前的故障盘同样,这块盘的故障依旧是磁头损坏,由于用户的HP OEM盘价格昂贵,因而尝试在网上购买ST原厂的相同型号硬盘进行磁头更换。这块硬盘的磁头更换完成后,设备可以正常识别硬盘,因而将故障盘全部扇区完整镜像到一块相同容量的备份盘中。ui
3.重组RAID-5步骤
【判断起始扇区】全部硬盘都镜像好后就能够重组了,用WinHex打开9块盘(热备盘不须要加进去重组),先把镜像文件解析成磁盘。能够看到这9块盘的0扇区都有“55 AA”标志,如图1所示。spa
图1
查找结果如图2所示,0x01C2H处表示该分区的类型,这里显示“05”,表明这是一个扩展分区。所以从0扇区看这是一个不正常的MBR分区结构。orm
图2
按图1方式继续往下找,分别在9号盘和8号盘找到了“55 AA”的标志。9号盘查询结果如图3所示。这是一个正常的MBR分区,其0x01C6处数值表明指向的下一个扇区为GPT的头部。 blog