第一部分:数据恢复方案

某公司的一台服务器组了一个raid5磁盘阵列有两块磁盘先后掉线,服务器崩溃。故障服务器的操作系统为linux redhat 5.3,应用系统为构架于oracle的一个oa,数据重要,时间很急。因oracle已经不再对本oa系统提供后续支持,用户要求尽可能数据恢复+操作系统复原。
【初检结论】
    热备盘完全无启用,硬盘无明显物理故障,无明显同步表现。数据通常可恢复
【恢复方案】
    1、保护原环境,关闭服务器,确保在恢复过程中不再开启服务器。
    2、将故障硬盘标好序号,确保在拿出槽位后可以完全复原。
    3、将故障硬盘挂载至只读环境,对所有故障硬盘做完全镜像(参考<如何对磁盘做完整的全盘镜像备份>)。备份完成后交回原故障盘,之后的恢复操作直到数据确认无误前不再涉及原故障盘。
    4、对备份盘进行RAID结构分析,得到其原来的RAID级别,条带规则,条带大小,校验方向,META区域等。
    5、根据得到的RAID信息搭建一组虚拟的RAID5环境。
    6、进行虚拟磁盘及文件系统解释。
    7、检测虚拟结构是否正确,如不正确,重复4-7过程。
    8、确定数据无误后,按用户要求回迁数据。如果仍然使用原盘,需确定已经完全对原盘做过备份后,重建RAID,再做回迁。回迁操作系统时,可以使用linux livecd或win pe(通常不支持)等进行,也可以在故障服务器上用另外硬盘安装一个回迁用的操作系统,再进行扇区级别的回迁。
    9、数据移交后,由北亚数据恢复中心延长保管数据3天,以避免可能忽略的纰漏。
【恢复周期】
    备份时间,约2小时。解释及导出数据时间,约4小时。回迁操作系统,约4小时。

第二部分:数据恢复及系统复原过程

1、对原硬盘进行完整镜像,镜像后发现2号盘有10-20个坏扇区,其余磁盘,均无坏道。
    2、分析结构:得到的最佳结构为0,1,2,3盘序,缺3号盘,块大小512扇区,backward parity(Adaptec),结构如下图:

3、组好后数据验证,200M以上的最新压缩包解压无报错,确定结构正确。
    4、直接按此结构生成虚拟RAID到一块单硬盘上,打开文件系统无明显报错。
    5、确定备份包安全的情况下,经客户同意后,对原盘重建RAID,重建时已经用全新硬盘更换损坏的2号盘。将恢复好的单盘用USB方式接入故障服务器,再用linux SystemRescueCd启动故障服务器,之后通过dd命令进行全盘回写。
    6、回写后,启动操作系统。正常情况下,这时候所有工作应该完成了。不巧的是,因帮颇费周折才解决,特意另起一段叙述。

系统复原过程:

dd所有数据后,启动操作系统,无法进入,报错信息为:/etc/rc.d/rc.sysinit:Line 1:/sbin/pidof:Permission denied
    怀疑此文件权限有问题,用SystemRescueCd重启后检查,此文件时间,权限,大小均有明显错误,显然节点损坏。
    重新分析重组数据中的根分区,定位出错的/sbin/pidof,发现问题因2号盘坏道引起。
    使用0,1,3这3块盘,针对2号盘的损坏区域进行xor补齐。补齐后重新校验文件系统,依然有错误,再次检查inode表,发现2号盘损坏区域有部分节点表现为(图中的55 55 55部分):

很明显,虽然节点中描述的uid还正常存在,但属性,大小,以最初的分配块全部是错误的。按照所有可能进行分析,确定无任何办法找回此损坏节点。只能希望修复此节点,或复制一个相同的文件过来。
    对所有可能有错的文件,均通过日志确定原节点块的节点信息,再做修正。
    修正后重新dd根分区,执行fsck -fn /dev/sda5,进行检测,依然有报错,如下图:

根据提示,在系统中发现有多个节点共用同样的数据块。按此提示进行底层分析,发现,因3号盘早掉线,帮存在节点信息的新旧交集。
    按节点所属的文件进行区别,清除错误节点后,再次执行fsck -fn /dev/sda5,依然有报错信息,但已经很少。根据提示,发现这些节点多位于doc目录下,不影响系统启动,于是直接fsck -fy /dev/sda5强行修复。
    修复后,重启系统,成功进入桌面。
    启动数据库服务,启动应用软件,一切正常,无报错。
    到此,数据恢复及系统回迁工作完成。

某公司服务器raid5阵列掉了两块盘数据恢复过程相关推荐

  1. 服务器运行时拔了一块硬盘,服务器硬盘掉了两块的解决过程

    一.服务器数据恢复故障描述 需要进行数据恢复的服务器共10个磁盘柜,每个磁盘柜满配24块硬盘.其9个存储柜用作数据存储使用,另外1个存储柜用作元数据存储使用.元数据存储里一共24块146G硬盘,其中设 ...

  2. RAID5服务器磁盘阵列,两块盘坏了数据恢复

    RAID5服务器磁盘阵列,两块盘坏了数据恢复,全国×××,现场进行服务器 RAID5数据修复 专业提供服务器数据恢复,服务器硬盘维修,RAID数据恢复,RAID阵列数据恢复,RAID5数据恢复,RAI ...

  3. 某公司服务器raid阵列2块硬盘损坏数据恢复成功案例

    一.raid数据恢复故障描述 故障描述 HP FC MSA2000存储 整个存储空间由8块450GB SAS的硬盘组成,其中7块硬盘组成一个RAID5的阵列,剩余1块做成热备盘使用.由于RAID5阵列 ...

  4. 某品牌服务器raid5阵列删除数据恢复过程分析

    [服务器raid5阵列数据恢复故障情况描述] 客户的某品牌服务器,raid5磁盘阵列数据恢复需求,服务器不存在物理故障,数据丢失的原因是误删除了服务器上的卷.可以从raid5磁盘阵列层面进行数据恢复操 ...

  5. P2000 RAID-5两块盘离线数据恢复过程

    服务器数据恢复故障描述 服 务  器  型  号:HP P2000 服务器操作系统:VMWARE ESX 服务器文件系统:VMFS 磁盘阵 列 级 别:RAID-5 需要进行数据恢复的服务器挂载了8块 ...

  6. HP P2000 RAID-5两块盘离线的数据恢复报告

    1. 故障描述 本案例是HP P2000的存储vmware exsi虚拟化平台,由RAID-5由10块lT硬盘组成,其中6号盘是热备盘,由于故障导致RAID-5磁盘阵列的两块盘掉线,表现为两块硬盘亮黄 ...

  7. Raid5损坏两块盘

    以下为浪潮Inspur NF5460M4型号服务器故障处理过程: 设备raid5组损坏两块硬,并raid组处理离线状态,情况如图: 由于硬盘数据比较重要,面对此情况不要慌我们尽量做到安全保守的保证数据 ...

  8. 【服务器数据恢复】HP StorageWorks系列存储RAID5两块盘离线的数据恢复

    服务器存储数据恢复环境: HP StorageWorks系列存储: VMWARE ESX虚拟主机平台,VMFS文件系统: 8块硬盘组成RAID5,1块热备盘. 服务器存储故障: 服务器在正常运行中两块 ...

  9. RAID5阵列掉盘显示未初始化---解决过程

    背景: 早上打开电脑,发现英特尔阵列管理工具(英特尔 virtual RAID on CPU)报错,提示说"阵列性能下降,有数据丢失风险" 解决思路: 点开"我的电脑&q ...

最新文章

  1. linux下多线程的调试
  2. 什么是时间管理,一个大四学生的简单理解
  3. Day 62 Django第三天
  4. Spring实战Day2
  5. C#使用Xamarin开发可移植移动应用(3.Xamarin.Views控件)附源码
  6. arcgis python实例_arcgis二次开发_arcgis二次开发python_arcgis二次开发实例
  7. 10.11 安装pod
  8. linux内核 lts长期演进,Linux Kernel 4.19 和 5.4 生命周期延长至 6 年
  9. hive(3)HiveQL数据定义
  10. python mainloop作用_Tkinter中的mainloop应该如何理解?
  11. Membership Leakage in Label-Only Exposures论文解读
  12. 最新 Axure 激活码
  13. 将图片从AutoCAD导出到Word
  14. Java 进制转换 代码
  15. 《管理的常识》7-“什么是计划”读后感及读书笔记
  16. 快速傅里叶变换使用方法
  17. javascript instaceof
  18. 介绍一些新手入门FPGA的优秀网站(新增4)
  19. 浅谈人行二代征信对接申请及接入验收流程
  20. 2D转换之旋转和旋转三角形的做法(7)

热门文章

  1. 高等数学复习之一(函数与极限)
  2. 如何用 Python 爬取网页制作电子书
  3. Windows编译libjpeg库
  4. ERP系统的主要功能模块
  5. 【C++入门必看】C++从0到1入门编程
  6. 星巴克:邮件里的夏趣盎然
  7. 《一种摄影创作理念》
  8. 《js闭包》超级实用 一眼看懂js闭包--Onload返回变量值
  9. 无线网络优化管理面试题和笔试题
  10. 粘塑性自洽多晶体塑性模型VPSC(一)