服务器数据恢复—raid5阵列热备盘上线过程中又一块盘掉线的数据恢复

简介: 华为某型号服务器,中有一组由24块硬盘组建的raid5阵列,其中一块盘为热备盘。服务器raid5阵列中一块硬盘离线,热备盘激活后开始同步数据,在同步数据过程中又有一块硬盘离线,服务器数据丢失,上层应用崩溃。北亚企安数据恢复工程师拿到故障服务器中所有硬盘后进行检测。经过检测,服务器数据恢复工程师发现除了一块硬盘之外,其他硬盘均不存在物理故障。

服务器数据恢复环境&故障:
华为某型号服务器,中有一组由24块硬盘组建的raid5阵列,其中一块盘为热备盘。
服务器raid5阵列中一块硬盘离线,热备盘激活后开始同步数据,在同步数据过程中又有一块硬盘离线,服务器数据丢失,上层应用崩溃。
北亚企安数据恢复工程师拿到故障服务器中所有硬盘后进行检测。经过检测,服务器数据恢复工程师发现除了一块硬盘之外,其他硬盘均不存在物理故障。

服务器数据恢复过程:
1、由于该服务器中的控制器磁盘检测策略比较严格,控制器会将不存在物理故障但性能不稳定的硬盘认定为坏盘并踢出raid阵列。故障服务器中掉线的两块盘中有一块盘就是因为读写不稳定掉线。
2、镜像完所有硬盘后,基于镜像文件分析所有硬盘的底层数据(raid阵列的条带大小、数据走向、硬盘顺序、热备盘、数据库的分布规律等),根据分析获取到的raid信息重组raid。
3、在重组raid过程中发现有一块硬盘内的数据被同步破坏,在恢复数据的过程中需要将这块硬盘排除。数据恢复工程师将所有硬盘底层数据进行对比,发现了其中一块硬盘在相同条带上的数据与其他硬盘明显不同。使用北亚企安自主研发的raid校验程序对该硬盘进行条带校验后确认该硬盘已被同步破坏。
4、服务器数据恢复工程师重组raid后,分析lun在raid中的分配情况及数据块map。只要能够的将map完整提取,即可借助北亚企安数据恢复中心自主开发的程序解析并恢复lun数据。
5、北亚企安数据恢复工程师自主编写了文件系统解析程序解析raid内的文件系统,导出数据库文件后移交给数据库数据恢复工程师进行校验和修复。
6、数据库工程师验证数据库文件后发现部分数据库文件及日志文件异常,表空间内存在大量坏块,所有控制文件被破坏,undotbs02丢失、数据库数据恢复工程师对数据库文件进行修复。
01副本.jpg
02副本.jpg

7、经过数据库数据恢复工程师的修复和验证,恢复出数据库数据。服务器数据恢复工程师将修复完成的数据库数据导入验证,验证后确认所有数据正常。交由用户方验证,数据完整有效。本次数据恢复工作完成。

相关文章
|
8月前
|
人工智能 自然语言处理 程序员
2026年OpenClaw/Clawdbot 极速部署教程+72个精选Skills打造全能AI助手
从只会写代码的“工具人”,到能写公众号、管邮件、做数据分析、定决策的全能AI助理,只需为OpenClaw(原Clawdbot/Moltbot)装上合适的Skills。2026年OpenClaw官方技能仓库**awesome-openclaw-skills**已收录3002个社区构建技能,覆盖内容创作、开发工具、自动化运营等全场景,遵循Anthropic开放标准,即装即用。
2413 11
|
23天前
|
存储 SQL 运维
【服务器数据恢复】基于不同机型的服务器RAID5容错原理与数据恢复策略
随着信息技术的持续迭代,服务器硬件架构与阵列技术不断升级,不同型号服务器的RAID5故障表现、处理逻辑及恢复方法存在明显差异。当前,大型业务系统的网络架构多采用C/S或B/S模式,核心业务数据库均部署在中心机房的专用服务器中。为保障数据存储的安全性、稳定性与可靠性,行业内普遍采用RAID磁盘阵列技术实现磁盘冗余备份。
178 26
|
21天前
|
存储 运维 安全
【服务器数据恢复】WinServer服务器RAID5故障数据恢复及安全防护建议
本次故障设备为文件服务器,整机未配置UPS不间断电源。设备存储由6块SAS硬盘组建RAID5磁盘阵列,搭载Windows Server操作系统,主要用于内部部门文件存储与数据共享业务。 设备运行期间经历多次意外断电,重启后服务器出现RAID阵列报错,系统无法识别存储设备。运维人员进入RAID管理模块排查时,设备直接死机,多次重启后故障现象依旧,阵列异常问题无法自行解决。为挽回业务数据,用户将整机设备送至我方进行专业数据恢复处理。
|
1月前
|
存储 运维 Oracle
【数据库恢复】ORACLE数据库故障数据恢复方案
常见ORACLE数据库数据灾难故障表现: 1、数据库无法启动、运行异常,业务无法正常访问; 2、ASM存储结构损坏、异常失效; 3、数据库核心数据文件丢失; 4、数据文件局部损坏、数据异常; 5、DUMP日志文件损坏、无法正常读取使用。
|
7月前
|
人工智能 Kubernetes API
“企业AI龙虾馆“规模化指南:OpenClaw阿里云/本地部署+LongBot System集群+免费百炼API配置+FAQ
在企业数字化转型过程中,AI工具的分散部署与无序管理成为新痛点——各部门独立使用OpenClaw(昵称“龙虾”),导致Agent重复创建、技能开发冗余、数据安全失控,不仅浪费资源,还难以形成企业级AI协同能力。传统OpenClaw虽能满足单一场景自动化需求,但缺乏多实例管控、权限隔离、技能共享等企业级核心能力,无法适配规模化应用。
1558 7
|
7月前
|
人工智能 安全 前端开发
Team 版 OpenClaw:HiClaw 开源,5 分钟完成本地安装
HiClaw 基于 OpenClaw、Higress AI Gateway、Element IM 客户端+Tuwunel IM 服务器(均基于 Matrix 实时通信协议)、MinIO 共享文件系统打造。
11697 59
|
12月前
|
存储 运维 Oracle
服务器数据恢复—存储硬盘指示灯亮黄灯,RAID5阵列崩溃的数据恢复案例
服务器存储数据恢复环境: 某单位一台某品牌DS5300存储,1个机头+4个扩展柜,50块的硬盘组建了两组RAID5阵列。一组raid5阵列有27块硬盘,存放Oracle数据库文件。存储系统上层一共划分了11个卷。 服务器存储故障: 存储设备上两个硬盘指示灯亮黄色。其中一组RAID5阵列崩溃,存储不可用,设备已经过保。
|
12月前
|
存储 运维 数据挖掘
服务器数据恢复—Raid5阵列2块硬盘损坏,热备盘未激活的数据恢复
EMC存储上有一组由多块stat硬盘组建的raid5磁盘阵列,该raid5阵列中有两块热备盘。上层采用的是zfs文件系统。 raid5阵列中2块硬盘出现故障,只有一块热备盘激活。
|
9月前
|
存储 数据挖掘 数据库
虚拟机数据恢复—误删除ESXi虚拟机的数据恢复案例
某品牌服务器,部署ESXi虚拟化系统,分配多个lun。 服务器管理员在进行常规维护时误操作删除了其中一个lun上的虚拟机,这台被误删除的虚拟机上存储了SqlServer2000数据库和一些其他格式的数据。 服务器管理员误删除数据后马上向领导报告情况并申请关闭了服务器。
|
10月前
|
存储 数据库 内存技术
Vsan数据恢复—攻克VSAN存储故障:非正常关机引发虚拟机磁盘丢失的数据恢复案例
vsan故障: vsan超融合架构包含4台服务器节点,每台服务器上有相同数量的固态硬盘和机械硬盘,固态硬盘作为缓存盘使用。 机房供电不稳导致服务器非正常关机。服务器管理员重启服务器后发现vsan逻辑架构出现故障,部分虚拟磁盘组件异常、磁盘文件丢失。

热门文章

最新文章