raid磁盘更换核心是“先标记、再移除、后替换”,需依次执行cat /proc/mdstat和mdadm --detail定位故障盘,--fail标记、--remove移除,新盘分区设为linux raid auto类型后--add加入,重建完成确认active sync并更新mdadm.conf。

更换损坏的 RAID 磁盘并重建,核心是“先标记、再移除、后替换”,整个过程可在不中断业务的前提下完成(RAID1/5/10 均支持)。关键不是换盘动作本身,而是严格按 mdadm 的逻辑顺序操作,避免跳步或误操作导致数据异常。
确认哪块盘真正故障
不要凭直觉拔盘。先看阵列整体状态和具体设备标记:
- 运行
cat /proc/mdstat—— 关注是否有(F)标记或显示faulty、failed; - 执行
mdadm --detail /dev/md0(把md0换成你的实际阵列名)—— 明确看到某设备(如/dev/sdc1)状态为failed或Faulty; - 辅助查日志:
sudo journalctl -u mdadm.service | grep -i "fail\|error",确认硬件报错是否指向同一设备。
主动标记并安全移除故障盘
标记是让内核停止向该盘写入的关键步骤,不可省略:
PyCharm 2026.2.0.1 Linux版提供 JetBrains 官方 2026.2.0.1 版本安装包,适合需要指定 PyCharm 版本进行 Python 项目开发、运行和调试的用户。
- 用
mdadm --manage /dev/md0 --fail /dev/sdc1主动标记为故障 —— 阵列会立即进入degraded状态,但仍在运行; - 紧接着执行
mdadm --manage /dev/md0 --remove /dev/sdc1—— 此时设备应从Active Devices中消失,Failed Devices计数归零; - 再次
mdadm --detail /dev/md0确认该盘已显示为removed,且剩余盘仍处于active sync状态。
准备新盘并加入阵列
新硬盘必须分区并设为 RAID 成员类型,否则无法被识别为有效成员:
- 用
fdisk /dev/sdc(或gdisk)创建分区(如/dev/sdc1); - 在
fdisk中输入t→fd(设为 Linux RAID auto 类型);若用gdisk,则输入t→fd00; - 保存退出后,运行
partprobe /dev/sdc让内核重读分区表; - 执行
mdadm --manage /dev/md0 --add /dev/sdc1加入新盘 —— 此刻/proc/mdstat会显示recovery或spare rebuilding。
等待重建完成并固化配置
重建耗时取决于阵列大小与当前负载,期间严禁强制中断或重复加盘:
- 持续观察
cat /proc/mdstat—— 直到状态变为active sync且无recovery字样; - 运行
mdadm --detail /dev/md0确认所有设备状态为active sync,State回到clean; - 更新配置文件:
mdadm --detail --scan >> /etc/mdadm.conf(覆盖或追加,确保内容准确); - 若使用 systemd,建议执行
dracut -f更新 initramfs,防止重启后阵列无法自动装配。










