linux下创建raid必须用mdadm,且需提前分区并设fd类型、配置/etc/mdadm.conf、执行dracut -f(rhel系)或启用mdadm服务(debian系),否则开机无法识别/dev/md0或自启失败。

Linux下创建RAID必须用 mdadm,没有替代方案;不提前分区、不设fd类型、不写/etc/mdadm.conf,阵列大概率无法开机自启或识别为预期设备名(比如变成/dev/md127)。
为什么mdadm -C创建后/dev/md0没出现或状态异常
常见现象是执行完mdadm -C /dev/md0 -l 5 -n 3 /dev/sdb /dev/sdc /dev/sdd后,cat /proc/mdstat显示inactive,或mdadm -D /dev/md0报错“no such device”。
- 根本原因:多数现代发行版(CentOS 7+/RHEL 8+/Ubuntu 20.04+)要求参与RAID的设备必须是**已分区且类型设为
fd(Linux RAID auto)**,不能直接用整盘(如/dev/sdb)——否则内核可能拒绝组装 - 验证方式:
fdisk -l /dev/sdb看Partition Type是否为fd;不是就用fdisk /dev/sdb→t→fd→w改 - 另一个易漏点:
mdadm -C命令里加-a yes才自动创建/dev/md0设备节点;不加的话得手动mknod,极不推荐
mdadm --create参数中-n、-l、--spare-devices怎么配才不出错
参数顺序和语义混淆是创建失败主因,尤其-n只计**活动设备数**,不包括热备盘。
-
-n 3+--spare-devices=1表示:3块盘参与RAID计算(如RAID5需至少3块),另1块纯备用;总物理盘数=4 -
-l 5要求至少3块活动盘;-l 1要求至少2块;-l 0至少2块;-l 6至少4块——少于最低数量会直接报错 - RAID5实际可用空间 =
(最小盘容量) × (n-1),不是所有盘容量之和;混用不同容量盘时,以最小那块为准 - 别用
-x(旧参数),它已被弃用;新版统一用--spare-devices
为什么mdadm -D /dev/md0显示State : clean, degraded却能挂载
这是RAID5/6在有盘掉线但未完全失效时的正常中间态,不代表数据损坏,但必须立刻处理。
-
degraded表示当前活动盘数 -n指定数(例如-n 3但只剩2块在线),RAID靠奇偶校验仍在运行,但无冗余能力 - 检查具体哪块出问题:
mdadm -D /dev/md0 | grep -A 5 "Failed Devices"或看/proc/mdstat中带(F)标记的设备 - 若确认某盘物理损坏,先
mdadm /dev/md0 -f /dev/sdb1标记失效,再--remove,最后--add新盘——顺序错会导致同步中断 - 热备盘(spare)会自动触发重建,但重建过程IO压力极大,避免在此期间做大量写操作
/etc/mdadm.conf不写或写错,重启后/dev/md0变/dev/md127
这是最常被忽略却后果最严重的配置项。系统启动时靠mdadm --scan读取该文件来映射设备名,否则按发现顺序编号。
- 正确生成方式:
mdadm -D --scan > /etc/mdadm.conf(注意是--scan,不是-s) - 文件内容必须包含
ARRAY行,形如:ARRAY /dev/md0 metadata=1.2 name=localhost:0 UUID=xxx;缺UUID或路径错,initramfs阶段无法识别 - CentOS/RHEL系还需运行:
dracut -f重生成initramfs,否则即使mdadm.conf对了,启动时也找不到阵列 - Ubuntu/Debian系则要确保
mdadm服务已启用:systemctl enable mdadm
真正麻烦的从来不是创建那一刻,而是半年后某天重启,发现/dev/md0变成了/dev/md127,而/etc/fstab里还硬编码着/dev/md0——挂载失败,服务起不来。这种问题不会报错,只会静默失败。










