必须在业务不中断前提下用pvmove迁移坏盘数据,前提是lvm仍可读取、新盘已加入vg且容量足够;迁移后验证pe清零和lv激活状态,再执行vgreduce和pvremove安全移除故障pv。

当系统中某块物理硬盘出现坏道但尚未完全失效,LVM仍能读取其上数据时,必须在业务不中断的前提下将该盘上的所有PE(物理扩展)安全迁出,否则后续I/O错误可能引发LV不可用或数据丢失。
确认坏盘状态并锁定可读性
先运行 dmesg | grep -i "sdb\|error" 查看内核日志,重点捕捉“end_request: I/O error”或“sector not readable”类报错;若连续出现3次以上,说明该盘已进入不稳定读取阶段。
执行 smartctl -a /dev/sdb,检查 【Reallocated_Sector_Ct】 和 【Current_Pending_Sector】 两项数值——只要任一值大于0,就必须立即启动迁移流程,不能等待盘彻底宕机。
运行 pvs -v 确认输出中 /dev/sdb 显示为 “allocatable” 状态;若显示 [unknown] 或 missing,则LVM已断开连接,【此时pvmove将直接失败,不可继续操作】。
准备新盘并加入卷组
方法一:无分区直用(适用于新盘未被其他系统使用过)
执行 pvcreate /dev/sdd → vgextend vg00 /dev/sdd。
方法二:需分区场景(如旧盘为/dev/sdb1,新盘需保持相同分区结构)
用 fdisk /dev/sdd 创建一个主分区 → 将分区类型设为 8e(Linux LVM)→ partprobe /dev/sdd 刷新内核分区表 → pvcreate /dev/sdd1 → vgextend vg00 /dev/sdd1。
注意:新盘容量必须 ≥ 旧盘已分配的PE总量,可通过 pvdisplay /dev/sdb | grep "Allocated PE" 获取确切数值,低于该值会导致pvmove中途卡死。
执行在线数据迁移
第一步:启用进度监控,避免误判迁移是否完成
执行 pvmove -i 5 /dev/sdb /dev/sdd,其中 -i 5 表示每5秒刷新一次进度,防止因后台任务阻塞而误以为命令无响应。
第二步:观察实时迁移状态
新开终端运行 watch -n 1 'pvs -o +pv_used,pe_count',重点关注 /dev/sdb 的Used列是否持续下降、/dev/sdd 是否同步上升;若某次刷新后 /dev/sdb Used值停滞超过2分钟,需立即检查 dmesg 是否新增I/O错误。
第三步:验证迁移完整性
待 pvmove 返回成功退出码(echo $? 输出0)后,执行 pvdisplay /dev/sdb,确认 Alloc PE 和 Used PE 均为0;再运行 lvscan 检查所有LV是否仍处于 active 状态——若有LV显示 inactive,说明迁移过程中发生了元数据损坏,需从备份恢复。
移除故障物理卷
执行 vgreduce vg00 /dev/sdb,该命令仅从VG中摘除PV引用,不擦除磁盘数据。
执行 pvremove /dev/sdb,这一步会清除LVM元数据头,使该设备彻底脱离LVM管理。
拔下物理硬盘前,再次运行 lsblk 确认 /dev/sdb 已不在输出列表中;若仍可见,说明内核缓存未刷新,需执行 echo 1 > /sys/block/sdb/device/delete 强制卸载设备节点。











