检测linux磁盘坏块有五种方法:一、只读扫描(badblocks -sv)适用于挂载设备;二、非破坏性读写测试(-nsv)需卸载分区;三、破坏性写入测试(-wsv)会清空数据;四、s.m.a.r.t.评估(smartctl)快速筛查健康状态;五、将坏块注入ext文件系统(e2fsck -l)使其永久避开故障扇区。

如果您需要确认Linux服务器中某块磁盘是否存在物理层面的不可靠存储区块,则可能是由于硬盘老化、供电异常或机械损伤导致扇区响应失败。以下是检测磁盘坏块的多种方法:
一、只读扫描:安全筛查已挂载或待检磁盘
该模式仅执行读取操作,不修改任何数据,适用于日常巡检、备份后验证或无法卸载的设备(如部分外接盘)。它能识别明显无法读取的扇区,但对偶发性不稳定扇区敏感度较低。
1、使用 lsblk -f 或 sudo fdisk -l 确认目标设备路径(例如 /dev/sdb1),避免误选系统盘。
2、执行只读检测并实时显示进度:sudo badblocks -sv /dev/sdb1 > badsectors_readonly.txt。
3、若需提升结果可信度,添加 -p 3 对初筛出的疑似坏块重复读取三次,仅三次全失败者才计入输出文件。
二、非破坏性读写测试:平衡准确性与数据安全性
此模式在读取原始数据后写入测试值并立即恢复,全程不改变用户数据,可暴露仅在写入路径触发的故障(如缓存控制器异常、写入放大失效),比纯读取更可靠,但仍要求目标分区处于未挂载状态。
1、先卸载目标分区:sudo umount /dev/sdb1;若提示“device busy”,使用 lsof +D /mount/point 查找占用进程并终止。
2、运行非破坏性扫描:sudo badblocks -nsv /dev/sdb1 > badsectors_nondestructive.txt。
3、为降低I/O压力,可结合调度策略:ionice -c 3 nice -n 19 sudo badblocks -nsv /dev/sdb1。
三、破坏性写入测试:彻底验证硬件稳定性(慎用)
该模式向每个扇区写入特定模式数据并校验,强制触发硬盘固件的重映射机制(GList更新),能发现隐藏更深的物理缺陷,但会清空整个设备上的所有数据,仅限于空盘、已完整备份或准备重格式化的磁盘。
1、确保无重要数据且已卸载:sudo umount /dev/sdb1。
2、执行全盘写入验证:sudo badblocks -wsv /dev/sdb1 > badsectors_destructive.log。
3、如需适配大容量硬盘效率,可指定块大小与批量数:sudo badblocks -wsv -b 4096 -c 128 /dev/sdb1。
四、S.M.A.R.T.前置评估:快速获取固件级健康指标
该方法不依赖文件系统,直接读取磁盘内部传感器与日志,耗时短、无I/O干扰,适合大规模批量筛查或生产环境在线监控,但无法替代底层扇区级扫描,仅作为初步风险过滤手段。
1、安装工具:sudo apt install smartmontools(Debian/Ubuntu)或 sudo yum install smartmontools(RHEL/CentOS)。
2、查看整体健康状态:sudo smartctl -H /dev/sdb。
3、检查关键属性:sudo smartctl -a /dev/sdb | grep -E "(Reallocated_Sector_Ct|Current_Pending_Sector|UDMA_CRC_Error_Count)";其中 Current_Pending_Sector 非零即表示存在尚未重映射的高危扇区。
五、坏块结果注入文件系统:使ext系列文件系统永久避开故障区域
扫描生成的扇区编号列表本身不具备防护能力,必须将其写入文件系统元数据,才能确保后续分配逻辑块时自动跳过这些位置。此步骤仅对ext2/ext3/ext4有效,且必须在分区未挂载状态下执行。
1、确认坏块文件格式为每行一个十进制扇区号,内容无空行或非数字字符。
2、执行标记操作:sudo e2fsck -l badsectors_readonly.txt /dev/sdb1。
3、若需保留原有坏块记录并追加新结果,添加 -k 参数:sudo e2fsck -lk badsectors_nondestructive.txt /dev/sdb1。










