fio测磁盘io必须加direct=1绕过page cache,否则结果失真;dd需同时设iflag=direct和oflag=direct;数据库关注4k随机读写iops与延迟,大文件关注顺序吞吐量。

用 fio 测磁盘 IO,先绕过缓存再测才真实
直接跑 fio 默认会走 page cache,测出来的是内存+磁盘的混合速度,不是磁盘真实能力。必须加 direct=1 强制绕过缓存,否则随机读写、小块 IO 的结果完全失真。
-
direct=1是硬性要求,不加等于白测;但某些老旧内核或裸设备可能不支持,报错Operation not supported时需换buffered=1并在结论里注明 - 测试前建议卸载目标分区(如
/dev/sdb1),避免文件系统层干扰;若无法卸载,至少确保filename指向一个独立大文件(如/mnt/testfile),别和业务数据混在一起 - 不要用
/tmp或/root目录——这些常挂载在内存盘(tmpfs)或系统盘上,测的不是目标磁盘
dd 能快速摸底,但参数选错就全废
dd 不是专业工具,但胜在系统自带、上手快。关键在两个标志位:iflag=direct 和 oflag=direct 必须同时出现,否则默认走缓存,写入速度可能虚高 5–10 倍。
- 测写:用
dd if=/dev/zero of=testfile bs=1M count=2048 oflag=direct,count=2048对应 2GB,太小(如 100MB)易受瞬时波动影响 - 测读:用
dd if=testfile of=/dev/null bs=1M iflag=direct,注意不能省略iflag=direct,否则读的是 page cache 里的热数据 - 别信
conv=fdatasync或oflag=dsync——它们只保证落盘,不绕缓存;真正绕缓存只有direct标志
顺序 vs 随机、读 vs 写,场景不同指标意义完全不同
IOPS 和吞吐量(MB/s)永远是一对矛盾体。比如 SSD 在 4K 随机读下 IOPS 可达 10w+,但吞吐才 400MB/s;而顺序读同样 400MB/s 时,IOPS 还不到 10w。选哪个测,取决于你的真实负载。
- 数据库、虚拟机盘:重点看
rw=randread/rw=randwrite+bs=4k,关注IOPS和latency(延迟) - 视频转码、备份归档:用
rw=read/rw=write+bs=1M,盯紧bw(带宽,即 MB/s) - 混合负载(如
rw=randrw,rwmixread=70)更贴近生产,但需明确读写比例,否则结果无法对标
看懂 fio 输出里的三个关键数字
fio 报告末尾的三行数值,90% 的人只扫一眼 bw 就结束,其实 iops 和 iowait(或 lat)才决定能不能扛住业务。
-
bw=124.5MiB/s:吞吐量,适合大文件场景;单位是 MiB/s(不是 MB/s),差约 7% -
iops=31.9k:每秒完成的 IO 请求次数,数据库类应用生死线;低于预期值 30% 就要查是不是队列深度(iodepth)设太低 -
lat (usec): min=123, max=18920, avg=3210:延迟,avg 超过 10ms(即 10000μs)说明磁盘已吃紧;max 突增往往意味着队列积压或硬件响应异常
别忽略 %util 字段——如果长期 >80%,说明磁盘持续满负荷,哪怕 bw 看着还行,也已经没余量应对突发请求了。










