cpu调优后需验证%id是否上升、%wa是否下降,r值是否≤cpu核心数;内存调优看available是否回升、si/so是否为0;磁盘调优重点观察iostat中await是否降低、%util与吞吐匹配性。

调优不是改完就完事,关键得验证改得有没有用。直接看效果,比看参数更可靠。
CPU 调优后怎么确认有效
比如你把 CPU governor 改成 performance,或者绑核、调优先级,别光信命令执行成功了——要看实际负载和响应是否改善。
- 用 vmstat 1 5 看 %id(空闲)是否稳定上升、%wa(IO等待)是否明显下降;如果 %wa 还高,说明瓶颈可能不在 CPU,而在磁盘
- 用 mpstat -P ALL 1 3 查每个核心的 %usr/%sys 分布:调优后若原本单核打满、其他核闲置的情况消失,说明负载均衡生效
- 对比调优前后 top 中的平均负载(load average)和运行队列长度(r 列):r 值从长期 > CPU 核心数降到 ≤ 核心数,是 CPU 压力缓解的直接证据
内存调优后重点看什么
比如你调了 vm.swappiness、清了缓存、或限制了某进程 RSS,得盯住真实可用性和交换行为。
- 运行 free -h,重点关注 available 字段:调优后 available 值应明显回升,且 swap used 持续为 0
- 用 vmstat 1 5 观察 si(swap in)和 so(swap out):两者都稳定为 0,说明不再频繁换页;若有非零值,说明内存仍紧张
- 结合 top 或 htop 查看目标进程的 RES 和 %MEM:若限制生效,其内存占用应稳定在预期阈值内,不随时间爬升
磁盘 I/O 调优效果靠 iostat 验证
比如你换了 IO 调度器、调整了队列深度、或做了读写分离,不能只看吞吐量,要看响应质量。
- 执行 iostat -x 1 3,重点关注 %util(设备忙时百分比)和 await(I/O 平均等待毫秒):%util 接近 100% 但 await 持续 > 20ms,说明存在排队;调优后 await 应显著下降
- 观察 r/s 和 w/s 是否更平稳(无突发尖峰),rrqm/s 和 wrqm/s(合并请求数)是否升高——说明 IO 合并策略起效
- 对比调优前后 vmstat 的 bi/bo(块输入/输出)速率,若总吞吐没降、但延迟降了,就是有效优化
用 sar 看趋势,避免“快照误导”
单次 top 或 vmstat 是快照,容易漏掉间歇性问题。sar 可回溯历史,验证调优是否带来持续改善。
- sar -u 1 10 抓 10 秒 CPU 使用率,比对调优前后峰值和波动幅度
- sar -r 1 10 查内存使用趋势,确认 available 是否在负载周期内始终高于安全线(如总内存 10%)
- sar -d 1 10(需启用 disk 数据收集)对比调优前后磁盘 %util 和 await 的统计分布,看长尾延迟是否收敛











