dstat 是一个可替代 vmstat、iostat、netstat 等工具的多功能系统监控工具,能实时综合监控 cpu、磁盘 i/o、网络、内存等资源,并支持按进程排序(如 --top-cpu、--top-io),帮助快速定位 java 性能问题是否源于底层资源争用。

Java 应用在 Linux 上出现性能问题时,单靠 JVM 工具(如 jstack、jstat)往往不够——你需要确认是不是系统资源(CPU、磁盘 I/O、网络)先扛不住了。dstat 是一个轻量、实时、多维度的系统监控工具,能帮你快速定位 Java 瓶颈是否源于底层资源争用。
安装并启动 dstat 查看综合指标
dstat 默认多数 Linux 发行版未预装,需手动安装:
- CentOS/RHEL:sudo yum install -y dstat 或 sudo dnf install -y dstat
- Ubuntu/Debian:sudo apt install -y dstat
运行基础命令即可看到每秒刷新的 CPU、磁盘、网络、内存等汇总视图:
dstat -c -d -n -m -t --top-cpu --top-io --top-latency
其中:
-c:CPU 使用率(user/sys/idle/wait)
-d:磁盘读写(read/write B/s,含设备名)
-n:网络收发(recv/send B/s,按接口统计)
-m:内存与 swap 使用情况
--top-cpu:实时显示占用 CPU 最高的进程(含 PID 和命令名)
--top-io:实时显示 I/O 最高的进程(注意:依赖 /proc/PID/io,部分容器环境可能受限)
--top-latency:显示延迟最高的进程(如因锁、调度或磁盘等待导致)
聚焦 Java 进程的针对性监控
Java 进程常以 java 命令启动,PID 易识别。若已知 Java 进程 PID(例如 12345),可用以下方式增强关联性:
- 用 dstat -c --top-cpu 1 | grep "12345" 持续过滤该 PID 的 CPU 占用波动
- 结合 dstat -d --top-io 观察是否 Java 进程频繁触发磁盘写入(如 GC 日志、堆转储、日志刷盘、临时文件生成)
- 用 dstat -n --tcp 或 dstat -n --udp 查看 TCP/UDP 连接数、重传、错误包,辅助判断网络瓶颈是否来自 Java 的 Netty/Spring WebMvc 等组件
特别提醒:dstat 自身不解析 Java 线程状态,但它能告诉你“此时系统哪类资源正被谁吃掉”,从而决定下一步该用 jstack(线程阻塞)、jstat -gc(GC 压力)还是 iotop -p 12345(Java 进程级 I/O 细节)。
结合时间窗口做对比排查
性能问题常呈周期性或突发性。建议用 dstat 记录一段时间数据用于横向比对:
- 记录 60 秒原始数据:dstat -c -d -n -m --top-cpu --top-io 1 60 > dstat.log
- 导出后用 Excel 或 awk 分析峰值时刻:比如某秒 CPU sys% 突增到 70%,同时 --top-cpu 显示 java 进程 sys 时间占比高,说明可能是大量系统调用(如频繁 socket read/write、FileChannel 操作)
- 若 -d 显示磁盘 await > 100ms 且 --top-io 中 java 进程排第一,需检查日志同步策略(log4j2 的 immediateFlush=false)、序列化/反序列化开销、或数据库连接池配置是否引发本地磁盘临时文件堆积
避坑提示:dstat 在 Java 排查中的常见误用
dstat 很好用,但几个关键点容易被忽略:
- 默认单位是 KB/s,不是 MB/s;加 --unit k 或 --unit m 可切换(如 dstat -n --unit m)
- 网络统计基于内核协议栈,无法区分 Java 应用层协议(HTTP/GRPC),但能发现异常带宽占用或重传率飙升(dstat -n --raw 可看 raw socket 活动)
- 容器环境中,dstat 运行在宿主机时看到的是整个节点视图;若在容器内运行,需确保有 SYS_ADMIN 权限且挂载了 /proc 和 /sys
- 不要只盯着 %cpu —— Java 应用可能 CPU idle 很高但响应极慢,此时应重点看 --top-latency 和 -c 中的 wait 列(I/O 等待),这往往指向磁盘或网络阻塞
Java免费学习笔记:立即使用
解锁 Java 大师之旅:从入门到精通的终极指南











