要统计进程内存增长趋势,核心是定期采集目标进程的rss等指标并生成时间序列报表;推荐直接解析/proc/[pid]/status获取高精度、低干扰数据,每5–30秒采样一次,记录时间戳、pid、rss(kb)和comm,避免使用ps。

要统计进程内存增长趋势,核心是定期采集目标进程的内存使用数据(如 RSS、VSS 或 PSS),再汇总生成时间序列报表。关键不在“一次性快照”,而在“持续、可比、低干扰”的采样机制。
明确监控指标和采样方式
Linux 下推荐优先使用 RSS(Resident Set Size),它反映进程实际占用的物理内存,比 VSS 更具参考价值。可通过 /proc/[pid]/statm 或 /proc/[pid]/status 获取(前者单位为页,需乘以 getconf PAGESIZE;后者直接含 rss: 行)。避免用 ps,因其精度低、字段易受格式变化影响。
- 每 5–30 秒采样一次,频率过高会增加系统负载,过低则丢失拐点
- 采样时记录 UNIX 时间戳(秒级或毫秒级)、PID、RSS(KB)、命令名(
comm字段最稳定) - 建议用
awk直接解析/proc/[pid]/status,不依赖外部工具链
轻量脚本实现持续采集
以下是一个可后台运行的 Bash 脚本示例,支持指定 PID 和输出文件:
#!/bin/bash
PID=$1
OUTFILE=${2:-"mem_trend_$(date +%s).log"}
echo "# timestamp(pid:$PID) rss_kb comm" > "$OUTFILE"
while kill -0 $PID 2>/dev/null; do
ts=$(date +%s.%3N)
rss=$(awk '/^VmRSS:/ {print $2}' "/proc/$PID/status" 2>/dev/null)
comm=$(awk '/^Name:/ {print $2}' "/proc/$PID/status" 2>/dev/null | tr -d '\0')
[ -n "$rss" ] && echo "$ts $rss $comm" >> "$OUTFILE"
sleep 10
done
运行后生成带时间戳的纯文本日志,便于后续分析。注意:脚本需对目标进程有读取 /proc/[pid]/status 权限(通常同用户即可)。
生成趋势报表与可视化建议
原始日志可直接用 gnuplot 或导入 Excel/Python(pandas + matplotlib)绘图。重点观察:
- 内存是否随时间单调上升(典型内存泄漏迹象)
- 是否存在周期性尖峰(如定时任务、缓存刷新)
- 重启前后对比:同一业务逻辑下 RSS 是否逐次升高
若需自动化报表,可用 Python 加载日志,计算每分钟平均 RSS、最大增幅、增长率(如 ΔRSS/Δt),并标记异常时段(如 5 分钟内增长超 200MB)。
规避常见干扰因素
真实环境中的内存波动常被误判为泄漏,需排除以下情况:
- glibc 的 malloc arena 扩展后不立即归还给内核(
malloc_trim(0)可缓解) - 共享库加载、JVM 堆外内存、GPU 显存等未计入 RSS
- 内核 page cache 影响(可用
cat /proc/[pid]/smaps_rollup | grep ^Rss:获取更全视图) - 多线程进程的 RSS 包含所有线程,但线程创建/销毁可能造成短期抖动
不复杂但容易忽略:单靠 RSS 不足以定论泄漏,需结合代码逻辑、分配器行为及长期趋势综合判断。











