linux无直接输出重传率的命令,必须用/proc/net/snmp中同一时间窗口内tcpretranssegs与tcpoutsegs的增量比值计算:重传率≈(retranssegs₂−retranssegs₁)÷(outsegs₂−outsegs₁),>0.5%需关注,>2%应立即排查。

Linux 没有直接输出“重传率百分比”的命令,必须通过差值计算得出——用同一时间窗口内 TCPRetransSegs 的增量除以 TcpOutSegs 的增量,这才是真实、可比、可用于告警的重传率。
用 /proc/net/snmp 算瞬时重传率
这是最可靠、最轻量、容器友好的方式,不依赖 net-tools,所有内核都支持。关键不是看绝对值,而是两个采样点之间的变化量:
- 执行
cat /proc/net/snmp | grep -A1 Tcp | tail -n1,输出类似:Tcp: RtoAlgorithm RtoMin RtoMax ... InSegs OutSegs RetransSegs InErrs ... - 第 11 列是
OutSegs(总发出段数),第 15 列是RetransSegs(已重传段数) - 用
watch -n1 'cat /proc/net/snmp | grep -A1 Tcp | tail -n1'观察 5–10 秒,记录两组值 - 重传率 ≈ (
RetransSegs₂−RetransSegs₁) ÷ (OutSegs₂−OutSegs₁) - 结果 > 0.005(即 0.5%)需关注;> 0.02(2%)说明链路已明显丢包,应立刻排查
用 sar -n TCP 看重传趋势和异常信号
sar -n TCP 不提供重传率,但能给出每秒重传段数 retrans/s 和其他关键异常指标,适合监控告警:
Linux系统管理专家,覆盖12大模块:用户权限、SSH、存储、网络、systemd、防火墙、日志监控、备份恢复、TLS证书、Ansible、容器、IaC。提供配置、验证、加固、监控、备份、自动化、故障排查、回滚闭环。关键词:useradd、sudo、sshd_config、chmod、SEL...
- 运行
sar -n TCP 1 3,重点看三列:retrans/s(重传段/秒)、atmptf/s(失败连接尝试/秒)、estres/s(异常关闭连接/秒) -
retrans/s ÷ oseg/s可粗略估算重传比例(注意:oseg/s 包含纯 ACK,该比值偏保守,仅作趋势参考) - 若
retrans/s+atmptf/s+estres/s同步突增,大概率是路径丢包或延迟抖动,建议立即配合mtr -n或ping -i 0.1验证 - 别用
sar -n TCP查单连接问题——它只统计协议栈全局行为
用 ss -ti 定位高重传的具体连接
ss -ti 的 retransmits 字段常被误读:它只统计超时重传(RTO timeout),不包括快速重传、SACK 重传或 TLP:
- 执行
ss -ti state established,观察每行末尾的retransmits值 - 该值在连接关闭后清零,无法回溯;即使
TCPRetransSegs持续上涨,retransmits也可能为 0 - 它对应
/proc/net/snmp中的TCPTimeouts,不是TCPRetransSegs - 真正想定位高重传流,应先用
ss -tunap找出目标连接四元组,再加-i查其retransmits;若值 > 0 且持续增长,说明该流路径存在稳定丢包
别信 netstat -s 的字段名和解析逻辑
netstat -s 是对 /proc/net/snmp 的文本封装,但在生产环境里容易翻车:
- CentOS 7+、Ubuntu 22.04+ 默认不预装
net-tools,容器中更常缺失 - 输出字段名不统一:有的系统写
TCPRetransSegs,有的只写RetransSegs,脚本解析极易出错 - 它不提供时间戳或采样间隔信息,无法直接用于计算瞬时率
- 如果你必须用它,至少过滤出
TCPRetransSegs、TCPTimeouts、TCPSynRetrans这几项,它们分别代表总重传段、超时重传次数、SYN 重传次数——三者差异本身就能说明问题类型
真正难的不是“怎么查”,而是理解每个数字背后的 TCP 行为含义:比如 TCPSynRetrans 高,大概率是服务未监听或防火墙拦截;TCPSpuriousRtx 高,往往是因为未开启 tcp_timestamps 或接收端延迟 ACK 过久。这些细节不结合上下文看,光盯着一个“重传率”数字,反而会误导排查方向。










