avg()不能直接对max-min差值求平均,因其反映的是含空档期的挂起时长;正确做法是用lead()或自连接配对相邻事件计算真实步骤间隔,并过滤异常值后取平均。

AVG() 不能直接套在首尾时间差上
用 MAX(event_time) - MIN(event_time) 算出每个流程的总跨度,再对这些跨度取 AVG(),结果不是“平均周转时间”,而是“平均挂起时长”。因为一个流程可能包含 submit → review(5分钟)→ approve(隔了12小时)→ complete,MAX-MIN 会把那12小时空档全算进去,但用户实际停留只发生在相邻步骤之间。
必须用 LEAD() 或自连接配对相邻事件
真实周转时间 = 每个步骤到下一步的时间差之和。关键在于把同一 flow_id 内按时间排序的事件两两配对:
-
PARTITION BY flow_id ORDER BY event_time是强制前提,否则LEAD()返回顺序不可控 -
LEAD(event_time)取下一行时间,当前行与之相减得到单步间隔 - 最后一行的
next_time为NULL,自然被AVG()忽略(它自动跳过 NULL) - 若数据库不支持窗口函数(如 MySQL 5.7),得用自连接 +
MIN(b.event_time)模拟,但需确保event_time唯一或加辅助序号,否则并行事件会导致跳步
过滤异常值比写对公式更重要
原始数据里常混着测试流程、超短操作(0秒)、卡死流程(>24 小时)或缺失中间步骤的残缺链路。直接 AVG(duration_sec) 会让结果失真:
- 加
WHERE duration_sec BETWEEN 1 AND 86400(1秒到24小时),砍掉明显脏数据 - 排除
event_type IN ('test_submit', 'system_ping')类伪事件 - 如果业务允许,优先用
PERCENTILE_CONT(0.5)替代AVG()—— 它对长尾异常更鲁棒,但 PostgreSQL/SQL Server 支持,MySQL 不原生支持 - 注意:
AVG()在某组无有效记录时返回NULL,不是0;若需补零,得套COALESCE(AVG(...), 0)
时间字段类型决定差值单位
event_time 是 TIMESTAMP 还是 DATETIME,直接影响 LEAD() - event_time 的结果形态:
- PostgreSQL 返回
INTERVAL,需转成秒:EXTRACT(EPOCH FROM (next_time - event_time)) - MySQL 8.0+ 直接返回秒数(前提是字段为
DATETIME或TIMESTAMP) - SQL Server 需用
DATEDIFF(SECOND, event_time, next_time) - 千万别用字符串时间(如
'2026-06-16 10:23:45')直接相减——多数引擎报错或返回意外整数
真正卡住人的从来不是语法,而是没意识到:流程周转时间本质是路径上所有边的权重平均,不是起点到终点的直线距离。漏掉一步过滤、错用时间类型、或忽略空档期,结果就从运营参考变成误导指标。











