percent_rank是返回0到1间相对位置比例的窗口函数,公式为(rank−1)/(total_rows−1);rank返回整数名次且并列跳号,不归一化,二者本质区别在于percent_rank反映位置比例,rank反映名次序号。

PERCENT_RANK 是什么,它和 RANK 有什么本质区别
PERCENT_RANK 不是四舍五入后的“第几名”,而是返回一个介于 0 到 1(含)之间的相对位置值,表示当前行在分组内排序后的位置比例。它的计算公式是:(rank - 1) / (total_rows - 1),其中 rank 是 RANK() 的结果(相同值并列,跳过后续名次),total_rows 是该窗口内的总行数。
这导致几个关键行为:
- 第一名的
PERCENT_RANK永远是0.0(因为(1 - 1) / (n - 1) = 0) - 最后一名永远是
1.0(只要n > 1) - 并列时,所有人共享同一个
RANK,因此也共享同一个PERCENT_RANK - 它不处理“去重”逻辑——重复值不会被合并统计,而是按实际行数参与分母计算
直接用 PERCENT_RANK 计算销售员业绩百分位点的写法
假设有一张 sales 表,含字段 salesperson、amount,你想按业绩从高到低排百分位:
SELECT salesperson, amount, PERCENT_RANK() OVER (ORDER BY amount DESC) AS pct_rank FROM sales;
注意三点:
-
ORDER BY amount DESC是必须的,否则默认升序(最低业绩排最前,百分位反直觉) - 不加
PARTITION BY就是全表统一排名;如果要按区域/季度分组计算,得写成OVER (PARTITION BY region ORDER BY amount DESC) - 结果是小数,不是整数百分比;如需显示为“92.3%”,外面套
ROUND(pct_rank * 100, 1) || '%'(语法依数据库而异)
常见错误:和 CUME_DIST 混用,或误以为它能跳过并列
PERCENT_RANK 和 CUME_DIST 经常被对比,但二者逻辑不同:
-
CUME_DIST是“≤当前值的行数 / 总行数”,所以并列时后一名的值可能比前一名大(例如两个并列第2,CUME_DIST都是 0.4;下一名是第4,CUME_DIST可能是 0.6) -
PERCENT_RANK是严格基于RANK的线性插值,相同RANK必然相同PERCENT_RANK
容易踩的坑:
- 用
ORDER BY amount ASC算“业绩越低越靠前”,但业务上通常关心“业绩越高越优秀”,此时第一名为 0.0 反而让人困惑 - 在只有 1 行的窗口中,
PERCENT_RANK返回NULL(因分母为 0),需用COALESCE(..., 0.0)处理 - MySQL 8.0+ 支持,但旧版 MySQL 或 SQLite 不支持,别在迁移脚本里直接硬写
如何把百分位点映射成“前 X%”这类业务语言
PERCENT_RANK 返回的是“位置比例”,不是“有多少人比你差”。比如某人 PERCENT_RANK = 0.85,意思是“有 85% 的人业绩 ≤ 他”,即他优于 85% 的人——等价于“前 15%”。
换算时注意方向:
- 若按
DESC排序(业绩高者优先),则“前 X%”对应1 - PERCENT_RANK() - 所以
ROUND((1 - PERCENT_RANK()) * 100)得到整数百分比(如 15 表示前 15%) - 但别四舍五入到个位就完事:当多人并列且刚好卡在临界点(如 15.0 和 14.999),业务上可能要求“前 15% 包含所有并列者”,这时得结合
NTILE(100)或额外逻辑判断
真实场景中,单纯依赖 PERCENT_RANK 做绩效档位划分往往不够——它不保证每档人数均匀,也不处理并列膨胀。真要划“前 10% 奖励”,建议先用 NTILE(10) 分十分位,再人工校准边界。










