row_number() 是为分组生成连续序号的首选方案,需配合 partition by 和必需的 order by(在分组内生效),区别于 rank() 和 dense_rank() 的重复值处理逻辑,且不可在 where 中直接引用其别名。

用 ROW_NUMBER() 为每个分组生成连续序号
直接用 ROW_NUMBER() 配合 PARTITION BY,这是最常用也最可靠的方案。它不依赖原始数据顺序,也不要求字段唯一,只要分组逻辑明确就能稳定产出 1, 2, 3… 序列。
常见错误是漏写 ORDER BY 子句——ROW_NUMBER() 要求必须指定排序依据,否则会报错 Window function 'row_number' requires ORDER BY。这个 ORDER BY 是在每个分组内生效的,不是全表排序。
- 想按时间先后编号?用
ORDER BY created_at - 想按金额从高到低排?用
ORDER BY amount DESC - 分组内顺序无所谓?可退而求其次用
ORDER BY 1(依赖数据库支持),但更稳妥的是选一个确定性字段,比如主键ORDER BY id
示例:
SELECT category, name, ROW_NUMBER() OVER (PARTITION BY category ORDER BY price DESC) AS rn FROM products;
ROW_NUMBER() vs RANK() vs DENSE_RANK() 的区别在哪
三者都生成序号,但重复值处理方式完全不同,选错会导致业务逻辑出错。比如同一组里有两个并列第一的价格,ROW_NUMBER() 会给出 1 和 2,RANK() 给出 1 和 1 后跳到 3,DENSE_RANK() 给出 1 和 1 后接 2。
绝大多数“生成序列号”场景要的是严格连续、无跳号、无视重复值的编号,所以必须用 ROW_NUMBER()。用错成 RANK() 可能导致后续用 rn = 1 取首条时漏掉并列记录;用 DENSE_RANK() 则在需要“第 N 条”语义时(比如取每组第 3 名)可能多捞出数据。
-
ROW_NUMBER():强制唯一序号,适合“第 1 条、第 2 条…”这类位置定位 -
RANK():适合“排名第 1、并列第 1、第 3 名…”这种名次表达 -
DENSE_RANK():适合“第 1 名、并列第 1 名、第 2 名…”这种紧凑名次
MySQL 5.7 或更老版本不支持窗口函数怎么办
没有 ROW_NUMBER() 就得靠变量模拟,但要注意 MySQL 中用户变量的行为在不同版本和执行计划下不稳定,尤其在 JOIN、子查询或开启优化器重排时容易出错。
安全做法是先用 ORDER BY 显式排序,再用变量递增,并确保整个查询不被优化器拆解。典型写法:
SELECT category, name, @rn := IF(@prev = category, @rn + 1, 1) AS rn, @prev := category FROM products CROSS JOIN (SELECT @rn := 0, @prev := '') AS _ ORDER BY category, price DESC;
关键点:
- 必须把初始化变量写在
CROSS JOIN里,不能只在 SELECT 列表中赋初值 -
ORDER BY必须包含分组字段(如category)和排序字段(如price DESC),否则变量累积会错乱 - 该写法在 MySQL 8.0+ 已不推荐,优先升级并使用原生窗口函数
WHERE 条件里不能直接引用 ROW_NUMBER() 别名
写 WHERE rn = 1 会报错 Unknown column 'rn',因为窗口函数在 WHERE 之后执行。这是 SQL 执行顺序导致的硬性限制,不是语法写错了。
正确做法只有两种:
- 套一层子查询:
SELECT * FROM ( SELECT *, ROW_NUMBER() OVER (PARTITION BY category ORDER BY price DESC) AS rn FROM products ) t WHERE rn = 1;
- 用 CTE(更清晰):
WITH ranked AS ( SELECT *, ROW_NUMBER() OVER (PARTITION BY category ORDER BY price DESC) AS rn FROM products ) SELECT * FROM ranked WHERE rn = 1;
别试图用 HAVING —— 它只对 GROUP BY 生效,和窗口函数无关。临时表也可以,但没必要增加 IO 开销。
真正容易被忽略的,是 PARTITION BY 表达式里字段的 NULL 处理:多个 NULL 值会被视为同一组。如果业务上 NULL 应该各自独立分组,得提前用 COALESCE(category, id) 或类似方式规避。











