窗口函数比group by更适合保留明细,根本原因是它不删行只加列;group by强制折叠原始行,输出行数≤输入,而窗口函数输出行数=输入,且能访问当前行全部字段、支持有序计算与动态上下文。

窗口函数比 GROUP BY 更适合保留明细,根本原因就一条:它不删行,只加列。
GROUP BY 会强制折叠原始行,窗口函数只是追加计算值
当你执行 GROUP BY customer_id,数据库必须把所有同客户订单合并成一行——order_id、created_at、product_id 这些字段全没了,除非你用 ANY_VALUE() 或硬塞进聚合函数里,但语义已经失真。而 SUM(amount) OVER (PARTITION BY customer_id) 不动原始数据结构,100 行订单还是 100 行,只是每行多了一列“该客户总消费”。
- 错误写法:
SELECT order_id, customer_id, SUM(amount) FROM orders GROUP BY customer_id→ 报错或返回任意order_id,不可靠 - 正确写法:
SELECT order_id, customer_id, amount, SUM(amount) OVER (PARTITION BY customer_id) AS total_by_customer FROM orders→ 每行完整,语义清晰 - GROUP BY 是“毁灭性操作”,窗口函数是“非侵入式增强”
窗口函数能访问当前行的全部字段,GROUP BY 不能
想查每个员工的工资,同时显示他所在部门的平均薪资差额?salary - AVG(salary) OVER (PARTITION BY dept) 直接可用;换成 GROUP BY,你得先算部门均值,再 JOIN 回员工表,中间还可能因多对一关系引发重复或丢失。
-
SELECT name, dept, salary, salary - AVG(salary) OVER (PARTITION BY dept) AS diff_from_dept_avg FROM employees合法且高效 -
SELECT name, dept, salary, AVG(salary) FROM employees GROUP BY dept→name字段报错(MySQL 8.0+ 严格模式) - 窗口函数运行在 SELECT 阶段末尾,能看到所有已投影字段;GROUP BY 在 SELECT 之前执行,只能输出分组键或聚合结果
ORDER BY + PARTITION BY 支持动态上下文计算,GROUP BY 完全做不到
累计求和、排名、取上一行值这些操作,依赖行间顺序和分区边界,GROUP BY 没有“当前行”概念,也没办法定义“从第一行到当前行”这种滑动窗口。
-
SUM(amount) OVER (PARTITION BY user_id ORDER BY created_at ROWS BETWEEN UNBOUNDED PRECEDING AND CURRENT ROW)→ 截至当前订单的累计消费 -
LAG(amount) OVER (PARTITION BY user_id ORDER BY created_at)→ 上一笔订单金额,用于环比 -
ROW_NUMBER() OVER (PARTITION BY user_id ORDER BY created_at DESC)→ 精准取最新一笔,不怕并列或歧义 - 漏写
ORDER BY对ROW_NUMBER()是致命错误:MySQL 可能返回任意编号,PostgreSQL 直接拒绝执行
真正容易被忽略的是执行时机:窗口函数在 WHERE 和 GROUP BY 之后才计算,所以它能看到过滤后、甚至聚合后的中间结果;但反过来,你也永远不能在 WHERE 中直接引用窗口函数别名——比如 WHERE rn = 1 必须套 CTE 或子查询。这不是语法限制,而是 SQL 执行逻辑决定的刚性顺序。











