pivot非sql标准语法,仅sql server和oracle原生支持;mysql、postgresql等主流数据库不支持,须用case when+聚合函数手动实现行转列。

用 PIVOT 之前先想清楚:SQL 标准里没有 PIVOT 关键字
绝大多数数据库(PostgreSQL、MySQL 8.0+、SQLite)并不原生支持 PIVOT 语法,SQL Server 和 Oracle 是例外。想实现“行转列”的透视效果,得靠窗口函数 + 条件聚合组合出等价逻辑——不是语法糖,是真要手写逻辑。
典型场景:销售表 sales 含 region、product、amount,想按地区横向展开各产品销售额。
- 错误做法:直接查
PIVOT文档后照搬 SQL Server 写法,在 PostgreSQL 里报错syntax error at or near "PIVOT" - 正确路径:用
CASE WHEN+SUM() OVER (PARTITION BY ...)或更常见的SUM(CASE ...)配合GROUP BY - 窗口函数在这里不替代分组,而是补足“分组内计算但保留明细行”的需求——比如既要每地区的总销售额,又要每个订单在该地区的累计占比
ROW_NUMBER() 和 RANK() 在透视上下文里别乱混用
当你要对每组内的记录排序再取 Top N(例如“每个地区销量前三的产品”),窗口函数是刚需;但选哪个排序函数,直接影响结果是否去重、是否跳号,进而影响后续 CASE 聚合的对齐。
假设按 region 分组,对 amount 降序排:
-
ROW_NUMBER() OVER (PARTITION BY region ORDER BY amount DESC):严格编号,同金额也不同号 → 可能漏掉并列高销量产品 -
RANK() OVER (PARTITION BY region ORDER BY amount DESC):同金额同名次,后续跳号 → “前三”可能返回 4 行(比如两个第 2 名) - 真正稳的做法是
DENSE_RANK(),它同值同号且不跳号,适合“取每组前 N 个唯一排名”
示例:取各地区销量前 3 的产品名称(去重、不跳号):
SELECT region,
MAX(CASE WHEN drnk = 1 THEN product END) AS top1,
MAX(CASE WHEN drnk = 2 THEN product END) AS top2,
MAX(CASE WHEN drnk = 3 THEN product END) AS top3
FROM (
SELECT region, product, amount,
DENSE_RANK() OVER (PARTITION BY region ORDER BY amount DESC) AS drnk
FROM sales
) t
GROUP BY region;
聚合和窗口同时出现时,执行顺序决定你能拿到什么数据粒度
窗口函数在 SQL 执行顺序中晚于 WHERE 和 GROUP BY,但早于 ORDER BY 和 LIMIT。这意味着:如果你先 GROUP BY region, product 求出各地区各产品的总销量,再套窗口函数,那窗口作用域就是这个分组后的结果集;但如果你没 GROUP BY,直接在原始明细行上开窗,那算出来的就是“每行在所属地区的累计销量”,不是汇总值。
- 想输出“每个地区各产品的销售额 + 该地区总销售额占比”:必须先聚合(
GROUP BY region, product),再用窗口函数算SUM(amount) OVER (PARTITION BY region) - 想输出“每个订单在所属地区的销售累计额(按时间排序)”:不能先聚合,得在明细行上用
SUM(amount) OVER (PARTITION BY region ORDER BY order_date) - MySQL 8.0+ 和 PostgreSQL 支持在同一个查询里混合使用聚合和窗口,但 SQLite 直到 3.40 才支持窗口函数,且不支持在聚合查询中嵌套窗口(会报
misuse of aggregate)
性能陷阱:OVER () 全局窗口和大表 PARTITION BY 的代价差异极大
一个没写 PARTITION BY 的 COUNT(*) OVER () 看似简单,实际会让优化器扫描全表做全局计数;而 COUNT(*) OVER (PARTITION BY region) 如果 region 值很多(比如有 10 万种),PG 可能放弃哈希聚合改用排序,性能断崖下跌。
- 检查执行计划时重点看
WindowAgg节点的Partition Key和Sort Key是否命中索引 - PostgreSQL 中,如果
PARTITION BY region ORDER BY sale_time,最好有复合索引(region, sale_time) - 避免在
OVER里写复杂表达式(如UPPER(region)),会导致无法利用索引,还可能让分区失效
真正难的不是写出语法,是在分组维度、排序需求、数据量、索引结构之间做显式权衡——窗口函数不会自动优化,它只是把计算时机交给你手动控制。










