rollup是group by的扩展修饰符,用于自动生成多级小计和总计行;它按列从左到右逐级上卷生成(a,b,c)、(a,b,null)、(a,null,null)、(null,null,null)四级汇总,而普通group by仅返回最细粒度分组结果。

ROLLUP 是什么,和 GROUP BY 有什么区别
ROLLUP 不是独立语句,而是 GROUP BY 的扩展修饰符,用于在分组基础上自动添加“上卷”小计行(subtotal)和总计行(grand total)。它按括号内列的**从左到右顺序**逐级折叠:比如 GROUP BY ROLLUP(a, b, c) 会生成 (a,b,c)、(a,b,null)、(a,null,null)、(null,null,null) 四层聚合结果。
关键区别在于:普通 GROUP BY 只返回最细粒度分组;ROLLUP 多出的行用 NULL 占位,表示该层级被“汇总掉了”。这点常被误读为数据缺失,其实是设计行为。
怎么写一个带层级标签的 ROLLUP 查询
直接写 ROLLUP 会导致 NULL 值难以理解,必须配合 CASE 或 GROUPING() 函数标注层级。推荐用 GROUPING() —— 它对参与 ROLLUP 的列返回 1(表示该列被上卷)或 0(实际值),比判断 IS NULL 更可靠(因为原始数据本身可能含 NULL)。
示例(以销售表 sales 为例,按地区、部门、员工三级汇总):
SELECT
CASE WHEN GROUPING(region) = 1 THEN '总计'
WHEN GROUPING(dept) = 1 THEN CONCAT('地区:', region)
WHEN GROUPING(emp_name) = 1 THEN CONCAT('部门:', dept)
ELSE emp_name END AS level_label,
SUM(amount) AS total_sales
FROM sales
GROUP BY ROLLUP(region, dept, emp_name);
注意:GROUPING() 的参数必须严格匹配 ROLLUP() 括号内的列顺序和数量。
ROLLUP 和 CUBE、GROUPING SETS 选哪个
三者都是多维聚合工具,但行为不同:
-
ROLLUP(a,b,c):只生成前缀组合(a)、(a,b)、(a,b,c)及其总计,适合有天然层级关系的场景(如年→季→月) -
CUBE(a,b,c):生成所有 2³=8 种组合,包括 (a,c)、(b,c) 等跨层组合,易爆炸,慎用 -
GROUPING SETS:完全手动指定要聚合的维度组合,最灵活,也最啰嗦,适合混合层级+例外需求
如果只是做“部门下员工 → 部门小计 → 公司总计”这种线性汇总,ROLLUP 最简洁;一旦需要“按部门和按城市分别看小计”,就得切到 GROUPING SETS。
常见报错和性能陷阱
两个高频问题:
-
ERROR: column "xxx" must appear in the GROUP BY clause or be used in an aggregate function:这是 PostgreSQL/MySQL 8.0+ 严格模式报错,说明 SELECT 中用了未聚合且未出现在 ROLLUP 列表里的字段。解决方法:要么加进ROLLUP(),要么用MIN()/MAX()包裹(若确定该字段在组内恒定) - 查询变慢:ROLLUP 本质是多轮分组合并,数据量大时 I/O 和内存压力明显。建议在
ROLLUP字段上建复合索引,顺序与 ROLLUP 列一致(如CREATE INDEX idx_rollup ON sales(region, dept, emp_name))
另外,MySQL 5.7 不支持 GROUPING() 函数,得用 IF(ISNULL(region), 1, 0) 模拟,但要注意原始 NULL 值干扰。










