多列分组是group by基础用法;select非聚合字段须全写入group by;where过滤分组前数据,having仅作用于聚合结果;rollup可自动生成多级小计;排序字段须在select中出现或重复表达式。

直接说结论:多列分组不是“高级技巧”,而是 GROUP BY 的基础用法;真正容易出错的,是 SELECT 列与 GROUP BY 列的匹配规则,以及后续想加排序或过滤时的顺序陷阱。
GROUP BY 后面写多个字段,用逗号分隔就行
数据库会按字段从左到右逐层分组:先按第一个字段切分大组,再在每个大组内按第二个字段细分,依此类推。比如 GROUP BY region, category,结果中每行代表一个「地区+类别」的唯一组合。
- 必须把
SELECT中所有非聚合字段(如region、category)全部写进GROUP BY,否则 MySQL 严格模式或 PostgreSQL 会直接报错:column "xxx" must appear in the GROUP BY clause or be used in an aggregate function - 字段顺序影响结果排列逻辑,但不影响分组本身;不过如果后续加
ORDER BY,顺序不一致容易导致“看起来没排序” - 别写成
GROUP BY (region, category)—— 括号是语法错误,只用于子查询或函数参数
HAVING 过滤必须作用于聚合结果,不能替代 WHERE
很多人想筛出“华东地区销售额超 10 万的产品类别”,却写成 HAVING region = '华东' AND SUM(amount) > 100000,这会失败——因为 region 是分组字段,HAVING 只能过滤聚合后的行,不能用来做原始值判断。
- 地域、时间等原始条件一律放
WHERE:例如WHERE region IN ('华东', '华南') AND sale_date >= '2025-01-01' -
HAVING只处理聚合值:如HAVING SUM(amount) > 100000或HAVING COUNT(*) >= 5 - WHERE → 分组前过滤(减少数据量),HAVING → 分组后筛选(基于统计结果),顺序不能颠倒
需要多层级小计?别硬写多个 GROUP BY + UNION,用 ROLLUP
比如要同时看「年+月+日」的销售、各月小计、各年小计和总计,手动拼 4 条 SQL 再 UNION ALL 不仅难维护,还容易漏掉空值处理逻辑。
- 用
GROUP BY ROLLUP(year, month, day),数据库自动补全 (year,month,day)、(year,month)、(year)、() 四层聚合 - 配合
GROUPING()函数识别哪一列是聚合占位符(返回 1),避免把 NULL 当成真实数据:例如GROUPING(year) = 1表示该行是“不含 year 维度”的汇总行 - ROLLUP 生成的行数是 n+1 层(n 为维度数),比
CUBE(2ⁿ)更可控,适合有明确层次关系的场景(如时间、组织架构)
排序和别名容易被忽略的细节
分组后加 ORDER BY 很自然,但两个坑常被跳过:一是排序字段必须出现在 SELECT 列表里(除非是聚合表达式),二是别名不能在 GROUP BY 或 HAVING 中直接引用。
- 正确写法:
SELECT region, SUM(amount) AS total FROM sales GROUP BY region ORDER BY total DESC - 错误写法:
GROUP BY region ORDER BY total DESC(total是别名,GROUP BY阶段还不可见) - 如果要用表达式排序,要么重复写聚合函数(
ORDER BY SUM(amount)),要么用位置序号(ORDER BY 2 DESC),但后者可读性差,不推荐











