group by 必须与聚合函数配合使用,非分组字段需用max、min或group_concat等包裹;where在分组前过滤行,having在分组后过滤组;多字段group by按组合值分组,order by仅能引用分组字段或聚合结果。

GROUP BY 必须和聚合函数一起用,否则会报错
直接写 SELECT name FROM users GROUP BY city 会触发 MySQL 的严格模式报错:Expression #1 of SELECT list is not in GROUP BY clause。这是因为 MySQL 要求所有非聚合字段都必须出现在 GROUP BY 子句中(除非关闭 sql_mode 中的 ONLY_FULL_GROUP_BY,但不推荐)。
正确做法是:对需要展示的非分组字段,明确用聚合函数包裹:
-
MAX(name)或MIN(name)—— 取该组内某个代表值(注意不是“随机”,而是按字典序最大/最小) -
GROUP_CONCAT(name)—— 拼成字符串,适合查看全部成员,比如GROUP_CONCAT(id SEPARATOR ';') - 如果只想统计数量,就只写
COUNT(*),不选原始字段
WHERE 和 HAVING 容易混淆,位置和作用完全不同
WHERE 过滤的是行(在分组前),HAVING 过滤的是组(在分组后)。写反了要么查不到数据,要么报语法错误。
例如:查“每个城市的用户数超过 5 人的城市”——必须用 HAVING:
SELECT city, COUNT(*) AS cnt FROM users GROUP BY city HAVING cnt > 5;
而“只统计北京和上海的用户”——必须用 WHERE:
SELECT city, COUNT(*) FROM users WHERE city IN ('北京', '上海') GROUP BY city;
-
WHERE中不能用COUNT(*)、AVG(age)等聚合结果 -
HAVING中可以引用SELECT中定义的别名(如cnt),但部分旧版本 MySQL 要求写完整表达式 - 先
WHERE→ 再GROUP BY→ 最后HAVING,顺序不可调
多字段 GROUP BY 的排序和去重逻辑要心里有数
写 GROUP BY city, gender 不等于“先按 city 分组、再在每组里按 gender 分”,而是按 (city, gender) 的组合值做唯一分组。相当于把这两列拼成一个联合键。
- 结果行数 ≤ 原表行数,且一定 ≤
COUNT(DISTINCT city, gender) - 如果某 city 下没有 male 记录,那一行就不会出现;不会自动补
NULL或默认值 - 想补全缺失组合(比如每个城市都要显示 male/female 行,哪怕为 0),得用
LEFT JOIN配合衍生表,不是GROUP BY本身能解决的
ORDER BY 在 GROUP BY 后执行,但字段受限
ORDER BY 放在 GROUP BY 之后,它能引用的字段只有:分组字段、聚合结果、或 SELECT 列表中的表达式。
错误写法:SELECT city FROM users GROUP BY city ORDER BY name —— name 未聚合也未分组,MySQL 拒绝执行。
- 正确写法示例:
SELECT city, COUNT(*) c FROM users GROUP BY city ORDER BY c DESC - 也可以按分组字段排序:
ORDER BY city ASC - 如果用了
GROUP_CONCAT,还能按拼接结果排序:ORDER BY GROUP_CONCAT(age)(但要注意长度限制)
实际写的时候,最容易漏掉的是:聚合结果没起别名,导致 ORDER BY 引用时写原表达式冗长又易错。建议一律用 AS 显式命名。











