left join适合父子级一对多汇总,因能保全父表全部行并拉平子表数据;group by须包含父表所有非聚合字段;count(emp.id)统计实际员工数,count(*)会将空部门计为1;需用coalesce处理null以避免聚合结果为null。

LEFT JOIN 为什么适合父子级一对多汇总
因为父表(如部门)每条记录在子表(如员工)中可能对应零条、一条或多条记录,LEFT JOIN 能保全父表全部行,同时把子表匹配到的数据“拉平”过来——这是做汇总的前提。用 INNER JOIN 会丢掉没有子记录的父节点(比如空部门),而 RIGHT JOIN 方向反了,逻辑难读。
GROUP BY 必须包含父表所有非聚合字段
一旦加了 GROUP BY 做汇总(比如统计每个部门人数、平均薪资),SQL 要求:所有出现在 SELECT 列表里、又没被 COUNT()/SUM() 等包裹的字段,都得写进 GROUP BY。否则 MySQL 8.0+ 或 PostgreSQL 会报错:ERROR 1055: Expression #1 of SELECT list is not in GROUP BY clause。
常见错误写法:
SELECT dept.name, COUNT(emp.id) FROM department dept LEFT JOIN employee emp ON dept.id = emp.dept_id GROUP BY dept.id; -- ❌ name 没在 GROUP BY 中,报错
正确写法:
SELECT dept.id, dept.name, COUNT(emp.id), AVG(emp.salary) FROM department dept LEFT JOIN employee emp ON dept.id = emp.dept_id GROUP BY dept.id, dept.name; -- ✅ 所有非聚合列都出现
COUNT(emp.id) 和 COUNT(*) 的行为差异很关键
在 LEFT JOIN 后做计数时,这两个看似等价,实则结果不同:
-
COUNT(emp.id)只统计子表中id非 NULL 的行数 → 对应“该部门实际有多少员工” -
COUNT(*)统计左表每一行生成的连接结果行数 → 如果某部门无员工,LEFT JOIN仍会生成一行(emp.id为 NULL),所以COUNT(*)返回 1
也就是说,想统计“员工数”,必须用 COUNT(emp.id) 或 COUNT(emp.some_not_null_column);用 COUNT(*) 会把空部门也记作 1,导致总数虚高。
NULL 值处理要主动干预,别依赖默认
子表无匹配时,LEFT JOIN 产生的字段全是 NULL,但像 SUM(emp.salary) 或 AVG(emp.salary) 对全 NULL 输入会返回 NULL,不是 0。前端或下游系统常因此出错。
建议统一用 COALESCE() 显式兜底:
SELECT dept.name, COUNT(emp.id) AS emp_count, COALESCE(SUM(emp.salary), 0) AS total_salary, COALESCE(AVG(emp.salary), 0) AS avg_salary FROM department dept LEFT JOIN employee emp ON dept.id = emp.dept_id GROUP BY dept.id, dept.name;
注意:COALESCE(COUNT(emp.id), 0) 是多余的——COUNT 永远返回整数,不会是 NULL。
父子汇总真正容易翻车的地方不在语法,而在对 NULL 的预期管理:JOIN 产生 NULL、聚合函数对 NULL 的响应、以及业务上“零值”到底该显示为 0 还是留空——这三者不提前对齐,报表数字就总差那么一两条。











