group by 无法直接生成多列统计,因其仅按分组输出单行结果;需用 case when 配合聚合函数(如 count、sum)在行级标记后聚合,且必须处理 null 和空字符串以避免漏计。

为什么直接用 GROUP BY 无法生成多列统计
GROUP BY 本身只负责分组,每组只能输出一行结果,但你想要的是同一分组内按不同条件拆出多个统计值(比如“订单数”“有效订单数”“退款订单数”),这本质上不是分组逻辑,而是对每行数据做条件标记后再聚合。硬套 GROUP BY + 多个 COUNT(*) 会重复计数或漏条件,必须把判断下推到行级。
CASE WHEN 必须配合聚合函数使用,不能单独出现在 SELECT 列表中
常见错误是写成 SELECT user_id, CASE WHEN status = 'paid' THEN 1 END AS paid_cnt —— 这样每个匹配行都输出一个 1,不聚合,结果行数爆炸。正确做法是把 CASE WHEN 塞进 COUNT() 或 SUM() 里:
SELECT
user_id,
COUNT(CASE WHEN status = 'paid' THEN 1 END) AS paid_cnt,
COUNT(CASE WHEN status = 'refunded' THEN 1 END) AS refunded_cnt,
SUM(CASE WHEN status IN ('paid', 'shipped') THEN amount ELSE 0 END) AS valid_amount
FROM orders
GROUP BY user_id;
-
COUNT(...)自动忽略NULL,所以ELSE可以省略(不写即为ELSE NULL) - 用
SUM()累加数值时,ELSE 0必须显式写,否则NULL会让整列变NULL - 所有
CASE WHEN表达式都必须在聚合函数内部,不能裸写
NULL 值和空字符串容易导致统计偏差
如果 status 字段允许为 NULL 或空字符串 '',而你的条件只写了 = 'paid',那这些行就全被归入 NULL 分支,最终被 COUNT() 忽略——看起来像“消失”,其实是没被任何分支捕获。要排查这类问题:
- 先查
SELECT COUNT(*), COUNT(status), COUNT(NULLIF(status, '')) FROM orders看缺失比例 - 把兜底分支加上:
COUNT(CASE WHEN status = 'paid' THEN 1 ELSE 0 END)改成SUM(CASE WHEN status = 'paid' THEN 1 ELSE 0 END),这样能暴露未覆盖的行数 - 必要时显式处理:
CASE WHEN status IS NULL THEN 'unknown' WHEN status = '' THEN 'empty' ELSE status END
性能敏感场景下避免在 CASE WHEN 中调用函数
比如写成 CASE WHEN UPPER(status) = 'PAID' THEN 1 END,会导致索引失效(即使 status 有索引)。更安全的做法是提前标准化数据,或改用大小写不敏感比较(如 PostgreSQL 的 ILIKE,MySQL 的 COLLATE utf8mb4_0900_as_cs)。如果必须函数转换,至少确保只转一次:
SELECT user_id, SUM(CASE WHEN norm_status = 'PAID' THEN 1 ELSE 0 END) AS paid_cnt FROM ( SELECT user_id, UPPER(status) AS norm_status FROM orders ) t GROUP BY user_id;
这种子查询方式比在每行都重复调用 UPPER() 更可控。
CASE WHEN 分支覆盖不全 + NULL 静默丢弃,建议每次写完先用小数据集跑 COUNT(*) 和各列 SUM() 对齐总和。










