sum(case when...)比where过滤更灵活,因它能在一次聚合中按条件分流统计多类指标,且需显式写else 0避免null导致结果缩水。

为什么SUM(CASE WHEN ...)比WHERE过滤更灵活
因为 SUM 本身是聚合函数,不能直接写多个 SUM 配合不同 WHERE 来统计同一组里的多类指标;而 CASE WHEN 在聚合前做行级标记,让一行数据能按条件“分流”进不同求和桶里。比如统计「订单总金额」「已发货订单金额」「未发货订单金额」三个指标,必须用一个 GROUP BY + 多个 SUM(CASE WHEN ...) 实现。
CASE WHEN 必须有 ELSE,否则 NULL 会被忽略
CASE WHEN 没写 ELSE 时,默认补 ELSE NULL,而 SUM 会跳过 NULL 值——这看似安全,但容易掩盖逻辑漏洞。比如想统计「非北京用户数」,写成 SUM(CASE WHEN city != '北京' THEN 1 END),如果某行 city 是 NULL,它不会被计入,但你可能希望把它算作“非北京”。实际应明确补 ELSE 0:
SELECT SUM(CASE WHEN city = '北京' THEN 1 ELSE 0 END) AS beijing_cnt, SUM(CASE WHEN city != '北京' OR city IS NULL THEN 1 ELSE 0 END) AS non_beijing_cnt FROM users;
避免在 CASE WHEN 中混用聚合与非聚合字段
常见错误是在 CASE WHEN 分支里引用未出现在 GROUP BY 中的普通列,比如:
-- ❌ 报错:col_b 不在 GROUP BY 中,也不能在 SUM 内部直接引用 SELECT user_id, SUM(CASE WHEN status = 'paid' THEN col_b END) FROM orders GROUP BY user_id;
正确做法是把逻辑移到聚合前,或确认该字段在分组维度内是确定的(如用 MAX(col_b) 等聚合包裹):
- 如果
col_b在每个user_id下恒定,改用MAX(col_b)或MIN(col_b) - 如果要按条件取值(比如只取已支付订单的
col_b),需嵌套子查询或用FIRST_VALUE等窗口函数 - 多数场景下,
CASE WHEN内只放常量(1、amount)、聚合字段(price * qty)或确定性表达式
性能注意:WHERE 先过滤,再 SUM(CASE WHEN)
数据库无法自动把 CASE WHEN status = 'paid' 下推到索引扫描层,所以如果只关心某几类状态,先用 WHERE 缩小数据集更高效:
-- ✅ 推荐:先过滤,再分支聚合
SELECT
SUM(CASE WHEN type = 'cash' THEN amount ELSE 0 END) AS cash_total,
SUM(CASE WHEN type = 'card' THEN amount ELSE 0 END) AS card_total
FROM orders
WHERE status IN ('paid', 'shipped'); -- 减少参与聚合的行数
如果 WHERE 条件和 CASE WHEN 完全重叠(比如都只看 status = 'paid'),那不如直接 SUM(amount) WHERE status = 'paid',别硬套 CASE WHEN。
最易被忽略的是 ELSE 0 的显式声明——不写它,看起来结果对,但遇到 NULL 字段或边界条件时,聚合结果会静默缩水,查问题极难定位。











