sql聚合函数忽略null是标准行为,因null代表未知值而非零;count(*)统计所有行,count(列)仅统计非null值;sum/avg/max/min遇全null返回null;coalesce位置决定业务含义,清洗null需结合场景。

SQL聚合函数忽略NULL是标准行为,不是bug;处理方式取决于你是否想把“未知”当作“零”来算。
为什么SUM、AVG、COUNT(列名)都跳过NULL
因为NULL在SQL中代表“未知值”,不是0、不是空字符串、也不是假。聚合函数设计上拒绝为未知做假设——比如AVG(age)遇到NULL,数据库不会猜这个人是0岁还是100岁,干脆不参与计算。这保证了统计结果不被主观填补污染。
-
COUNT(*)统计所有行,包括含NULL的行;COUNT(status)只数status IS NOT NULL的行,差值就是NULL数量 -
SUM(amount)整列NULL时返回NULL,不是0;下游代码直接getInt()会抛异常 -
MAX()和MIN()在非空值中找极值,全NULL时也返回NULL
SUM(COALESCE(col, 0)) 和 COALESCE(SUM(col), 0) 区别很大
前者是“先把每行NULL补0,再加总”,后者是“先加总,发现结果为NULL再补0”。业务含义完全不同:
- 用
SUM(COALESCE(sales, 0)):适合库存汇总,缺记录就当0件,总数要包含所有行 - 用
COALESCE(SUM(sales), 0):适合部门报表,某个部门没人销售,显示0元而非空白 - 错误写法:
COALESCE(AVG(sales), 0)只兜底空组,但没解决分母变小问题;正确是AVG(COALESCE(sales, 0))
LEFT JOIN后字段为NULL,聚合前必须清洗
JOIN未匹配到右表数据时,字段天然为NULL。这时直接SUM(right_table.amount)会漏掉这些行——不是数据丢了,是它们被跳过了。
- 典型场景:订单主表LEFT JOIN优惠券表,
coupon_discount为NULL表示没用券,业务上应计为0 - 必须写成:
SUM(COALESCE(coupon_discount, 0)),而不是COALESCE(SUM(coupon_discount), 0) - 更危险的是运算表达式:
SUM(total - discount)中任一为NULL,整行变NULL;得拆成SUM(COALESCE(total, 0) - COALESCE(discount, 0))
空字符串''和NULL不是一回事,别混着查
聚合函数只忽略NULL,不忽略''。但业务代码常把''当“空值”用,导致统计口径撕裂:
-
COUNT(status)会把''计入,但WHERE status IS NULL查不到它 - 想查真正缺失的数据,得分开写:
WHERE status IS NULL OR status = '' -
SUM(CAST(LEN(status) AS INT))中''长度为0,参与计算;而NULL仍被跳过
最麻烦的从来不是NULL本身,而是同一列里有的NULL表示“未发生”,有的表示“不适用”,有的表示“录入失败”——这时候统一COALESCE(col, 0)反而掩盖了数据质量问题。











