left join + is null 能替代 except 是因为其逻辑等价于差集(左表有、右表无),且兼容性好;关键在 where 中用右表关联字段 is null 判定未匹配,而非 = null,并需确保 on 条件完整、字段有索引、注意 null 比较和去重。

Left Join + IS NULL 为什么能替代 EXCEPT?
因为标准 SQL 的 EXCEPT 要求左右两边列数、类型、顺序完全一致,且多数 MySQL 版本根本不支持。而 LEFT JOIN 配合 IS NULL 过滤,本质是“找出左表有、右表无的记录”,逻辑等价于差集,兼容性好、写法直观。
基础写法:用 LEFT JOIN 找出 A 表独有数据
关键不是 JOIN 本身,而是 WHERE 中对右表主键(或关联字段)判 IS NULL —— 这表示右表没匹配上任何行。
常见错误是漏掉 WHERE right_table.id IS NULL,只写 LEFT JOIN,结果还是全量左表数据。
- 必须确保 ON 条件覆盖所有用于判断“存在性”的字段(比如多字段联合唯一时,ON 要写全)
- 右表字段在 WHERE 中判
IS NULL,不能写成= NULL(SQL 中= NULL永远返回 false) - 如果右表关联字段允许 NULL,且你又用它做 ON 条件,可能意外过滤掉有效行;优先用非空主键或带索引的唯一字段
SELECT a.* FROM orders a LEFT JOIN returns b ON a.order_id = b.order_id WHERE b.order_id IS NULL;
处理重复数据与多字段差集
当需要按多个字段判断“是否相同”(比如 (user_id, product_id) 组合),ON 必须显式列出全部字段;否则会误判。
若左表本身有重复,差集结果也会保留这些重复 —— LEFT JOIN 不自动去重,需要手动加 DISTINCT 或用 GROUP BY。
- 多字段 ON 示例:
ON a.user_id = b.user_id AND a.product_id = b.product_id - 去重建议放最外层:
SELECT DISTINCT a.* FROM ...,避免在 JOIN 前对大表子查询去重拖慢性能 - 注意 NULL 值比较:两个
NULL在 ON 中不相等,所以 (1, NULL) 和 (1, NULL) 可能无法匹配;必要时用COALESCE(col, '###')统一 NULL 表示
性能和可读性陷阱
大表执行差集时,LEFT JOIN 的性能高度依赖右表关联字段是否有索引。没索引的话,可能触发全表扫描,比子查询还慢。
- 务必给右表的 ON 字段建索引,尤其是作为“被查找依据”的字段(如
returns.order_id) - 避免在 ON 或 WHERE 中对字段用函数(如
ON UPPER(a.email) = UPPER(b.email)),会导致索引失效 - 逻辑复杂时,别硬塞进一个 JOIN:先用 CTE 或临时表明确拆出右表的“存在集合”,再 LEFT JOIN,反而更易维护
实际写的时候,最容易忽略的是 NULL 比较行为和索引缺失——这两点往往让语句看起来对,跑起来慢,或者结果少几条还查不出原因。










