not exists 是判断记录不在另一表中的正确方法,因 not in 在被查字段含 null 时会因三值逻辑失效;not exists 依赖子查询是否返回行,需关联外层表,语义清晰且性能更优。

用 NOT EXISTS 判断某条记录不在另一张表里
直接用 NOT IN 容易出错,尤其当被查字段含 NULL 时,整个条件会恒为 FALSE 或 UNKNOWN,导致查不到任何结果。这是最常踩的坑。
正确做法是用 NOT EXISTS,它不依赖值比较,而是看子查询是否返回行:
SELECT * FROM users u WHERE NOT EXISTS ( SELECT 1 FROM orders o WHERE o.user_id = u.id );
-
SELECT 1是惯用写法,实际只关心是否存在匹配行,不关心返回什么 - 子查询里必须关联外层表(如
o.user_id = u.id),否则变成“只要 orders 表非空就全过滤掉” - 如果
orders.user_id有索引,这个查询通常比NOT IN快,且语义清晰稳定
为什么 NOT IN 在有 NULL 时失效
SQL 的三值逻辑让 NOT IN (1, 2, NULL) 等价于 value != 1 AND value != 2 AND value != NULL。而 value != NULL 永远不是 TRUE(它是 UNKNOWN),整个表达式最终为 FALSE。
实操验证:
SELECT 3 NOT IN (1, 2, NULL); -- 返回 NULL(即 FALSE)
- 哪怕你确定数据里没
NULL,也建议默认用NOT EXISTS,避免后期数据变更引发隐性 bug - 如果非要用
NOT IN,必须显式排除NULL:NOT IN (SELECT user_id FROM orders WHERE user_id IS NOT NULL)
替代方案:LEFT JOIN ... WHERE ... IS NULL
这是另一种等价写法,可读性对部分人更直观,但需注意连接条件和过滤位置:
SELECT u.* FROM users u LEFT JOIN orders o ON u.id = o.user_id WHERE o.user_id IS NULL;
- 必须用
LEFT JOIN,不能用INNER JOIN,否则没匹配的行根本不会出现在结果里 -
IS NULL要写在WHERE子句,不能写在ON条件里(否则失去“找缺失”的语义) - 性能上和
NOT EXISTS接近,但某些数据库优化器对NOT EXISTS更友好
子查询里别漏写 WHERE 关联条件
漏掉外层表和子查询的关联,会导致子查询变成“独立执行一次”,结果完全不对:
-- ❌ 错误:没关联,子查询永远查所有 orders,NOT EXISTS 永远为 FALSE SELECT * FROM users u WHERE NOT EXISTS ( SELECT 1 FROM orders o WHERE o.status = 'paid' -- 缺少 o.user_id = u.id );
- 这种写法实际查的是“是否存在任意一条已支付订单”,而不是“该用户是否有已支付订单”
- MySQL、PostgreSQL、SQL Server 都会允许执行,但逻辑错误很难一眼发现
- 写完子查询后,强制自己念一遍:“这条子查询是不是针对当前外层行在跑?”
关联字段类型也要一致,比如 users.id 是 BIGINT,orders.user_id 却是 INT,可能触发隐式转换,拖慢性能甚至走不上索引。











