union all能保留重复行,因为它不执行去重、不排序、不建临时表,仅直接拼接结果集;而union默认隐式去重并排序,列数与对应列类型必须严格兼容,否则报错1222或类型转换异常。

UNION ALL 为什么能保留重复行
因为 UNION ALL 不做去重,它只是把两个结果集的行简单拼接起来;而 UNION 会隐式执行 DISTINCT,导致重复行被合并。只要两个查询的列数、对应列的数据类型兼容(比如都是 INT 和 TINYINT 通常可隐式转换),就能直接拼接。
列名和数据类型不匹配时的常见报错
执行 UNION ALL 时如果列数不一致,会报类似 ERROR 1222 (21S01): The used SELECT statements have a different number of columns;如果某列类型强转失败(如字符串和日期硬拼),MySQL 可能报 Truncated incorrect DOUBLE value 或直接返回空值。实际中更常遇到的是字段顺序错位——比如第一个查询是 SELECT name, age,第二个写成 SELECT age, name,结果就是姓名列里出现数字。
- 确保两个
SELECT的列数完全相同 - 用别名统一列名:
SELECT id AS user_id, name AS full_name FROM t1 UNION ALL SELECT uid AS user_id, real_name AS full_name FROM t2 - 显式转换类型避免隐式截断:
CAST(created_at AS DATE)或CONVERT(varchar(10), dt, 120)(SQL Server)
ORDER BY 和 LIMIT 在 UNION ALL 中怎么生效
ORDER BY 和 LIMIT 不能直接写在每个子查询后面(除 PostgreSQL 支持子句括号加 ORDER BY ... LIMIT 外,MySQL/SQL Server 会报语法错误)。正确做法是把整个 UNION ALL 当作一个派生表,再套一层查询:
SELECT * FROM ( SELECT id, name, 'old' AS source FROM users_old UNION ALL SELECT id, name, 'new' AS source FROM users_new ) AS combined ORDER BY id DESC LIMIT 100;
注意:如果不加外层包装,ORDER BY 只作用于最后一个 SELECT,不是整体结果。
性能差异:UNION ALL 比 UNION 快多少
没有绝对倍数,但差距明显。比如两个各 10 万行的结果集,UNION 需要排序 + 去重,可能耗时 800ms;UNION ALL 通常在 50ms 内完成——因为它跳过了临时表构建和唯一性校验。不过要注意:如果上层业务逻辑依赖“无重复”,盲目换 ALL 会引入数据逻辑错误,得先确认重复是否真的可接受。
真正容易被忽略的是字段对齐细节:哪怕只有一列类型是 TEXT 而另一侧是 VARCHAR(255),某些数据库会强制把整列转成更宽类型,影响内存和排序效率。











