能,count(distinct column)直接统计去重后行数,而select distinct column返回去重后的值列表;多列distinct对组合去重,null视为相同但count(distinct)不计null。

Distinct 去重后还能直接 COUNT 吗?
能,但必须明确:COUNT(DISTINCT column) 和 SELECT DISTINCT column 是两回事。前者返回一个数字(去重后的行数),后者返回去重后的实际值列表。如果想统计「不同用户登录的天数」,用 COUNT(DISTINCT login_date);如果想列出所有不重复的 login_date,就得用 SELECT DISTINCT login_date。
多个字段组合去重怎么写?
MySQL 支持多列 DISTINCT,语法是 SELECT DISTINCT col1, col2 FROM table。它会对整行(col1 + col2 的组合)去重,不是分别对每列去重。常见错误是误以为它等价于「先对 col1 去重、再对 col2 去重」——其实不是。例如:
SELECT DISTINCT user_id, status FROM orders;
会保留 (101, 'paid') 和 (101, 'shipped') 两条记录,因为组合不同。若只想统计有多少个「用户-状态」唯一组合,就该用:
SELECT COUNT(DISTINCT user_id, status) FROM orders;
Distinct 遇到 NULL 怎么处理?
MySQL 把所有 NULL 视为相同值,因此 SELECT DISTINCT col 中,不管有多少个 NULL,结果里只会出现一个 NULL。但注意:COUNT(DISTINCT col) 默认**不统计 NULL** —— 它只计算非 NULL 的唯一值个数。如果你需要把 NULL 当作一种有效分类来计数,得显式转换:
- 用
COUNT(DISTINCT IFNULL(col, 'NULL')) - 或
COUNT(*) - COUNT(col) + COUNT(DISTINCT col)(先算总行数减去非 NULL 行数,补上 NULL 算作 1 种)
性能差?别急着加索引,先看执行计划
DISTINCT 本质依赖排序或哈希去重,数据量大时容易触发临时表和文件排序。但不是所有场景都适合建索引:
- 单列
DISTINCT且该列有索引 → 通常走索引扫描,较快 - 多列
DISTINCT→ 需要联合索引,且顺序必须匹配SELECT DISTINCT a,b,c中的列序 -
COUNT(DISTINCT)在 GROUP BY 后嵌套使用 → 很可能无法利用索引,考虑物化中间结果
执行前务必用 EXPLAIN 看 type 是否为 index 或 range,避免 ALL 扫全表。
复杂点在于:DISTINCT 的行为在不同 MySQL 版本中对 NULL 和排序的处理略有差异,生产环境务必在目标版本上验证结果一致性。











