mysql默认是否忽略大小写取决于字段的collation,如utf8mb4_0900_ai_ci(_ci)表示不区分大小写,而_utf8mb4_0900_as_cs(_cs)或_bin则区分;可通过show full columns查看collation,group by时若collation为_ci则天然忽略大小写,无需lower();临时方案可用collate指定校对规则,如group by 用户名 collate utf8mb4_0900_ai_ci,轻量且不破坏索引。

MySQL 默认就忽略大小写,但得看字段的 collation
不是所有 MySQL 表都“自动忽略大小写”。真正起作用的是字段的 collation,比如 utf8mb4_0900_ai_ci 中的 _ci 就代表 case-insensitive(不区分大小写),而 _cs 才是 case-sensitive。直接执行:
SHOW FULL COLUMNS FROM user_activity LIKE '用户名';看
Collation 列的值。如果它是 utf8mb4_general_ci 或 utf8mb4_0900_ai_ci,那 GROUP BY 用户名 本身就已忽略大小写——不需要加 LOWER()。
用 LOWER() 强制统一大小写,但要注意性能和索引失效
如果你不能改表结构,或字段 collation 是 _cs 类型(如 utf8mb4_0900_as_cs),就得靠函数兜底。常见写法是:
SELECT LOWER(用户名) AS name_lower, COUNT(*) FROM user_activity GROUP BY LOWER(用户名);但注意:
-
LOWER(用户名)会让该字段无法走普通索引,哪怕你建了INDEX(用户名) - MySQL 8.0+ 可以建函数索引:
CREATE INDEX idx_username_lower ON user_activity (LOWER(用户名)); - 如果数据量大、QPS 高,优先考虑改字段 collation,而不是长期依赖
LOWER()
临时强制不区分大小写:用 COLLATE 指定校对规则
不想改表、又不想写两次 LOWER()?可以在查询里动态指定 collation:
SELECT 用户名, COUNT(*) FROM user_activity GROUP BY 用户名 COLLATE utf8mb4_0900_ai_ci;这个写法比
LOWER() 更轻量,且语义更清晰。但它只影响本次查询,不会改变字段定义。注意两点:
-
COLLATE必须跟在列名后,不能写成GROUP BY COLLATE utf8mb4_0900_ai_ci 用户名 - 如果字段本身是
BINARY类型或用了BINARY前缀,COLLATE会被忽略 - 不同 MySQL 版本支持的 collation 名称略有差异,建议先查
SHOW COLLATION LIKE 'utf8mb4%ai%';
别踩 NULL 和空字符串的坑
GROUP BY 对 NULL 的处理是“自动归为一组”,但空字符串 '' 和 NULL 是两回事。如果你的 用户名 字段允许为空,且业务上想把 NULL 和 '' 当作同一类,必须显式合并:
SELECT COALESCE(NULLIF(用户名, ''), 'unknown') AS norm_name, COUNT(*) FROM user_activity GROUP BY COALESCE(NULLIF(用户名, ''), 'unknown');否则
NULL 自成一组,'' 又是另一组,统计结果会偏高。
实际中最容易被忽略的,是 collation 和索引的联动关系——改了 collation 却没重建索引,或者加了函数索引却忘了在查询里引用它。











