报 error 1040 时可先用 socket 直连排查:mysql -s /var/run/mysqld/mysqld.sock -u root -p,查 max_connections、threads_connected 和 max_used_connections,并用 show processlist 识别 sleep/running 连接状态,再针对性 kill 或调优超时参数。

连不上时,先用 socket 直连看水位
报 ERROR 1040 (HY000): Too many connections 时,TCP 连接已被占满,但 MySQL 默认保留一个本地 socket 管理通道(哪怕 max_connections 耗尽也通常可用)。只要能登录服务器本机,就还能救。
执行以下命令直连:
mysql -S /var/run/mysqld/mysqld.sock -u root -p
若提示权限拒绝,常见原因是 socket 文件属主为 mysql 用户,当前用户无读权限。可临时切过去:
sudo -u mysql mysql -S /var/run/mysqld/mysqld.sock -u root -p
成功后立刻查三组关键指标:
-
SHOW VARIABLES LIKE 'max_connections';—— 看上限(5.7/8.0 默认 151,云数据库可能设 1000+) -
SHOW STATUS LIKE 'Threads_connected';—— 看当前总连接数(含 Sleep) -
SHOW STATUS LIKE 'Max_used_connections';—— 看历史峰值,比瞬时值更反映真实压力
如果 Threads_connected 是 80 而 max_connections 是 151,那报错大概率不是真不够用,而是应用在疯狂重试或健康检查建连。
查 PROCESSLIST 识别“假连接”和“真卡点”
SHOW PROCESSLIST; 是诊断核心命令,但默认只显示当前用户权限下的连接;要查全量,必须用 root 或具备 PROCESS 权限的账号。
重点关注三类连接:
-
State = 'Sleep'且Time > 300:空闲超 5 分钟,基本是应用没关连接或连接池配置失当 -
State = 'Sending data'或'Locked'且Time持续增长:SQL 卡住了,可能是慢查询、锁等待或大事务 - 同一
User + Host出现几十个连接:大概率是某个应用实例泄漏,比如 PHP 脚本异常退出未归还连接
特别注意 unauthenticated user:大量这类连接集中在同一 IP 或网段,TIME 持续增长,STATE 是 Connecting to master 或 Receiving from client,基本是 DNS 解析卡顿或暴力扫描所致,不是业务问题。
KILL Sleep 连接前先过滤,别一刀切
别直接 KILL 所有 Sleep 进程。先筛选出可疑的:
SELECT ID, USER, HOST, DB, COMMAND, TIME, STATE FROM INFORMATION_SCHEMA.PROCESSLIST WHERE COMMAND = 'Sleep' AND TIME > 300;
确认这些连接无关键事务后,再批量 KILL:
KILL 12345, 12346, 12347;
或者生成批量语句(慎用):
SELECT CONCAT('KILL ', ID, ';') FROM INFORMATION_SCHEMA.PROCESSLIST WHERE COMMAND = 'Sleep' AND TIME > 300;
复制输出结果再执行。注意:KILL 不会丢数据,但会中断当前连接上的操作;如果应用没做重试,可能报错一次,但比服务全挂强。
调 max_connections 前先看系统级限制
执行 SET GLOBAL max_connections = 500; 后发现值没变?常见原因不是语法错,而是:
- Linux 文件描述符限制太低:
ulimit -n返回 1024,而你想设 2000 → MySQL 启动时自动向下取整,日志里会有Could not increase number of max_open_files - 配置文件写错段落:
max_connections必须放在[mysqld]段下,写在[client]或全局位置无效 - MySQL 8.0.22+ 已用
SET PERSIST持久化过该参数 →my.cnf修改会被忽略,得查mysqld-auto.cnf
验证是否生效,别信配置文件,要查运行时值:SELECT @@global.max_connections;。盲目设高只是把问题往后推,还可能引发 OOM——每个连接吃内存约 256KB–2MB,尤其小内存机器上设到 2000+ 风险极高。
真正该优先调的是 wait_timeout 和 interactive_timeout(默认 28800 秒 = 8 小时),建议缩到 300–900 秒(5–15 分钟)。改完必须写进 my.cnf 的 [mysqld] 段,并重启 MySQL(systemctl restart mysqld),光 reload 不生效。











