mysql 5.7并行复制无效的主因是配置未生效:必须同时设slave_parallel_type=logical_clock、binlog_format=row,且避免无主键表和io瓶颈,仅调大slave_parallel_workers无效。

Seconds_Behind_Master 持续大于 10 秒,基本可以断定是 SQL 线程回放不过来——不是主库写得慢,是从库执行得太慢。MySQL 5.7 默认单线程回放,主库一并发,它就卡死。并行复制能解,但必须配对生效、避开雷区,否则 slave_parallel_workers 设再大也白搭。
为什么 slave_parallel_workers 设了还是没效果?
参数写了但延迟不降,大概率是并行复制根本没跑起来。MySQL 5.7 的 LOGICAL_CLOCK 并行模式有硬性前提:
-
binlog_format必须是ROW:执行SET GLOBAL binlog_format = 'ROW',并确认已写入my.cnf;MIXED或STATEMENT下该模式自动退化为单线程 -
slave_parallel_type必须显式设为LOGICAL_CLOCK:仅设slave_parallel_workers > 0不生效 - 从库不能启用
database级并行(即slave_parallel_type = DATABASE),这种模式在跨库 DML 下完全失效 - 检查
SHOW SLAVE STATUS\G中的Slave_SQL_Running_State,若长期停留在Reading event from the relay log而非Executing event,说明并行调度器压根没介入
Error_code: 1032 是并行复制最典型的“踩坑即停”错误
报这个错,99% 是因为某张表缺主键或唯一索引。ROW 格式下,主库一条 UPDATE 变成 N 条行事件,从库靠主键定位更新行;没主键就只能全表扫描,而并行线程又可能乱序执行,导致“找不着要更新的那行”。
- 用这条 SQL 扫出所有无主键表:
SELECT table_schema, table_name FROM information_schema.tables WHERE table_schema NOT IN ('mysql','information_schema','performance_schema','sys') AND table_name NOT IN (SELECT table_name FROM information_schema.key_column_usage WHERE constraint_name = 'PRIMARY' GROUP BY table_name) - 加主键前先去重:
CREATE UNIQUE INDEX idx_tmp ON db.t(col) USING BTREE(选一个能保证唯一性的列),再ALTER TABLE db.t ADD PRIMARY KEY (col) - 别信“先加主键再删重复数据”——
ALTER TABLE ... ADD PRIMARY KEY遇到重复值直接失败
延迟显示为 0,但从库查不到新数据?
Seconds_Behind_Master = 0 只代表 relay log 已读完、SQL 线程空闲,不代表事务已提交。大事务(比如主库一个事务改 50 万行)在从库回放时,SQL 线程会卡在“执行中”,但状态仍显示 0。
- 看
Slave_SQL_Running_State字段:如果是Executing event或Committing event,就是真正在干活,不是“已同步” -
Exec_Master_Log_Pos和Read_Master_Log_Pos差值很小,但Seconds_Behind_Master为 0,就是典型的大事务阻塞 - 业务侧感知的真实延迟得靠
pt-heartbeat:主库每秒写心跳,从库查时间差,这才是你该监控的指标
硬件和网络这些“隐形瓶颈”怎么快速验证?
别一上来就调参数,先确认是不是机器或网络拖了后腿:
- 对比主从配置:从库 CPU 核数、内存、磁盘类型(必须 SSD)、IOPS 是否 ≥ 主库?云环境尤其注意“共享型实例”的 IO 争抢
- 跑
iperf -c 主库IP -p 5201 -t 60测带宽,结果低于主库峰值写入流量(比如主库每秒写 80MB binlog,网络测出来才 40MB/s),就得升带宽 - 查从库
iostat -x 1:%util持续 > 90%、await> 20ms,说明磁盘 IO 到极限了;此时调innodb_flush_log_at_trx_commit = 2能明显缓解,但需接受极小概率 crash loss - 禁用 Nagle:
tcp_nodelay = 1加到 MySQL 客户端连接配置里,减少小包延迟
slave_parallel_workers 却没效果,第一反应不该是调更大,而是查有没有无主键表、IO 是否打满、网络是否丢包——这些点漏掉一个,并行复制就形同虚设。











