dts迁移常见错误根源在连接或权限阶段,如网络不通、认证失败、缓冲区溢出、rdb写入失败或主从版本不兼容等。

直接看日志里最靠前的 ERROR 或 # 号行,90% 的 sync_error 根源不在同步协议本身,而在连接建立或权限校验阶段。
从节点日志出现 Error condition on socket for SYNC: No route to host
这不是 Redis 协议错误,是网络层根本连不通。常见于:
- 主节点服务器防火墙(如
iptables、ufw)未放行 Redis 端口(默认6379),telnet <master-ip> 6379</master-ip>会直接失败 - 主节点绑定地址是
127.0.0.1,没改成0.0.0.0或具体内网 IP,导致从节点无法路由到服务进程 - 云主机安全组/ACL 规则未开放对应端口,比本地防火墙更常被忽略
从节点日志报 NOAUTH Authentication required
主节点启用了密码认证(requirepass),但从节点没配密码。此时 SYNC 请求在 AUTH 阶段就被拒了,不会进入真正同步流程。
Redis 缓存和数据结构管理技能。通过自然语言操作 Redis,支持 String、Hash、List、Set、ZSet、Stream 等数据结构操作。当用户提到 Redis、缓存、消息队列、会话存储时使用此技能。
- 检查主节点配置:运行
redis-cli config get requirepass,若返回非空值,说明需要密码 - 从节点必须显式设置:在
redis.conf中加masterauth <password></password>,或运行CONFIG SET masterauth <password></password> - 注意:Redis 6+ 的 ACL 用户名(
user)不支持在masterauth中使用,只认明文密码
从节点日志反复出现 Partial resynchronization not possible 后立刻断连
表面是增量同步失败,实际是复制缓冲区(repl-backlog)被覆盖或从节点断连太久,但更隐蔽的问题常出在主节点资源上:
- 主节点
fork()失败:日志里有Can't save in background: fork: Cannot allocate memory,说明系统vm.overcommit_memory不是1,或内存不足 - 主节点 RDB 写入失败:日志含
Failed to write to RDB file或Permission denied,典型是非 root 用户启动且dir目录无写权限 - 主节点输出缓冲区溢出:日志出现
scheduled to be closed ASAP for overcoming of output buffer limits,说明client-output-buffer-limit slave设置太小,尤其在大 RDB 传输时
主节点 INFO 显示 connected_slaves: 0,但从节点日志说已连上
这是“假连接”——TCP 握手成功,但 Redis 协议握手卡在中间环节。重点查:
- 主从版本严重不兼容:比如从节点是 Redis 5.0,主节点是 7.0,PSYNC2 协议扩展字段(如
capa eof)会被低版本静默拒绝,日志可能只有Connection reset by peer - 主节点启用了新特性(如
replica-ignore-disk-write-errors yes),而从节点版本老(≤ 5.0),解析失败后直接断连,不报具体错误 - 主节点配置了
bind但没配protected-mode no,当从节点用公网 IP 连接时,主节点因保护模式拒绝服务
真正棘手的不是报错信息本身,而是那些不报错的失败:比如从节点日志停在 Master replied to PING, replication can continue 就不动了,这时候得立刻去主节点查 INFO REPLICATION 里的 master_repl_offset 是否在增长,否则问题一定卡在主节点生成 RDB 或发数据的环节。










