linux bonding主备模式(mode=1)默认秒级无感切换,但需正确配置miimon=100(100ms链路检测)、fail_over_mac=1(统一mac防交换机丢包),并清空从网卡ip配置、仅保留master/slave参数,否则将导致断网或切换失败。

主备网卡切换(active-backup)在 Linux bonding 中默认就是秒级无感故障转移,但配置错一个参数就可能变成“断网 30 秒”甚至“切不起来”。
mode=1 模式下必须设对 miimon 和 fail_over_mac
miimon 控制链路检测频率,miimon=100 表示每 100ms 用 MII 寄存器查一次物理链路状态。低于 50ms 可能触发误判,高于 200ms 会导致故障响应延迟明显——拔线后要等 300ms~500ms 才切换,业务已超时。
fail_over_mac 必须设为 1 或 2,否则切换后交换机会缓存旧 MAC 对应的端口,新 active 网卡发包被丢弃:
-
fail_over_mac=1:主动把 backup 网卡 MAC 改成和 active 一致(推荐) -
fail_over_mac=2:由内核在切换时发 gratuitous ARP 刷新交换机 MAC 表(依赖网络支持 ARP 广播) - 不设或设为
0:两块网卡 MAC 不同,切换后流量黑洞
从网卡配置里删掉 IP、BOOTPROTO 和 GATEWAY
只要 eth0 或 eth1 配置文件里还留着 IPADDR、GATEWAY 或 BOOTPROTO=static,systemd-networkd 或 NetworkManager 就可能绕过 bond0 自行拉起路由,造成双默认网关、ARP 冲突或路由环路。
正确写法只保留三行:
Linux系统管理专家,覆盖12大模块:用户权限、SSH、存储、网络、systemd、防火墙、日志监控、备份恢复、TLS证书、Ansible、容器、IaC。提供配置、验证、加固、监控、备份、自动化、故障排查、回滚闭环。关键词:useradd、sudo、sshd_config、chmod、SEL...
DEVICE=eth0 ONBOOT=yes MASTER=bond0 SLAVE=yes
注意:SLAVE=yes 必须和 MASTER=bond0 写在同一行,某些旧版 ifup 脚本会忽略换行后的值。
验证时别只看 cat /proc/net/bonding/bond0
这个文件只告诉你当前谁是 Active,但不反映实际连通性。真正要确认容错生效,得做两件事:
- 拔掉 active 网线,1 秒内执行
ping -c 3 192.168.1.1(网关),必须全通;再cat /proc/net/bonding/bond0 | grep "Active Slave"确认已变 - 用
ethtool eth0和ethtool eth1分别看 Link detected 是否为no,避免因网线松动、交换机端口 shutdown 导致误判 - 如果用的是虚拟机(如 VMware/VirtualBox),确保虚拟网卡类型是
e1000或vmxnet3,rtl8139驱动对 miimon 支持不稳定
BONDING_OPTS 里 mode=1 和 mode=active-backup 效果一样但有兼容风险
内核接受数字和字符串两种写法,但老发行版(如 CentOS 6、RHEL 7 早期 kernel)只认 mode=1;新系统(RHEL 8+/Ubuntu 20.04+)两者都行。混用容易在升级后失效。
统一用数字更稳妥:
BONDING_OPTS="mode=1 miimon=100 fail_over_mac=1"
另外,arp_interval 和 arp_ip_target 在 mode=1 下可选,但一旦启用就必须关掉 miimon(二者互斥)。日常建议只用 miimon,ARP 检测在跨交换机或 VLAN 场景才必要,且配置稍有偏差就会反复切换。










