nginx 本身不提供自动应答功能,所谓双机热备中的“自动应答”实为 keepalived 通过健康检查脚本检测 nginx 故障并自动重启或触发 vip 切换,依赖 vrrp_script 联动脚本与 keepalived.conf 配置实现。

Nginx 本身不提供“自动应答”功能,你提到的双机热备环境中的自动应答,实际是指 Keepalived 在检测到 Nginx 故障时,自动触发服务恢复或切换 VIP 的行为——即“自动响应故障”,而非 HTTP 层的自动返回内容(如 200/503 页面)。这个过程依赖 Keepalived 的健康检查 + 脚本联动机制,不是 Nginx 配置项,而是通过外部脚本和 keepalived.conf 协同实现。
以下是关键配置逻辑和实操要点:
健康检查脚本需具备自动修复能力
Keepalived 通过 vrrp_script 执行自定义脚本(如 /etc/keepalived/check_nginx.sh),该脚本不仅要检测 Nginx 是否存活,还应在异常时尝试重启 Nginx,失败后再触发权重下降或主备切换。
示例脚本(需赋予可执行权限:chmod +x /etc/keepalived/check_nginx.sh):
#!/bin/bash
NGINX_PID=$(pgrep -f "nginx: master process")
if [ -z "$NGINX_PID" ]; then
systemctl start nginx # 或用 /usr/sbin/nginx -t && /usr/sbin/nginx
sleep 2
NGINX_PID=$(pgrep -f "nginx: master process")
if [ -z "$NGINX_PID" ]; then
killall keepalived # 强制退出,让对端接管 VIP(慎用,仅用于非抢占模式)
exit 1
fi
fi
keepalived.conf 中启用自动响应逻辑
在 vrrp_instance 块中关联该脚本,并设置权重变化策略,使 Keepalived “感知”修复结果:
vrrp_script chk_nginx {
script "/etc/keepalived/check_nginx.sh"
interval 2 # 每2秒执行一次
weight -30 # 检查失败时,本节点优先级减30(如主节点 priority 100 → 70)
fall 2 # 连续2次失败才判定为宕机
rise 2 # 连续2次成功才恢复权重
}
vrrp_instance VI_1 {
state MASTER
interface eth0
virtual_router_id 51
priority 100
advert_int 1
authentication {
auth_type PASS
auth_pass 1111
}
virtual_ipaddress {
192.168.1.200/24
}
track_script {
chk_nginx # 关联上述脚本
}
}
⚠️ 注意:
weight -30需配合备机 priority(如 90)使用。若主节点检查失败后 priority 降为 70,低于备机的 90,则 VIP 自动漂移到备机——这就是“自动应答”的核心机制。
防止脑裂与误切的关键设置
- 主节点建议加
nopreempt(非抢占模式),避免主恢复后立即抢回 VIP,造成服务抖动; - 备节点
state BACKUP,priority 设为略低于主(如 90),但不要过低(否则无法接管); - 启用
vrrp_strict时需确保网络支持组播,否则会导致 keepalived 启动失败(生产环境常注释掉)。
不复杂但容易忽略











