apache本身不内置故障转移能力,需依赖mod_proxy_balancer等模块组合实现;长连接中断源于切换时tcp上下文破坏,非主动断开,关键在启用stickysession、调优retry与keepalivetimeout,并避免在apache层做websocket等长连接的后端切换。
apache 本身不内置故障转移(failover)能力,它依赖外部机制或模块组合实现后端服务切换。长连接在切换时断开报错,本质是连接状态未被感知、未被保持,或代理层未正确处理连接生命周期所致——不是 apache “主动断开”,而是切换过程破坏了 tcp 连接上下文。
确认 Apache 是否参与故障转移链路
Apache 常见角色有三种:
-
纯反向代理:后端是多个 Tomcat/Node.js 实例,由
mod_proxy_balancer管理,此时故障转移由 Apache 自身控制; - 被前置代理调度:如 Nginx 或 HAProxy 做负载均衡,Apache 只是后端节点之一,故障转移发生在上层,Apache 不知情;
- 与外部注册中心联动:如结合 Consul + registrator 或 Kubernetes Service,Apache 配置静态,实际路由由 DNS 或 sidecar 动态更新。
只有第一种场景(mod_proxy_balancer)下,Apache 才真正“参与”故障转移,也才可能暴露长连接中断问题。
启用并调优 mod_proxy_balancer 的连接保持策略
默认 ProxyPass 不保留连接状态,mod_proxy_balancer 提供会话粘滞(sticky session)和故障恢复能力,但需显式配置:
Apache Superset 是一个广泛采用的开源 BI 平台,用于 SQL 探索、图表构建和仪表板交付。当代理需要查询仓库数据、组装仪表板或使用成熟的分析界面解释指标而不是临时笔记本代码时,此技能非常有用。
- 启用 balancer 并设置
lbmethod=byrequests或bytraffic,同时添加stickysession=ROUTEID|JSESSIONID,让同一客户端始终打到同一后端(避免切换); - 设置
retry=60(单位秒),表示某后端失败后,60 秒内不再尝试发送新请求给它,但已建立的长连接不会被强制关闭; - 若用 WebSocket 或 HTTP/2,必须配合
ProxySet stickysession=ROUTEID|websocket和ProxyPreserveHost On,否则 Upgrade 头丢失导致握手失败; - 禁用
ProxySet disablereuse=On(默认 Off),否则每个请求都新建连接,无法复用长连接。
规避长连接因后端切换而中断的关键操作
真正的长连接(如 WebSocket、SSE、HTTP/2 流)依赖端到端 TCP 保活和协议升级连续性,Apache 切换后端时无法“迁移”连接。因此应:
- 不在 Apache 层做后端故障转移,改由客户端重连 + 后端服务健康探针(如 /health)+ 前置 LB(HAProxy/Nginx)自动摘除异常节点;
- 对 WebSocket 场景,确保后端服务自身支持集群会话同步(如 Redis 存储 session state),客户端断连后能从任意节点恢复上下文;
- 在 Apache 配置中显式设置
KeepAliveTimeout 5和MaxKeepAliveRequests 100,避免空闲连接长期占用 worker,但不要设为 0(会彻底禁用复用); - 检查错误日志中是否出现
proxy: error reading from remote server或connection reset by peer,这类报错往往说明后端进程已退出或被 kill,而非 Apache 主动断开。
验证与监控建议
仅靠配置不够,需实测验证:
- 用
curl -v --http2 wss://your-domain/ws或浏览器开发者工具观察 WebSocket 连接状态,切换后端后看是否触发onclose且无onerror; - 开启
LogLevel proxy:debug,查看error_log中是否有balancer: removing worker或reusing connection to类日志; - 通过
mod_status(启用ExtendedStatus On)实时观察当前活跃连接数、worker 状态及 proxy 连接池使用情况。









