nginx高性能负载均衡需据业务特征选策略、配健康检查、优传输效率、避配置陷阱:轮询适用于同构无状态服务;加权轮询适配异构服务器;ip_hash保障会话保持但禁用weight;least_conn优选长连接场景;必须配置max_fails/fail_timeout与proxy_next_upstream实现故障自动转移;启用keepalive连接池和合理超时参数提升转发效率;严禁ip_hash与weight混用、域名server缺resolve、upstream错放server块内。

要让 Nginx 实现高性能的负载均衡,关键不是堆砌策略,而是根据业务真实负载特征选对策略、配好健康机制、并规避常见陷阱。下面从四个实操维度讲清楚怎么配。
选对核心调度策略
默认轮询(round robin)适合服务器性能一致、无状态服务;但多数生产环境存在性能差异或会话需求,需主动切换:
-
加权轮询:新老服务器混用、CPU/内存明显不均时必用。例如一台 16C32G 服务器设
weight=5,一台 8C16G 设weight=2,请求比例自动接近 5:2 -
ip_hash:登录态、购物车等需会话保持的场景。注意 NAT 环境下客户端 IP 可能被代理覆盖,需配合
proxy_set_header X-Forwarded-For $remote_addr;并在 upstream 中用hash $http_x_forwarded_for consistent;替代 - least_conn:长连接服务(如 WebSocket、gRPC 流式接口)首选。它不看请求次数,而看当前活跃连接数,避免某台机器堆积大量慢连接
必须启用健康检查
没有健康检查的负载均衡等于“盲分发”。Nginx 开源版支持被动检查,建议至少配置:
- 每台 server 后加
max_fails=3 fail_timeout=30s:连续 3 次超时或 5xx 就踢出,30 秒后重试 - 搭配
proxy_next_upstream error timeout http_500 http_502 http_503 http_504;:上游失败时自动转发给下一台,用户无感 - 若用 Nginx Plus,可开启主动健康检查:
health_check interval=5s uri=/health;,更早发现僵死进程
优化代理层传输效率
很多性能瓶颈不在后端,而在 Nginx 自身转发环节:
- 启用 keepalive 连接池:
upstream backend { keepalive 32; }+proxy_http_version 1.1; proxy_set_header Connection '';,复用 TCP 连接,降低 handshake 开销 - 调大缓冲区:
proxy_buffering on; proxy_buffers 8 64k; proxy_busy_buffers_size 128k;,避免小包频繁写入 - 设置合理超时:
proxy_connect_timeout 5s; proxy_read_timeout 30s; proxy_send_timeout 30s;,防住慢后端拖垮整个 upstream
避免典型配置错误
这些细节看似微小,却常导致策略失效或流量倾斜:
-
ip_hash 和 weight 不能共存:一旦写了
ip_hash,权重会被忽略,所有 IP 哈希后强制平均打散 -
server 地址写域名但没配 resolve:DNS 解析失败会导致该 server 被永久标记为 down,应加
resolve或改用 IP - upstream 定义放在 server 块里:语法错误,必须放在 http 块内;且多个 location 共用同一 upstream 名称才能真正共享连接池











