nginx发挥负载均衡优势的关键是围绕业务负载特征精准配置:选对调度策略(加权轮询适配异构服务器、ip_hash用于会话保持但需防nat陷阱、least_conn适用于长连接)、配实健康检查(max_fails/fail_timeout+proxy_next_upstream)、优化代理链路(keepalive、缓冲区、超时),并避开ip_hash与weight共存等高频误配。

要让 Nginx 真正发挥请求均衡的性能优势,关键不是堆满参数,而是围绕业务真实负载特征做精准配置:选对调度策略、配实健康检查、压稳代理转发链路、避开几个高频误配点。
按业务场景选准核心调度策略
不同服务类型对应不同算法,硬套默认轮询反而拖慢整体响应:
-
加权轮询:服务器配置差异明显时必须用。比如一台 16C32G 设
weight=5,另一台 8C16G 设weight=2,流量自动按比例分发 -
ip_hash:登录态、购物车等需会话保持的场景适用。注意 NAT 或 CDN 后客户端 IP 可能被覆盖,建议配合
proxy_set_header X-Forwarded-For $remote_addr,并改用hash $http_x_forwarded_for consistent - least_conn:WebSocket、gRPC、长连接 API 等场景首选。它看的是当前活跃连接数,而非请求数,能避免慢连接堆积在某台机器上
必须配好健康检查机制
没健康检查的负载均衡等于“盲转”,故障节点继续收请求,用户直接看到 5xx:
- 每台
server后加上max_fails=3 fail_timeout=30s:连续失败 3 次就踢出,30 秒后试探恢复 - 在
location块中启用proxy_next_upstream error timeout http_500 http_502 http_503 http_504:上游出问题时自动换节点重试,用户无感知 - 若使用 Nginx Plus,可加
health_check interval=5s uri=/health;,主动探测更早发现僵死进程
优化代理层传输效率
很多性能卡点不在后端,而在 Nginx 自身转发环节:
- 启用 keepalive 连接池:
upstream backend { keepalive 32; }+proxy_http_version 1.1; proxy_set_header Connection '';,复用 TCP 连接,减少 handshake 开销 - 调大缓冲区:
proxy_buffering on; proxy_buffers 8 64k; proxy_busy_buffers_size 128k;,避免小包频繁刷写 - 设合理超时:
proxy_connect_timeout 5s; proxy_read_timeout 30s; proxy_send_timeout 30s;,防慢后端拖垮整个 upstream
避开几个典型配置陷阱
这些错误看似微小,却常导致策略失效或流量严重倾斜:
- ip_hash 和 weight 绝对不能共存:Nginx 会直接报错,二者逻辑冲突
- upstream 不能放在 server 块里:必须定义在 http 块下,否则无法被多个 location 共享
-
用域名定义 upstream 时忘了加 resolve:如
server api.example.com resolve;,否则 DNS 不刷新,扩容缩容不生效











