解决“too many open files”需协同调优:先定位瓶颈层,再同步增大系统limits、systemd limitnofile及nginx worker_rlimit_nofile(设为硬限90%),并匹配worker_connections、启用multi_accept及内核参数优化。

解决高并发下载场景下的“Too many open files”报错,关键在于让每个 Nginx worker 进程能稳定打开足够多的文件描述符——worker_rlimit_nofile 就是这个核心开关,但它必须和系统限制、内核参数、Nginx 连接配置形成闭环,否则单独调整会静默失效或直接报错。
先确认瓶颈在哪一层
高并发下载(如大文件分片、Range 请求、断点续传)会显著增加文件句柄占用:每个下载连接占 1 个 socket,每个被读取的文件(尤其是小分片或缓存副本)占至少 1 个 fd,加上 access.log、error.log、临时 gzip 缓存等。别猜,实查:
- 查 Nginx 启动用户:ps -eo pid,comm,user | grep nginx | grep master(常见为
nginx或www-data) - 查该用户的实际限制:sudo -u nginx bash -c "ulimit -Sn; ulimit -Hn"
- 查 systemd 是否覆盖:systemctl show nginx | grep LimitNOFILE
- 查 worker 进程真实生效值:cat /proc/$(pgrep -f "nginx: worker" | head -n1)/limits | grep "Max open files"
同步调大三层系统级限制
worker_rlimit_nofile 只能 ≤ 系统硬限制,且启动时继承软限制。若不打通底层,配置等于没写:
-
/etc/security/limits.conf:添加两行(用户名按上一步结果替换)
nginx soft nofile 262144nginx hard nofile 262144 -
PAM 启用:确保
/etc/pam.d/common-session包含session required pam_limits.so -
systemd 覆盖:创建
/etc/systemd/system/nginx.service.d/override.conf,写入[Service]LimitNOFILE=262144
然后执行:sudo systemctl daemon-reload && sudo systemctl restart nginx
正确设置 worker_rlimit_nofile 和关联参数
该指令必须放在 nginx.conf 最外层(main 上下文),即 events 块之前、http 块之外:
- 写法示例:
worker_rlimit_nofile 262144;(不能写在 http/server/location 内) - 数值逻辑:建议设为硬限制的 90% 左右(如硬限 262144 → 设 235000),预留空间给日志、SSL 会话缓存、临时文件等
- 匹配
worker_connections:下载场景 I/O 密集,建议设为worker_rlimit_nofile × 0.6~0.7(例如 235000 →worker_connections 150000) - 启用
multi_accept on;,提升单次事件循环中接受连接的能力
补充内核与日志优化
避免其他环节成为新瓶颈:
- 内核总容量:
fs.file-max = 4194304(写入/etc/sysctl.conf,运行sysctl -p) - 网络队列:
net.core.somaxconn = 65535、net.ipv4.ip_local_port_range = "1024 65535" - 日志缓存:
open_log_file_cache max=1000 inactive=10s min_uses=2 valid=1m;,减少频繁 open/close - 避免为每个下载 location 单独定义带变量路径的
access_log,防止动态生成大量日志句柄










