排查Nginx连接数瓶颈需统筹系统层、内核队列与Nginx配置三层限制;必须同步调优ulimit、net.core.somaxconn、worker_rlimit_nofile及worker_connections,并启用epoll与multi_accept。

排查 Nginx 连接数瓶颈,不能只盯着 worker_connections 这个配置项。它只是整条连接资源链上的一环,真正卡住的地方往往在系统层、内核队列或 Nginx 自身限制之间。调优的关键是让这三层“对齐”——谁也不拖后腿。
看真实上限:查进程级文件描述符是否到位
每个 TCP 连接至少占 1 个文件描述符(fd),而 Nginx worker 还要开日志、SSL 缓存、上游连接等额外 fd。Linux 默认单进程最多 1024 个 fd,远不够用。
- 临时验证:运行
ulimit -n看当前 shell 限制;再执行cat /proc/$(pgrep nginx)/limits | grep "Max open files"查 Nginx worker 实际生效值 - 永久设置:编辑
/etc/security/limits.conf,为 Nginx 用户(如www-data或nginx)添加两行:
nginx soft nofile 65536
nginx hard nofile 65536 - 若用 systemd 管理,还需在
/etc/systemd/system/nginx.service.d/override.conf中加:
[Service]
LimitNOFILE=65536
补上 Nginx 主动声明:必须设 worker_rlimit_nofile
系统开了口子,Nginx 得自己伸手要。不显式声明,它会静默沿用启动时的 ulimit 值,导致高配 worker_connections 完全失效。
Linux系统管理专家,覆盖12大模块:用户权限、SSH、存储、网络、systemd、防火墙、日志监控、备份恢复、TLS证书、Ansible、容器、IaC。提供配置、验证、加固、监控、备份、自动化、故障排查、回滚闭环。关键词:useradd、sudo、sshd_config、chmod、SEL...
- 在
nginx.conf的 main 块(events块外、http块前)添加:
worker_rlimit_nofile 65536; - 该值应 ≥
worker_connections,建议设为相同值或略高(如 1.2 倍),为日志、临时文件等留余量 - 注意:这不是 per-worker,而是主进程能为所有 worker 向系统申请的 fd 总上限
匹配业务类型设合理值,不是越大越好
过高会吃内存、增上下文切换开销;过低则扛不住并发。关键看连接生命周期和复用率:
- 高频短连接(如 H5 秒杀页、REST API):连接建得快、断得快 → 推荐
worker_connections 8192–16384,配合keepalive_timeout 0彻底禁用长连 - 长连接保活型(如 WebSocket、HTTP/2 上报、直播流):单连接持续时间长 → 推荐
2048–8192,同时设keepalive_timeout 15–30控制空闲时长 - HTTPS 反向代理:除 socket 外还需 SSL session cache、OCSP stapling 等额外 fd →
worker_connections建议不超过系统 ulimit 的 70%~80%
配套内核与 events 参数必须同步调
光改 worker_connections 就像拓宽车道却不修入口匝道——车根本上不来。
- 内核参数需对齐:
net.core.somaxconn = 65535(已完成三次握手的连接等待队列)
net.ipv4.tcp_max_syn_backlog = 32768(半连接队列)
net.core.netdev_max_backlog = 262144(网卡收包队列) - Nginx events 块内必须写明:
use epoll;(Linux 下必须显式指定,避免回退到有 1024 硬限的 select/poll)
multi_accept on;(一次事件循环尽可能多 accept 新连接,缓解突发排队)

















