nginx通过accept_mutex轻量协同机制防止惊群效应:worker抢锁成功才注册监听socket并accept,失败则跳过;锁在批量accept完成后立即释放,并结合ngx_accept_disabled实现负载感知的软性连接倾斜。

Nginx 多进程模型中防止惊群效应的核心不是靠传统阻塞锁,而是用一种“抢到才干活、抢不到就跳过”的轻量协同机制——accept_mutex。它不阻止进程运行,只控制谁注册监听事件、谁执行 accept(),从而从源头避免多个 worker 同时被唤醒争抢新连接。
accept_mutex 是怎么工作的
这个锁本质是一块所有 worker 进程都能读写的共享内存变量,底层用原子操作(如 atomic_cmp_set)实现 CAS 比较并设值。每个 worker 在进入 epoll_wait 前都会调用 ngx_trylock_accept_mutex() 尝试抢锁:
- 抢成功:把监听 socket 加入自己的 epoll 实例,并标记自己持有锁(ngx_accept_mutex_held = 1);
- 抢失败:不注册监听 socket,本次循环直接跳过 accept 阶段,只处理已建立连接上的读写事件;
- 无论成败,都不阻塞、不休眠,worker 始终保持活跃状态处理已有任务。
锁的获取与释放时机很紧凑
锁不是长期持有的,而是在一次 accept 批量处理完成后立刻释放:
- 持有锁的 worker 在 epoll_wait 返回后收到监听 socket 可读事件,进入 ngx_event_accept();
- 该函数循环调用 accept(),直到返回 EAGAIN(非阻塞模式下表示暂无新连接);
- 每 accept 一个连接,会更新连接计数和负载指标 ngx_accept_disabled;
- 本轮 accept 结束后,立即调用 ngx_shmtx_unlock() 清空锁变量,为下一轮竞争准备。
它还自带简单负载感知
nginx 不是平均分配连接,而是让高负载 worker 主动让出机会:
- ngx_accept_disabled 初始为负值(约 -7/8 × worker_connections),随连接增长而上升;
- 当该值大于 0,说明当前 worker 空闲连接不足,它会在下次抢锁前主动放弃竞争;
- 这样空闲多的 worker 更容易抢到锁,实现软性连接倾斜,缓解局部过载。
注意它的生效前提
这个机制不是万能的,依赖具体运行环境:
- 仅对 epoll 或 kqueue 事件模型有效,若配置 use poll; 或 use select;,accept_mutex 自动失效;
- 默认开启(Nginx 1.9.1+),无需手动写 accept_mutex on;,但也不能误配为 off;
- 它不替代负载均衡,也不保证各 worker 连接数完全一致,目标是消除无效唤醒而非强均衡。











