最常见误操作是直接用 kill -9 杀错 pid;应先确认是否真需强制终止,多数 stop 失败源于 pid 文件失效或信号阻塞,而非进程僵死。

直接用 kill -9 杀错 PID 是最常见误操作,先确认是不是真需要“强制”——多数 stop failed 是因为 pid 文件失效或信号被阻塞,不是进程僵死。
为什么 php start.php stop 会失败
Workerman 的 stop 命令本质是读取 pidFile 中的主进程 PID,再发 SIGINT 信号。失败通常不是因为进程没响应,而是找不到它:
-
pidFile被删了(比如系统清空/tmp/,而你没改默认路径) - 启动和停止用的不是同一个用户(权限不一致,读不到 pid 文件)
- 主进程 PID 还在文件里,但实际已被系统回收,新进程占用了那个 PID(常见于服务器重启后)
- 你在前台按了
Ctrl+Z挂起过进程,它收不到SIGINT,得先fg唤醒
怎么安全定位并杀死真正的 Workerman 主进程
别猜、别 ps aux | grep WorkerMan 瞎杀——那可能匹配到子进程、日志行甚至注释。正确做法是反查端口或确认主进程特征:
- 如果你监听了端口(如
tcp://0.0.0.0:2346),用ss -tulpn | grep ':2346'或lsof -i :2346查出真正占用该端口的 PID - Workerman 主进程一定有
WorkerMan(注意大小写)在命令行参数里,且是php进程,子进程名通常是ForkPoolWorker或带worker字样,**不要杀它们** - 运行
ps -o pid,ppid,comm,args -C php,找父进程 PID 为 1(即已 daemonize)或没有终端控制 tty 的那个php进程
执行 kill 时的三档策略
强制 ≠ 直接上 kill -9。Workerman 主进程注册了 SIGTERM 和 SIGINT 处理器,应分步试探:
- 先发温和信号:
kill <code>PID(等价于kill -TERM <code>PID),等 3–5 秒,再ps -p <code>PID看是否还存在 - 若卡住,尝试
kill -INT <code>PID(模拟 Ctrl+C),部分版本对这个更敏感 - 仅当进程完全无响应、且确认无正在处理关键连接(比如聊天服务里没人发消息)时,才用
kill -9 <code>PID—— 它跳过所有清理逻辑,onWorkerStop不会触发,临时资源可能残留
避免下次再掉坑里的硬性配置
很多 stop failed 是启动时就埋下的雷:
- 务必在
start.php里显式设置绝对路径的Worker::$pidFile,例如$worker->pidFile = '/var/run/workerman.pid';,别依赖默认相对路径 - 用
-d启动时,确保运行用户对pidFile所在目录有写权限,否则 daemon 化静默失败,进程几秒后自动退出,但你根本不知道 - 生产环境优先用
systemd管理,而不是靠php start.php stop—— systemd 能通过CGroup精确追踪整个进程树,不会丢 PID
真正难处理的从来不是“怎么杀”,而是“怎么让 kill 之后的状态可预期”:主进程死了,子进程是否干净退出?日志是否落盘?连接是否 graceful close?这些都取决于你启动时有没有配对好信号处理和资源释放逻辑,而不是最后那一行 kill -9。











