workerman可通过httpserver实现sse流式响应,关键在于正确设置text/event-stream头、禁用输出缓冲、每条data:后跟双换行,并手动flush;不可用websocket或worker::onmessage处理。

Workerman 本身不内置 SSE 支持,但能轻松实现符合 SSE 协议的流式响应——关键不是“用 Workerman 做 ChatGPT”,而是用它稳定地、低延迟地把后端生成的文本 chunk 按 data: + event: + id: 格式逐块推给前端。SSE 在 Workerman 中是纯 HTTP 长连接控制问题,不是 WebSocket 也不是 SocketIO。
为什么不能直接用 Worker::onMessage 处理 SSE?
SSE 是 HTTP 协议行为,必须走 HttpServer,而非 Worker 或 WebsocketServer。常见错误是把 SSE 接口写在 WebSocket 回调里,结果前端收不到任何 text/event-stream 响应,只看到空白或 CORS 错误。
-
HttpServer才能正确设置Content-Type: text/event-stream和禁用缓冲(ob_end_flush()+flush()) - 必须手动禁用 output buffering:Workerman 默认启用
output_buffering,会导致 chunk 积压,前端卡住不动 - 每个
data:行末必须有双换行\n\n,少一个就解析失败
如何在 HttpServer 中正确发送流式 chunk?
核心是保持连接不关闭、分段输出、及时刷新。以下是最简可用逻辑(PHP 8.0+,Workerman 4.1+):
use Workerman\Worker;
use Workerman\Connection\TcpConnection;
$http_worker = new Worker('http://0.0.0.0:8080');
$http_worker->onMessage = function ($connection, $request) {
// 必须设置 SSE 头,且禁止缓存
$connection->header('Content-Type', 'text/event-stream; charset=utf-8');
$connection->header('Cache-Control', 'no-cache');
$connection->header('Connection', 'keep-alive');
$connection->header('X-Accel-Buffering', 'no'); // Nginx 兼容
// 禁用 PHP 输出缓冲(关键!)
if (function_exists('ob_end_clean')) {
@ob_end_clean();
}
// 发送初始空事件(可选,避免 Safari 首帧延迟)
$connection->send("event: init\nid: 0\ndata: \n\n");
// 模拟 LLM 流式生成(实际替换为你的模型调用)
$chunks = ['Hello', ', ', 'world', '!', ' This is streamed.'];
$id = 1;
foreach ($chunks as $chunk) {
// 每个 chunk 必须按 SSE 格式封装
$msg = "id: {$id}\nevent: message\ndata: " . str_replace("\n", "\ndata: ", $chunk) . "\n\n";
$connection->send($msg);
$id++;
// 强制刷新到客户端(否则可能积压在 TCP 缓冲区)
$connection->flush();
// 模拟生成延迟(真实场景中这里是你调用模型的耗时)
usleep(300000); // 300ms
}
// 结束标记(可选)
$connection->send("event: done\ndata: [DONE]\n\n");
$connection->close(); // 主动关闭连接
};
前端用 EventSource 接收时要注意什么?
浏览器原生 EventSource 对格式极其敏感,稍错就静默失败。常见掉坑点:
- 后端路径必须支持 GET(
EventSource只发 GET),且不能带复杂 query(某些代理会截断) - 如果后端返回非
200 OK(比如 502/504),EventSource会自动重连,但不会报错——需监听error事件并检查eventSource.readyState -
data:内容若含换行,必须拆成多行并每行加data:前缀(见上例中的str_replace) - 不要用
fetch+ReadableStream替代EventSource:Safari 对fetch流式响应的支持不稳定,EventSource是唯一跨浏览器可靠的 SSE 方案
生产环境必须关掉的几个默认行为
Workerman 开箱即用的配置对 SSE 不友好,上线前务必确认:
-
Worker::$maxRequest默认为 0(不限制),但 SSE 连接是长连接,建议设为0(保持)或合理值(如 300),避免被误回收 -
Worker::$reusePort设为true可提升并发吞吐,但需确认系统支持(Linux 3.9+) - Nginx 作为反向代理时,必须添加:
proxy_buffering off;、proxy_cache off;、proxy_http_version 1.1;,否则 chunk 会被缓存住 - 超时时间:Nginx 的
proxy_read_timeout至少设为 300,Workerman 的$connection->timeout也要同步延长
真正难的不是发几行 data:,而是让每个 chunk 在 100ms 内从模型输出 → Workerman 缓冲 → TCP 发送 → 浏览器解析完成。中间任意一环缓冲未关、头未设对、代理未配妥,都会导致“看起来没流式”。先跑通最简示例,再一层层加模型、加 token 统计、加错误重试——别一上来就堆 stream=true 参数和 LLM::generate() 封装。
前端入门到VUE实战笔记:立即使用
在学习笔记中,你将探索 前端 的入门与实战技巧!











