file_get_contents() 读取 claude json 截断是因为启用了 stream=true 的 sse 流式响应,而该函数无法正确解析 data: 分块内容;需用 curl 手动逐行读取、过滤非 data: 行、剥离前缀后逐行 json_decode,避免拼接错误或解析 [done] 和不完整帧。

为什么 file_get_contents() 读取 Claude 返回的 JSON 会截断?
不是 PHP 本身截断,而是 Claude 的 API 响应体里混入了流式 chunk(text/event-stream),而 file_get_contents() 或 curl_exec() 默认按完整响应等待,但实际服务端可能提前关闭连接或分块发送不完整 JSON。常见现象是返回内容以 {"type":"content_block_start" 开头、无结尾大括号,或解析时抛出 JSON_ERROR_SYNTAX。
用 cURL 手动处理 SSE 流并拼接完整响应
Claude 官方 API(如 /messages)在启用 stream=true 时走 Server-Sent Events 协议,每行以 data: 开头,末尾有双换行分隔。必须逐行读取、过滤空行和 event 字段,再合并所有 data: 后的内容,最后 json_decode()。
- 设置
curl_setopt($ch, CURLOPT_RETURNTRANSFER, true)和CURLOPT_HEADER, false - 禁用自动解压:
curl_setopt($ch, CURLOPT_ENCODING, ''),避免 gzip 损坏流式数据 - 用
fread()或curl_setopt($ch, CURLOPT_WRITEFUNCTION, $callback)逐块接收,别依赖curl_exec()一次性返回 - 对每行做
trim()后判断是否以data:开头,剥离前缀并json_decode($line, true)累积到数组
json_decode() 失败时怎么定位是哪一帧出问题?
不要直接 json_decode(implode('', $dataLines)) —— 这会把多个独立 JSON 对象拼成非法字符串。Claude 的每个 data: 行是一个完整 JSON 对象(如 {"type":"content_block_delta","delta":{"text":"..."}}),需逐行 decode。错误通常出现在:
- 最后一行是
data: [DONE],不能传给json_decode() - 网络中断导致某行只收到一半(如
{"type":"content_block_delt),此时json_last_error()返回JSON_ERROR_SYNTAX - 未过滤
event:或id:行,误当 JSON 解析
建议加日志:对每一行 json_decode($line, true) 后检查 json_last_error() === JSON_ERROR_NONE,否则记录原始 $line 内容用于调试。
要不要自己实现流式渲染?还是等完整响应再输出?
如果业务需要实时打字效果(比如前端逐字显示),就必须用流式;但如果只是存档或后处理,更稳妥的做法是禁用 stream=true,改用同步接口(stream=false)。注意:stream=false 并非所有 Claude 模型都支持——claude-3-haiku-20240307 支持,但 claude-3-opus-20240229 在部分 region 强制流式,这时必须处理 SSE。
真正容易被忽略的是超时配置:curl_setopt($ch, CURLOPT_TIMEOUT, 300) 得设足够长(Claude 长文本可能耗时 60s+),且 PHP 的 max_execution_time 也要同步调高,否则脚本中途被 kill,连错误都来不及捕获。
php免费学习视频:立即使用
踏上前端学习之旅,开启通往精通之路!从前端基础到项目实战,循序渐进,一步一个脚印,迈向巅峰!











