先确认本地模型服务已运行且端口监听正常,再严格核对openclaw中base url(如http://localhost:8000)、模型名(大小写/版本号需完全一致)及代理/防火墙设置;最后可临时调大config.yaml中llm.timeout至120秒验证。
☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 多模态理解力帮你轻松跨越从0到1的创作门槛☜☜☜

OpenClaw配置本地模型时提示超时,说明服务端在规定时间内未收到模型响应,常见于模型未启动、端口未监听、网络不通或请求参数不匹配等情况。必须先确认本地模型服务已真实就绪,再检查OpenClaw侧的连接配置是否与之严格一致。
确认本地大模型服务已正常运行
打开终端,执行 curl -X POST http://localhost:8000/v1/chat/completions -H "Content-Type: application/json" -d '{"model":"qwen2.5-7b","messages":[{"role":"user","content":"hi"}]}'。如果返回 JSON 响应且含 "choices" 字段,说明服务已通;若报 Connection refused 或超时,则模型服务根本没起来。
这一步不能跳过——很多用户误以为模型启动脚本执行完就等于服务就绪,其实 Llama.cpp、vLLM 或 Ollama 启动后常需 10~30 秒才真正绑定端口并加载权重。建议等待至少 45 秒后再测。
用 lsof -i :8000(macOS/Linux)或 netstat -ano | findstr :8000(Windows)验证端口是否被进程占用。若无输出,说明服务未监听该端口,需回查启动命令中的 --host 和 --port 参数。
检查OpenClaw中模型配置项是否匹配
方法一:核对 Base URL 格式
在 OpenClaw 设置界面 → LLM Provider → Custom → Base URL 中,必须填 【以 http:// 开头、不含路径结尾斜杠】 的完整地址,例如 http://localhost:8000。填成 localhost:8000、http://localhost:8000/v1 或 http://localhost:8000/ 都会导致请求 404 或连接失败。
方法二:确认模型名称字段准确无误
Custom 模型配置页中的 Model Name 必须与你本地服务实际注册的模型名完全一致,包括大小写和版本号。比如 vLLM 启动时用了 --model Qwen/Qwen2.5-7B-Instruct,那么此处就得填 Qwen/Qwen2.5-7B-Instruct,填 qwen2.5-7b 或 qwen2.5 都会触发模型未找到错误,最终表现为超时。
方法三:关闭代理或防火墙干扰
如果你系统启用了全局代理(如 Clash、Surge),或 Windows Defender 防火墙阻止了 localhost 回环通信,OpenClaw 发出的请求可能被拦截或转发到错误地址。临时关闭代理软件,或在防火墙入站规则中允许 localhost:8000 端口,再试一次。
调整OpenClaw超时阈值(临时绕过)
第一步:进入 OpenClaw 安装目录下的 config.yaml 文件
第二步:查找 llm: 区块,在其下添加或修改以下两行:
timeout: 120
connect_timeout: 30
第三步:保存文件,重启 OpenClaw 应用。connect_timeout 控制建连阶段上限,timeout 控制整次请求最大耗时。设为 120 秒可覆盖多数本地模型首次响应慢的情况,但【这不是根本解法,仅用于验证是否纯属超时过短】。









