必须将请求精准转发至本地ollama/vllm服务端口,否则openclaw会报错“model not found”或卡在鉴权;需先验证模型存在(如ollama list确认qwen3.7-plus)、再配置provider为ollama或openai-compatible api、填对模型名与base url、关闭fallback_to_cloud、最后通过状态栏和network请求url验证是否真正走本地。
☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 多模态理解力帮你轻松跨越从0到1的创作门槛☜☜☜

要在 OpenClaw 中正确调用本地运行的 Qwen 模型(如 Qwen3.7-Plus 或 Qwen3.6-35B-A3B),必须绕过默认的云端 API 路由,将请求精准转发到本地 Ollama、vLLM 或 llama.cpp 启动的服务端口,否则 OpenClaw 会持续报错“model not found”或卡在鉴权环节。
确认本地 Qwen 模型已可用
打开终端,执行 ollama list 或 curl http://localhost:8000/v1/models(若用 vLLM),确认输出中包含类似 qwen3.7-plus 或 qwen3.6-35b-a3b 的模型名。没有则需先用 ollama pull qwen3.7-plus 拉取,或按 Qwen 官方文档启动 vLLM 服务——【模型名必须与后续配置完全一致,大小写和连字符都不能错】。
这一步操作起来很简单,直接把文件拖进去就行。但若跳过验证,后面所有配置都白搭。
在 OpenClaw 中切换为本地模型后端
启动 OpenClaw → 点击右上角齿轮图标 → 进入「Model Settings」→ 在「Provider」下拉菜单中选择「Ollama」或「OpenAI-Compatible API」(取决于你本地服务类型)。
若选 Ollama:在「Model Name」栏填入 qwen3.7-plus(必须与 ollama list 输出一致);「Ollama Host」保持默认 http://localhost:11434 即可。
若选 OpenAI-Compatible API:将「Base URL」设为 http://localhost:8000/v1(vLLM 默认)或 http://localhost:8080/v1(llama.cpp + openai-compatible-server),然后在「Model Name」填 qwen3.7-plus ——【此处不填模型路径,只填逻辑模型名】。
强制关闭 OpenClaw 的云端自动回退
方法一:编辑 OpenClaw 用户配置文件
找到 ~/.openclaw/config.json(Windows 在 %APPDATA%\OpenClaw\config.json),用文本编辑器打开,定位到 "fallback_to_cloud" 字段,将其值改为 false。保存后重启 OpenClaw。
方法二:启动时加参数
在终端中执行:openclaw --no-cloud-fallback。该参数会临时禁用所有云端兜底逻辑,确保请求 100% 走本地。
不关掉这个开关,OpenClaw 在本地响应超时(哪怕只有 200ms)就会自动切到 Claude 或 OpenAI 接口,导致你以为配置成功了,实际根本没走 Qwen。
测试本地 Qwen 是否真正生效
第一步:新建一个空白会话 → 输入“你是谁”,发送。
第二步:观察右下角状态栏——若显示「Qwen3.7-Plus @ localhost」或类似标识,说明路由成功;若显示「Claude Sonnet」或「gpt-4o」,说明仍走云端。
第三步:打开开发者工具(Ctrl+Shift+I)→ 切换到 Network 标签 → 发送一条消息 → 查看最新一条 chat/completions 请求的「Headers」→ 检查 Request URL 是否为 http://localhost:11434/api/chat 或你配置的本地地址。
只有 URL 域名是 localhost 或 127.0.0.1,才算真正跑在本地。其他任何域名都代表失败。










