接入ollama后不扣额度,因其为本地开源推理引擎,所有请求直连http://localhost:11434,全程离线处理,不经过云端api,无token计费;需确认base url正确、无残留云api key、模型名完全匹配且ollama服务正常监听。
☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 多模态理解力帮你轻松跨越从0到1的创作门槛☜☜☜

OpenClaw接入Ollama后不会扣模型额度,因为Ollama是本地运行的开源大模型推理引擎,所有计算都在你自己的设备上完成,不经过任何云端API服务,也就不存在调用次数限制、Token计费或账户额度消耗。
为什么接入Ollama就不再扣额度
OpenClaw本身支持多种后端协议,当它配置为连接本地Ollama服务(http://localhost:11434)时,所有请求都发往你本机启动的ollama进程,全程离线处理。这和调用OpenAI、Anthropic等云API有本质区别——后者每次request都会计入账户配额并产生费用,前者只是读取硬盘上的模型文件、占用CPU/GPU资源。
只要Ollama服务正常运行且模型已通过ollama pull下载到本地,OpenClaw发出的每个推理请求都只消耗本地算力,不触发任何外部鉴权或计费逻辑。
确认是否真走本地路径的两个关键检查点
方法一:查OpenClaw配置中的Base URL
打开OpenClaw设置 → 找到“Model Provider”或“LLM Backend”选项 → 确认Endpoint地址是http://localhost:11434或http://127.0.0.1:11434,而非https://api.openai.com之类云地址。
方法二:观察Ollama终端日志
保持Ollama正在运行(终端执行ollama serve),然后在OpenClaw中发起一次对话 → 立即查看Ollama所在终端窗口,如果出现类似→ processing request for model 'llama3'的日志行,说明请求已真实抵达本地服务。
本次更新实现飞书插件 npm 独立分发,新增 Ollama 本地模型配置及 openclaw 命令别名。引入 SQLite 持久化队列,支持断点续传。全面集成飞书、钉钉、企业微信及 QQ 官方渠道,优化阿里云百炼模型选择。修复多 Agent 路由、定时任务校验及配对授权等关键问题,提升系统稳定性与兼容性。
【必须关闭代理或全局科学上网工具】否则OpenClaw可能被劫持流量,误将请求转发到境外API网关,导致意外扣费。
常见误扣额度的三种情况
第一步:确认Ollama是否真的在监听默认端口
执行curl http://localhost:11434/api/tags,返回JSON列表才算服务就绪;若报错Connection refused,说明Ollama没启动或端口被占。
第二步:检查OpenClaw配置里有没有混用云参数
即使Base URL填对了,如果同时设置了API Key字段(比如残留的sk-xxx密钥),部分旧版OpenClaw会优先尝试用Key去调云服务,跳过本地Ollama。
第三步:验证模型名是否匹配本地已加载模型
Ollama中运行ollama list,输出第一列是模型名(如llama3);OpenClaw配置里的Model Name必须完全一致,大小写和版本号(如llama3:latest)都不能错。填错会导致OpenClaw自动fallback到配置的备用云后端。









