要在qoder中跳过云端计费、直接调用本地ollama或fastapi服务,需将请求重定向至http://127.0.0.1:11434/v1等本地地址;命令行临时指定需加/v1后缀,配置文件修改需严格缩进并重启生效,mcp插件适配非标api,反向代理则需关闭默认认证头。
☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 多模态理解力帮你轻松跨越从0到1的创作门槛☜☜☜

要在Qoder中跳过云端计费、直接调用你本机运行的Ollama或FastAPI封装的大模型服务,必须切断默认请求链路并重定向到http://127.0.0.1:11434这类本地地址,否则所有提示都会发往Qoder云后台。
命令行启动时临时指定本地Ollama
这一步操作起来很简单,直接在终端里敲完命令就能生效,适合多模型快速切换或验证本地服务是否通。
确保Ollama正在运行:执行ollama list能看到已加载模型(如qwen2.5-coder:14b),且服务监听在默认端口11434;若改过端口,后面URL要同步更新。
在项目根目录下运行:qoderclicn --ollama http://127.0.0.1:11434/v1 --model qwen2.5-coder:14b
【必须加/v1后缀】——Ollama 0.1.49+版本要求API路径严格匹配OpenAI格式,漏掉/v1会导致404错误,Qoder会fallback回云端计费。
永久修改配置文件强制走本地通道
这个方法会让Qoder所有功能模块(Quest/TUI/Memory)都绕开云端,适合长期本地开发环境,但一旦写错yaml格式,Qoder启动会直接报错退出。
打开配置文件:~/.qoder/config.yaml(Windows路径为%USERPROFILE%\.qoder\config.yaml)
找到llm:区块,完整替换为以下内容(注意缩进必须是两个空格):
llm:<br> base_url: "http://127.0.0.1:11434/v1"<br> api_key: "sk-ollama"<br> model: "qwen2.5-coder:14b"
保存后重启Qoder CLI或关闭再打开Qoder编辑器界面——【不重启配置不生效】,旧进程仍会读取内存中的缓存配置。
用MCP协议注入自定义LLM插件
当你需要对接非标准API(比如带JWT校验的私有网关、或返回字段不兼容OpenAI schema的FastAPI服务)时,此方法是唯一选择。
第一步:在项目根目录创建插件结构:mkdir -p ./mcp-providers/local-ollama/
第二步:在该目录下新建provider.py,写入标准MCP discovery接口和call逻辑
第三步:在call函数中构造POST请求,目标地址为http://127.0.0.1:11434/api/chat,body必须含model、messages、stream字段
第四步:Qoder启动时自动扫描mcp-providers/目录,发现有效插件后优先使用其响应结果
通过反向代理接入本地FastAPI服务
如果你已用FastAPI把DeepSeek-R1或Qwen3封装成OpenAI兼容接口,就不用折腾Ollama,直接让Qoder指向你的服务地址即可。
确认FastAPI服务已运行:访问http://localhost:8000/docs能打开Swagger UI,且/v1/chat/completions端点返回200
在Qoder设置中将API地址设为http://localhost:8000/v1,模型名填local-deepseek-r1
关闭认证头字段——FastAPI服务若未启用Bearer鉴权,Qoder仍会默认携带Authorization头,导致401拒绝











