必须手动配置外部模型接口以替换codegeex默认模型,前提是在本地或局域网运行兼容openai格式的restful api服务(如fastchat、vllm等),通过图形界面或编辑settings.json设置apibaseurl、apikey和modelname,并重启vs code验证请求是否指向本地/chat/completions接口。
☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 多模态理解力帮你轻松跨越从0到1的创作门槛☜☜☜

当你在VS Code或JetBrains IDE中使用CodeGeeX插件,发现本地加载的codegeex-13b模型响应缓慢、显存溢出报错,或想尝试Qwen2-7B、DeepSeek-Coder等第三方开源模型替代原生模型时,必须绕过插件默认的模型绑定机制,手动配置外部模型接口——这一步不依赖Zhipu AI Cloud,也不走Ollama封装层,而是直连兼容OpenAI格式的RESTful API服务。
确认本地已部署兼容API服务
CodeGeeX三方模型切换的前提是:你已在本机或局域网内运行一个支持OpenAI v1/chat/completions协议的推理服务,例如FastChat、vLLM、LMStudio或Ollama启动的qwen2:7b。打开终端执行curl http://localhost:8000/v1/models,返回包含"id": "qwen2-7b"的JSON即表示服务就绪。
若返回404或Connection refused,请先停止CodeGeeX插件,再启动对应服务——【未运行API服务时强行配置会导致插件静默降级回云端,且不报任何错误】。
在CodeGeeX设置中启用自定义API后端
方法一:通过图形界面配置(推荐新手)
点击VS Code左侧CodeGeeX火箭图标 → 右上角齿轮图标 → 找到“Backend Configuration” → “Model Provider”下拉菜单选择“Custom API”。
方法二:直接编辑settings.json(精准可控)
按Ctrl+Shift+P → 输入“Preferences: Open Settings (JSON)” → 在对象末尾添加:
"codegeex.apiBaseUrl": "http://localhost:8000/v1","codegeex.apiKey": "sk-xxx","codegeex.modelName": "qwen2-7b"
注意:apiKey可填任意非空字符串(部分服务如FastChat无需鉴权),但字段名和引号必须严格匹配;modelName必须与curl http://localhost:8000/v1/models返回的id完全一致,大小写敏感。
验证三方模型是否生效
第一步:重启VS Code或重新加载窗口(Ctrl+Shift+P → “Developer: Reload Window”)
第二步:新建一个.py文件,输入def 后停顿2秒 → 观察右下角CodeGeeX图标:
• 若为绿色静止火箭 → 说明已脱离云端,走本地API通道
• 若为蓝色旋转图标 → 检查API服务端口是否被占用,或settings.json中baseUrl末尾是否误加斜杠(如v1/)
第三步:打开开发者工具(Ctrl+Shift+I)→ Network标签页 → 过滤chat/completions → 触发一次补全 → 查看请求URL是否指向http://localhost:8000/v1/chat/completions,且Payload中"model"字段值等于你配置的modelName。











