vscode copilot 默认使用任务驱动的私有轻量模型(如copilot model v2),而非下拉菜单所选模型;行内补全基本固定调用该模型,仅agent模式等特定场景才动态路由至gpt-5、claude或gemini等公开模型。

VSCode Copilot 默认用的不是你选的那个模型
你在 Copilot Chat 界面点开模型下拉菜单,看到 GPT-5、Claude Sonnet 4.5、Gemini Flash —— 这些名字只是 Copilot 向你展示的“可用选项”,不代表你当前补全请求真由对应模型实时响应。GPT-5 Codex 或 Claude Haiku 4.5 可能只在特定任务(如多文件重构、长文档分析)中被路由调用;而日常行内补全(inline suggestion)大概率走的是轻量级私有模型(比如 GitHub 自研的 Copilot Model v2),它不对外公开参数、不支持温度调节、也不出现在下拉列表里。
常见错误现象:
– 你手动切到 Gemini Pro,但写 React 组件时补全仍像 GPT-3.5 那样简短、缺乏类型推导
– 切换 Claude Opus 4.1 后,对同一段 Python 注释生成的代码逻辑反而更保守、更少尝试新语法
– 模型选择界面显示“Active”,但网络面板看不到任何发往 Gemini 或 Anthropic 的请求
原因很简单:Copilot 的模型路由是任务驱动的,不是用户驱动的。它会根据以下信号动态决策:
– 当前光标所在语言和文件后缀
– 编辑器中选中的代码长度与上下文复杂度
– 是否触发了 Agent 模式(如输入 “Refactor this to use hooks”)
– 你的订阅等级(免费版基本不会路由到 GPT-5 或 Opus)
想真正控制模型?绕过 Copilot 的路由层
如果你明确需要 GLM-4.6 或 Grok-2 来生成某类代码(比如中文注释强相关、国产 SDK 兼容性好),别依赖 Copilot 内置下拉菜单。必须脱离它的模型抽象层,直接对接目标模型的 API。
实操路径只有两条:
– 安装 OAI Compatible Provider for Copilot 插件,填入智谱/月之暗面/Kimi 的 OpenAI 兼容 endpoint 和 API Key,再禁用原生 Copilot(否则双插件冲突)
– 自建轻量扩展,用 axios 直接调 https://open.bigmodel.cn/api/paas/v3/model-api/chatglm_pro/invoke,把编辑器选中文本作为 prompt 发过去,手动注入响应到编辑器
注意两个关键坑:
– 智谱包月计划的 endpoint 是 https://open.bigmodel.cn/api/coding/paas/v4,填错会按 token 扣费,不是走包月额度
– GLM 系列默认不返回 choices[0].message.content,而是 data.choices[0].message.content,解析失败会导致补全空白
将小说章节转换为电影分镜剧本。用户上传txt/md/docx文本,AI分析场景、角色、情绪、镜头语言,输出专业分镜脚本。适用于用户提及“分镜”“storyboard”“小说转分镜”“影视改编”“镜头脚本”或需要将小说改编为分镜的场景。
为什么改了 settings.json 还没生效?检查这三处覆盖关系
Copilot 的启用状态和模型行为受三层配置叠加影响,优先级从高到低是:
– 工作区级 .vscode/settings.json(只对该文件夹生效)
– 用户级 settings.json(Windows 在 %APPDATA%\Code\User\settings.json)
– 右键菜单的即时开关(GitHub Copilot: Toggle Enabled)——它会临时覆盖前两者,且重启 VSCode 不重置
典型问题:
– 你在项目里写了 "github.copilot.enable": false,但打开新文件时补全还在弹 → 检查右键菜单是否被意外开启
– 修改了用户级设置,但某个工作区仍走旧模型 → 查看该工作区的 .vscode/settings.json 是否显式设了 "ai.provider": "copilot"
– 使用 vscode-zhipuai 插件后,Copilot Chat 面板仍显示 GPT-5 → 关闭 Copilot 插件本身,否则两个插件同时监听 Ctrl+Enter 快捷键,响应不可预测
Agent 模式下的模型切换根本不可控
当你在 Copilot Chat 输入 “Add unit tests for this function”,或点击 “Ask Copilot to fix” 时,已进入 Agent 模式。此时 Copilot 会自动拆解任务、调用多个模型、合并结果并验证输出——你看到的最终建议,可能是 GPT-5 Codex 写骨架 + Claude Sonnet 4.5 补边界条件 + Gemini Flash 校验语法,全程无日志、无参数透出、无法干预。
这意味着:
– 即使你付费订阅了 GPT-5,也无法保证每次 Agent 请求都走它
– 你想用 GLM-4.6 做中文函数解释?它只在 Chat 对话中响应,不会参与 Agent 的内部调度
– 输出中出现 “// Generated by Copilot with Claude Opus” 这类水印,仅表示最终渲染用了该模型的 token,不代表整条链路都由它执行
真正能稳定复现的,只有纯文本补全(inline suggestion)这一条路径。其他所有高级能力,本质上都是 GitHub 控制的黑盒流水线。










