关闭「自动注入api文档」和「保留最近调试历史」可使单次调试token从12k降至1.8k;推荐用精简curl命令或最小json schema触发调试,并分步执行+启用本地缓存代理,最高节省73% token。
☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 多模态理解力帮你轻松跨越从0到1的创作门槛☜☜☜

CodeBuddy接口调试时,每次请求都携带完整API文档、历史调用记录、响应示例和项目配置,导致Token账单飙升——你只改了1个参数,系统却把整个后端服务的Swagger JSON重新塞进上下文。
关闭冗余上下文自动注入
默认开启的「智能上下文感知」会把当前项目所有OpenAPI文件、.env变量、最近3次调试记录全量加载进每轮请求。这步不关,光是Swagger v3 JSON就能吃掉8K Token。
进入CodeBuddy设置 → 「Agent行为」→ 关闭「自动注入API文档」和「保留最近调试历史」两项开关。
【关闭后需手动粘贴关键接口定义】,但换来的是单次调试输入Token从12K降至1.8K。
用最小化请求体触发调试
方法一:直接输入curl命令片段
在输入框里只写:curl -X POST http://localhost:3000/api/users -H "Content-Type: application/json" -d '{"name":"test"}'。CodeBuddy会自动解析出method、path、headers、body四要素,不加载任何额外上下文。
方法二:手写精简JSON Schema
若需校验结构,仅粘贴必要字段的Schema片段:{"type":"object","properties":{"name":{"type":"string"}},"required":["name"]}。别贴整份OpenAPI spec——那玩意儿动辄50K Token。
注意:粘贴前删掉所有注释和空行,JSON压缩工具在线处理一下再粘,能再省15%输入量。
分步执行调试流程
第一步:先让CodeBuddy生成基础请求模板
输入:“生成一个POST /api/orders的curl命令,body含order_id和amount” → 得到干净可执行的curl命令。
第二步:复制该命令,在终端执行并捕获真实响应
第三步:把原始请求+真实响应一起粘贴进CodeBuddy,加一句:“对比响应结构是否符合预期”。此时上下文只有200字左右,而非整套微服务架构图。
这三步拆开做,比让它“自动调试整个订单模块”节省73% Token。系统不再反复检索和重载无关服务的接口定义。
启用本地缓存代理
安装codebuddy-cache-proxy插件(npm install -g @tencent-ai/codebuddy-cache-proxy),启动后所有重复请求路径自动命中本地缓存。
比如连续调试/api/v1/users/{id}接口,第二次起输入Token按10%计费,响应内容直接从内存返回。
【必须确保同一路径的请求体完全一致才能命中缓存】,微小空格差异都会导致缓存失效。










