要提升codex调用性价比,需精准控制上下文:删隐形负担、设扫描范围、拆分任务、启用过滤器、用handoff.md交接。
☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 多模态理解力帮你轻松跨越从0到1的创作门槛☜☜☜

想让Codex每次调用都更值钱,不是靠删提示词、压字数,而是把真正该它看的上下文精准喂进去,把不该它背的屎山当场卸掉。你喂错内容、范围太大、会话拖太长,它就会反复读废话、重复理解、来回搬运无关信息,token烧得比跑满负荷的GPU还快。
先砍掉自动加载的“隐形负担”
每次新开会话,Codex都会默认把AGENTS.md、Skills、MCP工具定义、插件描述、浏览器权限清单一股脑塞进上下文——哪怕你这次只让它改一行README。这些内容不随你指令变化,却每轮都占几百上千token。
删掉不用的Skill:进入Settings → Skills → 关闭所有当前任务用不到的技能,比如“数据库迁移”“K8s部署”这类重技能,留着只会吃token。
精简AGENTS.md:只保留当前项目必需的3条信息——核心目录结构、本次任务关键文件路径、明确禁止访问的目录(如node_modules、dist)。【删掉所有解释性文字和历史备注,只留可执行指令】
禁用未启用的MCP:在MCP管理页里,把状态为“已安装但未启用”的工具全部停用。它们虽不运行,但描述文本仍计入上下文。
让每次读取都带“过滤器”
别让它扫整个仓库。你在根目录放一个agents.md,就是给Codex装上定向雷达。
方法一:用路径白名单限定扫描范围
在agents.md开头加一行:SCAN_ONLY: src/auth, src/api, types/index.ts。Codex将只加载这些路径下的文件,其他一律跳过。
方法二:用关键词触发精准加载
写指令时带上明确锚点:“基于src/auth/login.ts中validateToken()函数逻辑,修改错误提示文案”。Codex会优先加载该文件+该函数上下文,不会连带载入整个auth模块。
方法三:用命令截断防爆仓
所有可能输出大量内容的命令,必须加字节限制。例如:cat src/api/error-handling.ts 2>&1 | head -c 5000。这一步不做,一个没换行的日志文件就能吃掉2万token。
通过本地 Codex 或 OpenClaw OAuth 凭证直接调用 ChatGPT/Codex Responses 的 image_generation 工具来生成或编辑光栅图像,然后保存
拆任务、设边界、控输出
第一步:把“重构整个用户模块”改成“只改src/user/profile.ts中updateProfile()函数,保持参数签名不变,仅优化空值校验逻辑”。【边界不清的任务,Codex第一反应是读100个文件,而不是写1行代码】
第二步:开启Process_narration=false参数。它能屏蔽所有中间思考步骤,只返回最终代码或结论。实测节省约40%输出token,响应更快,且避免冗余描述污染后续上下文。
第三步:对轻量任务降级模型。写README、补注释、格式化JSON,用“中”推理档位足够;查报错原因、生成单元测试,用“高”档位;只有涉及跨模块依赖分析或算法设计时,才切“超高”。
第四步:单次会话只做一件事。修Bug就只修Bug,别中途插入“顺便看看登录页样式”。新需求立刻开新会话,避免历史记录滚雪球。
用HANDOFF.md接管上下文交接
当会话变长、上下文逼近上限,或你需要暂停去开会,别硬撑——让Codex生成一份HANDOFF.md。
指令示例:“当前目标已完成:修复JWT过期刷新逻辑。关键文件:src/auth/token-refresh.ts。已确认问题根源在refreshToken()未校验exp字段。已排除方案:修改axios拦截器。下一步:验证前端token续期UI是否同步更新。”
这份文件必须控制在1000 token内。新开会话时,第一句就写:“请先读HANDOFF.md,按其中‘下一步’执行。” Codex不再从零认知项目,也不会重复加载已确认无用的文件。
这一步做完,直接关闭当前会话窗口。










