codex响应变慢主因是上下文污染而非模型退化;需用/status诊断、/compact手动压缩、关闭process_narration省40%token、agents.md限定文件范围、设15000token自动压缩阈值。
☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 多模态理解力帮你轻松跨越从0到1的创作门槛☜☜☜

Codex响应变慢不是模型退化,而是上下文窗口被日志、旧方案、文件片段和工具输出层层堆满,真正关键的指令反而被淹没在噪声里——这时必须主动干预上下文长度,而不是等它卡死再硬重启。
诊断当前瓶颈类型
先运行 /status 查看当前 token 占用总量与剩余空间;若显示 “used: 182432 / 200000”,说明已逼近极限,但还没爆——此时优化效果最显著。
观察最近三轮响应延迟是否逐轮增加:如果从 1.2s → 2.7s → 5.1s,且中间夹杂大量命令输出或 diff 片段,就是典型上下文污染,不是真不够用。
立即生效的手动压缩
输入 /compact 触发即时清理,保留最近3轮有效交互+当前任务相关文件引用,丢弃中间日志、失败尝试和冗余解释。
【/compact 不会删你改过的代码,但会清掉所有未确认的临时方案草稿】
若需保留某份报错日志用于后续分析,在执行前加参数:/compact keep:error.log —— 这样 error.log 内容会被锚定在压缩后上下文中。
关闭冗余叙述省出40%输出token
方法一:在系统配置中永久关闭
打开 ~/.codex/config.yaml,找到 process_narration 字段,改为 false。
方法二:单次会话临时关闭
在提问开头加上:Process_narration=false. 后接你的实际需求,比如:Process_narration=false. 把 src/utils/parse.js 中的 dateRegex 替换为 ISO 8601 兼容版本。
这一步操作起来很简单,直接把文件拖进去就行。实测关闭后单轮输出 token 减少约 40%,尤其对批量修改类任务效果立竿见影。
通过本地 Codex 或 OpenClaw OAuth 凭证直接调用 ChatGPT/Codex Responses 的 image_generation 工具来生成或编辑光栅图像,然后保存
用 AGENTS.md 锁定关键文件范围
第一步:在项目根目录新建 AGENTS.md 文件
第二步:写入精准路径白名单,例如:
focus:<br> - src/core/auth.ts<br> - src/config/index.ts<br> ignore:<br> - node_modules/<br> - dist/<br> - *.log
第三步:重启 Codex 或运行 /reload 重新加载规则
AGENTS.md 生效后,Codex 启动时只扫描列出的两个 .ts 文件,跳过整个 node_modules(通常占 80 万+ token),【没有 AGENTS.md 的大型项目,光读文件就能吃掉几十万 token】。
设置自动压缩阈值
进入 Win11 设置 → Codex → Advanced → Context Compression,启用 Auto Compact,将 Threshold 设为 15000 tokens。
这个数值是实测平衡点:设太低(如 5000)会导致频繁压缩、丢失上下文连贯性;设太高(如 180000)等于没开,等爆了才动手。
开启后,每次请求前 Codex 自动检测,一旦发现即将突破 15000 token 就先执行 /compact 再处理你的指令。










