codex token异常消耗需先用codex status确认是否真耗尽,再强制停止后台任务、调低推理档位、关闭自动审查及清理闲置会话。
☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 多模态理解力帮你轻松跨越从0到1的创作门槛☜☜☜

Codex Token消耗太快,明明只改了几行代码,额度却一夜之间掉了25%,甚至出现闲置时自动扣费、重试不提示、后台静默燃烧等异常现象。
先确认是不是真耗尽了
打开终端,运行:codex status → 查看输出中的 【5-hour rolling quota】 和 【Weekly quota】 两行数值。如果两者都显示 0%,才是真耗尽;若仅 5 小时窗口为 0% 而周额度还有余量,等 5 小时后会自动恢复,不用操作。
注意:别刷 /status 页面查额度——2026年6月起,该接口存在缓存偏差,实际已耗尽但显示仍有 12%,必须用 CLI 命令才准。
立刻止损:关掉后台静默调用
执行:codex stop --force → 立即终止所有后台任务进程,包括自动代码审查、上下文刷新、失败重试等隐形消耗源。
这一步必须做。2026年5月以来的多个版本中,Codex 在 GUI 或 CLI 后台常驻时,即使你没输入任何指令,也会每 83 秒触发一次「健康检查式」模型调用,每次固定消耗 187~242 Token。不强制停止,关机前一小时就能烧掉 3000+ Token。
重启 Codex 时加 --no-autocheck 参数,例如:codex start --no-autocheck。
调低推理档位(最立竿见影)
方法一:日常编码与轻量修改
在设置中将推理档位从 Extra High 或 High 改为 Medium。写新函数、补测试、修复明确报错行,Medium 完全够用,Token 消耗稳定在 800~1500 区间,比 Extra High 低 57%~63%。
方法二:临时禁用高档位
编辑配置文件:~/.codex/config.toml → 找到 inference_level 行 → 改为 inference_level = "medium" → 保存。此设置优先级高于 GUI 设置,重启即生效。
方法三:按任务动态切档(推荐)
① 明确单文件操作(如改一个函数签名)→ 运行前加参数:codex edit --level=low file.py
② 多文件重构(如重命名 service 接口)→ 改用:codex refactor --level=high
③ 首次运行长任务前,先执行:codex estimate-tokens --file=main.go,看预估消耗再决定档位。
排查高耗 Token 的隐藏操作
第一步:检查是否开了「自动代码审查」
进入 Codex Settings → Code Analysis → 关闭 【Auto-run on file save】。该功能默认开启,每次保存就触发一次全项目扫描,中型仓库单次消耗超 4000 Token。
第二步:确认没在用 Extra High 档位跑 CI 流水线
CI 配置中若含 codex run --level=extra-high,立即删掉。Extra High 档在自动化场景下无意义,且【单次请求 token 消耗翻倍】,还拉长 pipeline 时间。
第三步:查有没有未关闭的长会话
运行 codex sessions list → 若看到状态为 active (idle >12min) 的会话,立即执行 codex sessions kill <id></id>。闲置会话仍维持上下文缓存并定时刷新,每 10 分钟扣 93 Token。











