配额异常陡降大概率是系统glitch,因五小时窗口与周额度逻辑冲突;国内ip易被静默切换模型,可用探针工具验证x-model-used字段;老prompt重跑若结果缺失核心逻辑但响应极短,说明模型被替换。
☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 多模态理解力帮你轻松跨越从0到1的创作门槛☜☜☜

额度掉得快,不一定是你用得多,很可能是系统层异常或配置错位。官方已确认存在配额计量 glitch,五小时窗口与周额度计数逻辑冲突,导致显示消耗远高于实际使用量。
看配额曲线是否异常陡降
非重度任务(比如日常问答、简单代码生成)半小时内掉 30% 以上,或连续几小时稳定消耗后突然断崖式下跌,大概率是 glitch。此时不要加购额度,先等官方重置——9 月已有两次自动 reset 记录,集中在周三和周六下午。
查请求是否被悄悄替换
国内 IP 即使开代理,Codex 也会把 Astra 请求静默路由为 GPT-5.6 Luna 或 Sol,而这两者计费策略不同,但前端仍显示调用的是 Astra。可用 ysh1112/codex-model-watch 这类本地探针工具验证:它能捕获真实响应头中的 X-Model-Used 字段,确认后台跑的到底是不是你选的模型。
通过本地 Codex 或 OpenClaw OAuth 凭证直接调用 ChatGPT/Codex Responses 的 image_generation 工具来生成或编辑光栅图像,然后保存
回放老 prompt 看完成质量
挑 9 月 3–5 日跑通的关键 prompt(如带类型检查的函数生成、含断言的多步推理),用当前 Astra medium/high 档重跑:
- 输出结果缺失核心逻辑,但响应时间极短(
- 同样 prompt 在 Sol 上稳定通过,在 Astra 上反复失败 → 上下文压缩层 bug,非你输入问题
- 多次重试后输出随机波动(有时对、有时漏条件)→ 典型的 completion bug,不是降智,是中间态丢弃
检查缓存是否真正生效
GPT-6 提示缓存默认开启,但只对「完全一致的共享前缀」生效。如果你每次追加指令都带新系统提示、或上传文件后又改了文件名/哈希,缓存就失效。打开 OpenAI 的 Prompt Caching Dashboard,观察 Cache Hit Rate 是否长期低于 30%。低于这个值,重复材料反复计算,账单自然飙升。










