老用户续费成本飙升是因minimax自2026年6月1日起默认将到期coding plan自动降级为token plan,原500次/天调用折算后仅剩19–38次/天;需在到期前72小时内手动续订旧版,且须完成用量导出、临界测试与降级锁定三步操作。
☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 多模态理解力帮你轻松跨越从0到1的创作门槛☜☜☜

很多老用户在MiniMax M3上线后收到续费提醒,发现原Coding Plan自动转为Token Plan,账单直接翻了三倍——这不是系统故障,而是订阅体系切换时未主动干预导致的默认升级路径。
为什么老用户续费成本突然飙升
MiniMax于2026年6月1日起将所有新购及续订订单统一接入Token Plan体系,旧版Coding Plan仅保留存量用户手动续订入口,且【到期日当天零点起自动降级为Token Plan基础档】。这意味着:你没做任何操作,系统就按新计费规则重新核算额度;原计划中“500次/天”的调用限额,在Token Plan里被折算为约7.2万输入Token+4.8万输出Token,而一次中等复杂度代码生成实际消耗约1800–2600 Token,等效调用量只剩19–38次/天。
这一步操作起来很简单,直接登录控制台→左侧导航栏点击“订阅管理”→找到当前生效的Coding Plan卡片右上角“…”→选择“立即续订旧版”,但该入口【仅在到期前72小时内可见】,过期即永久关闭。
Token Plan真实额度换算方法
Token Plan不按请求次数计费,而是严格区分输入Token与输出Token,且系统提示词、历史消息、工具调用参数全部计入输入量。常见误判是把官网写的“100万Token/月”当成可用额度,实际需扣除三类固定开销:
方法一:静态扣除法(适合预估月均支出)
取你最近7天API调用日志,统计平均单次请求的输入/输出Token均值,乘以预期调用频次,再叠加15%冗余系数(用于处理长上下文缓存失效场景)。
方法二:动态监控法(生产环境必用)
在vLLM服务层启用token_usage回调钩子→将每次response.headers中x-token-used字段写入本地SQLite→每小时聚合一次,生成折线图。若连续3小时输出Token占比超68%,说明prompt结构存在冗余描述,需压缩system message或启用摘要前置模块。
注意:MiniMax对缓存命中仅减免输入Token费用,输出Token无论是否命中缓存均全额计费。
续费前必须做的三件事
第一步:导出历史用量报表
进入控制台→“用量分析”→时间范围选“过去30天”→点击右上角“导出CSV”,重点查看“max_tokens_per_request”和“cached_ratio”两列数据。
第二步:测试Token Plan临界点
用curl构造一个极限请求:设置max_tokens=2048+temperature=0.3+top_p=0.85,输入一段含5个函数定义的Python代码,观察返回头中x-token-used数值。若单次突破3200 Token,说明你当前主力模型(如M2.5)不适合直接迁移到Token Plan的Plus档位。
第三步:锁定降级通道
若测试结果超标,立即前往“订阅管理”页面,点击“切换套餐”→选择“Legacy Coding Plan(仅限存量用户)”→勾选“到期后不再自动续订Token Plan”→提交工单申请人工审核。该操作【必须在当前订阅周期结束前48小时完成】,否则系统将强制执行自动转换。











