火山引擎ai大模型按token实时计费,输入输出分开计价,多模态内容折算视觉token;费用=(输入token+输出token)×单价;豆包2.1 pro定价为输入6元/百万token、输出30元/百万token。
☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 多模态理解力帮你轻松跨越从0到1的创作门槛☜☜☜

火山引擎AI大模型费用按实际调用消耗的Token数量实时结算,不是按次、按时长或包月强制扣费,输入和输出Token分开计价,图像等多模态内容会额外折算为视觉Token计入总用量。
Token怎么算出来的?
输入Token = 用户提问文字Token数 + 图像转成的视觉Token数。一张中等分辨率JPEG图约产生80~120个视觉Token,复杂图或高分辨率图可能翻倍;纯文本提问则只计文字切分后的词元数。
输出Token = 模型生成的回答所对应的全部词元数,包括标点、换行、空格及思考过程中的中间步骤(如Agent自动调用工具时的内部推理链)。
费用 = (输入Token + 输出Token)× 对应单价。豆包2.1 Pro当前定价为【输入6元/百万Token,输出30元/百万Token】,该价格已公示于火山引擎官网API定价页,2026年8月仍有效。
怎么查自己用了多少Token?
登录火山方舟控制台 → 进入「Turbine服务」→ 点击左侧「用量监控」→ 选择项目与时间范围,即可查看每小时粒度的输入/输出Token明细。
系统自动按项目聚合统计,支持导出CSV。若调用方未指定project_id,Token将计入默认项目,可能导致账单归属混乱。
如何避免突然高额账单?
第一步:在控制台「费用中心」→「预算管理」中,为每个项目设置月度预算阈值(例如500元)。
第二步:开启「超限自动暂停」开关,并绑定企业邮箱或飞书机器人接收告警——当消耗达预算80%时发预警,达100%时立即禁用该项目下所有API密钥。
第三步:在代码中嵌入降级逻辑,检测到单次请求输出Token预估超5000时,自动切换至lite-turbo等低价模型兜底,防止长回复失控拉高成本。
注意:免费试用额度耗尽后,账户余额不足会导致接口返回402 Payment Required错误,需提前充值,否则服务中断。
有没有更省钱的用法?
方法一:购买预付费Token资源包。例如“5000万Token六月包”可享折上折,比按量计费单价低约35%,适合调用量稳定、可预测的业务场景。
方法二:启用ArkClaw Agent Plan。该套餐含固定额度+ArkClaw调度能力,实测200元档位对应约2.04亿Token总配额,折合单价约1元/百万Token,远低于单独调用doubao-pro-32k的综合成本。
方法三:对非敏感、低频任务,改用GLM-4.6V-Flash-WEB等开源轻量模型本地部署。它在RTX 3090上单次图文推理仅耗120~180ms,不产生云API费用,且视觉Token完全自主可控。











