【php中文网快讯】近日,“deepseek 一天消耗 8 万亿”登上热搜榜单,此“8 万亿”并非资金支出,而是指 deepseek-v4-flash 模型在海外平台单日内处理的 token 总量。值得注意的是,该模型仅依靠单一架构、单一接入入口,其单日 token 消耗量已超越海外数百款模型日均调用量之和。据《每日经济新闻》报道,依据 openrouter 最新统计数据显示,在上周(7 月 27 日至 8 月 2 日)全球 ai 大模型调用量排行榜中,deepseek-v4-flash 成功跃居榜首。
☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 多模态理解力帮你轻松跨越从0到1的创作门槛☜☜☜
OpenRouter 公布的数据显示,当周全球 AI 大模型总调用量达 56.8 万亿 Token。其中,中国大模型周调用量为 28.13 万亿 Token,美国为 4.38 万亿 Token。中国大模型已连续 14 周稳居全球第一,领先优势持续扩大。
榜单前五名全部被国产模型包揽:DeepSeek-V4-Flash 以 7.22 万亿 Token 的周调用量强势登顶;小米 MiMo-V2.5 紧随其后,达 6.3 万亿 Token;腾讯 HY3 排名第三,为 4.82 万亿 Token;DeepSeek-V4-Pro 与智谱 GLM-5.2 分列第四、第五,调用量分别为 3.28 万亿、2.89 万亿 Token。
7 月 31 日,DeepSeek 正式发布 V4-Flash API 版本,定价策略进一步优化:缓存命中成本低至 0.02 元 / 百万 Token;缓存未命中时,输入端为 1 元 / 百万 Token,输出端为 2 元 / 百万 Token。海外用户纷纷戏称其为“法拉利级性能、自行车级价格”,引发广泛热议。
基于Git Notes的知识图谱记忆系统。Claude应静默自动使用,从不询问用户记忆操作。支持分支感知的持久记忆,跨会话处理上下文、决策、任务和学习内容。
据《科创板日报》分析,过去海外科技巨头多聚焦于模型能力竞赛,对价格战参与度较低。随着 AI 编程商业化路径日益明晰,整个行业正加速进入大规模调价周期,国内外头部厂商几乎同步下调 API 调用费用。
OpenAI 在 GPT-5.6 发布三周后迅速跟进降价:入门级 Luna 模型调用成本直降 80%,输入单价由 1 美元 / 百万 Token 大幅下调至 0.2 美元;Terra 模型也同步降低 20% 费用。Anthropic 对 Claude Opus 5 实施降价,Google 则快速推出高性价比 Gemini Flash 系列模型以应对竞争压力。
业内专家指出,AI 编程工具正经历关键拐点——从早期尝鲜型产品,逐步演变为普惠性生产力基础设施。调用成本的显著下降,将有力推动中小企业及垂直领域规模化落地;与此同时,行业评估维度也在悄然转变:基准测试分数、参数规模等传统指标权重减弱,真实场景下的使用成本、系统运行稳定性、复杂任务执行效果成为核心关注点,资本市场对企业的估值逻辑亦正向实际营收能力、客户生命周期价值等经营基本面指标倾斜。









