【php中文网快讯】据财联社消息,美国研究机构 artificial analysis 近日公布最新评测结果:在当前主流商用大模型中,deepseek-v4-flash 的综合运行成本位居全球最低,其单位任务执行成本甚至不到 anthropic 旗舰模型 claude fable 5 的1%。
☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 多模态理解力帮你轻松跨越从0到1的创作门槛☜☜☜
7月31日,DeepSeek-V4-Flash 正式版已全面上线(相关详情可参见此前 PHP 中文网报道:《DeepSeek-V4-Flash正式版上线,Agent能力大幅增强》)。回顾技术演进路径,DeepSeek 推出的 R1 模型早在2025年初发布时便引发全球产业震动,带动多国科技股震荡,也促使业界重新评估海外厂商高昂的 AI 研发投入与服务调用支出。此次 V4-Flash 凭借显著的成本优势,再度成为国际AI领域关注焦点。
Artificial Analysis 明确指出,DeepSeek-V4-Flash 的计费标准为:每百万输入 Token 收费 0.14 美元,每百万输出 Token 收费 0.28 美元。
为更真实反映开发者实际使用负担,该机构采用“智能指数加权测算法”,依据各任务实际所需的输入与输出 Token 总量,动态计算单任务平均开销。实测数据显示:DeepSeek-V4-Flash 单任务平均成本仅为 3 美分;横向对比来看,Kimi K3 为 86 美分,GPT-5.6 Sol 达 1.86 美元,Claude Fable 5 更高达 3.15 美元。研究团队强调,相较简单标价对比,加权测算能有效规避“表面低价但需多次交互导致总成本飙升”的误导性偏差,更契合真实开发场景中的资源消耗逻辑。
基于Git Notes的知识图谱记忆系统。Claude应静默自动使用,从不询问用户记忆操作。支持分支感知的持久记忆,跨会话处理上下文、决策、任务和学习内容。
在综合能力评估方面,Artificial Analysis 基于满分100分的智能指数体系(涵盖代码生成、逻辑推理、办公协同等九大核心基准任务),给予 DeepSeek-V4-Flash 50 分。该得分与谷歌 Gemini 3.6 Flash 并列,仅比 Meta Muse Spark 1.1 和智谱 GLM-5.2 低1分;Kimi K3 得分为57分,OpenAI GPT-5.6 及 Anthropic 多款旗舰模型得分均不低于59分。
兼具更低调用门槛与稳健性能表现,进一步提升了开发者接入意愿。过去一年间,DeepSeek 凭借高性价比 API 接口与持续优化的模型能力,加速拓展全球开发者生态,吸引大量海外企业及独立开发者迁移至其平台,API 调用量持续攀升。
全球多模型聚合平台 OpenRouter 发布的最新周度调用榜单显示:榜单前五名全部由国产大模型包揽。其中,小米 MiMo-V2.5 以单周 10.5 万亿 Token 的调用量稳居榜首;DeepSeek-V4-Flash、腾讯 HY3、智谱 GLM-5.2、DeepSeek-V4-Pro 分别位列第二至第五位,国产大模型在海外市场的渗透率正呈现集中式上升趋势。










