中国开源模型三连击,梁文锋开最后一枪?

花韻仙語

花韻仙語

2026-07-28

597人浏览

原创

kimi k3完整模型权重正式登陆hugging face。

发布仅半小时,K3便收获超4000个点赞,强势登顶平台趋势榜首位。Hugging Face联合创始人兼CEO Clem Delangue直言,这是该平台有史以来增速最快的一次模型发布

☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 多模态理解力帮你轻松跨越从0到1的创作门槛☜☜☜

中国开源模型三连击,梁文锋开最后一枪?

美国科技界迅速响应。Vercel创始人兼CEO Guillermo Rauch盛赞K3为“当前全球最强的开源权重模型”,并确认Vercel已通过本土推理服务商完成K3接入。vLLM在权重公开当日即宣布支持;Fireworks AI、Together AI、Modal、Baseten及DigitalOcean等主流平台也相继官宣上线。

这场爆发式热度之下,亦暗涌着紧迫气息。

就在K3开放权重前夕,OpenAI与Anthropic正密集向华盛顿政策圈传递警示:中国开放模型可能借由高频调用美方闭源API、采集输出数据,实施高效蒸馏——从而以更低成本复现甚至超越原模型能力。API尚可通过账户与地域限制加以管控,而一旦模型权重公开,开发者即可自由下载、二次开发与本地部署,原始厂商将彻底失去控制权。美方耗费巨额算力与资金训练出的核心能力,或将迅速演变为全球可复用的公共基础设施。

黄仁勋则公开持不同立场。7月22日,他在接受Axios采访时强调,优秀的中国开源模型“理应被广泛采用”,美国企业也“完全有权使用中国模型”

中国开源模型三连击,梁文锋开最后一枪?

7月24日,英伟达、微软、Meta等25家头部科技公司与机构联合签署《开放权重与美国AI领导力》倡议书,呼吁华盛顿审慎对待开放模型监管,避免过早设限。

中国开源模型三连击,梁文锋开最后一枪?

OpenAI、Google与SpaceX起初未列于首批签署名单,但于周末陆续加入。

该公开信核心诉求,并非否定蒸馏风险,而是反对将其扩大为对整个开放权重生态的系统性封禁。截至7月27日,在主要美国前沿AI公司中,Anthropic仍未签署。

其CEO Dario Amodei当日作出回应,明确表示公司从未主张全面禁止开源模型。他承认普通开源模型具备显著公共价值,但同时指出:顶尖模型一旦开放,极难维持原有安全防护机制,因此仍支持针对性打击工业级蒸馏行为、限制先进芯片对华出口,并要求所有高性能模型强制接受第三方安全评估。

中国开源模型三连击,梁文锋开最后一枪?

值得注意的是,OpenAI立场亦显微妙:一面支持美国自身发展开源模型,一面持续向监管层提示中国企业在蒸馏环节潜在的合规风险。

此后,英伟达联合微软、IBM、Hugging Face、SpaceXAI等组建“开放安全AI联盟”。联盟公告披露,Hugging Face此前处理Agent越界安全事件时,部分闭源工具因安全策略拒绝配合取证;团队最终借助本地部署的GLM-5.2模型,分析逾1.7万次操作轨迹,成功定位并阻断入侵路径。由此联盟提出关键主张:防御方同样需要可本地化部署、可深度定制、可全链路审计的强模型能力。

分歧本质,源于商业模式的根本差异。

OpenAI与Anthropic依赖订阅制与API调用盈利,仅Claude Code一项,今年2月年化收入已突破25亿美元;而英伟达销售AI芯片、微软提供云服务、Meta致力于构建开发者生态——三者皆受益于低价、开放、易集成的模型供给。

今年1月,Kimi、Qwen与GLM三家齐聚清华AGI-Next峰会,“中国开源四杰”中唯DeepSeek缺席。各方共识高度一致:单纯比拼对话能力已难拉开代际差距,下一轮竞争焦点,将落于Agent能否稳定执行更长周期、更复杂逻辑的任务。

半年之后,DeepSeek、GLM与Kimi轮番迭代,已迫使硅谷公开选边站队。Kimi K3只是最新火种,真正引爆争议的,是中国开源模型过去三个月连续挥出的“三锤”。

中国“三锤”

2026年,中国开源模型已发起三轮精准打击,每一轮均直指美国闭源模型一项核心优势。

“第一锤”出自DeepSeek。

4月24日,DeepSeek发布V4预览版并同步开源全部权重。V4-Pro参数总量达1.6万亿,单次推理激活490亿参数,上下文窗口支持100万Token。

中国开源模型三连击,梁文锋开最后一枪?

据DeepSeek官方模型卡披露的自测数据,V4-Pro在最高推理强度下的SWE-bench Verified得分为80.6%,与Claude Opus 4.6的80.8%基本持平;BrowseComp达83.4%,逼近Claude Opus 4.6的83.7%,且高于GPT-5.4的82.7%。

更具冲击力的是定价策略。5月23日,DeepSeek宣布将原限时75%折扣永久化,自5月31日起长期执行。当前非缓存输入/输出费用分别为每百万Token 0.435美元与0.87美元。

这意味着,开发者仅需支付美国闭源旗舰模型零头级别的费用,即可获得性能旗鼓相当的开源替代方案。

“第二锤”来自智谱。

DeepSeek
DeepSeek

DeepSeek是一款由深度求索公司开发的免费AI助手,支持Web端和移动端使用。它拥有强大的自然语言处理能力,可进行文本对话、内容创作、代码编写、文件处理(支持图像、PDF、Word、Excel、PPT等格式)以及联网搜索。DeepSeek上下文长度达1M tokens,能一次性处理海量信息(如《三体》三部曲)。其核心优势在于完全免费、响应迅速、支持语音输入,并提供API服务,适合学习、办公和开发等多种场景。

下载

6月16日,智谱发布GLM-5.2,同样支持100万Token上下文,并以MIT许可证完全开源。

中国开源模型三连击,梁文锋开最后一枪?

其战略重心已从通用问答转向持续性任务执行——包括深度阅读大型代码库、高频调用外部工具,并在数百轮交互中完成端到端软件工程闭环。

依据智谱汇总的各平台最优测试结果,GLM-5.2在Terminal-Bench 2.1中得分82.7%,略逊于GPT-5.5的83.4%,但显著优于Claude Opus 4.8的78.9%。

尽管不同模型所用Agent工具链存在差异,这一成绩仍清晰表明:开源模型在真实终端环境与复杂工作流中的落地能力已快速逼近闭源标杆,后者在Agent领域的技术代差正在加速收窄。

第三锤来自Kimi K3。

7月27日,月之暗面正式开放K3全部权重。按官方表述,这是全球首个开源的3万亿级参数模型:总参数达2.8万亿,单次激活1040亿参数,原生支持图像、视频多模态输入,并兼容100万Token上下文。此前难以在开源模型中同时实现的大规模、多模态与超长上下文三大能力,K3首次集于一体。

在月之暗面公布的基准测试中,K3于Terminal-Bench 2.1取得88.3%成绩,超越Claude Fable 5的88.0%,距GPT-5.6 Sol的88.8%仅差0.5个百分点;在专测超长软件工程任务的SWE-Marathon中,K3得分42分,高于GPT-5.6 Sol的39分与Claude Opus 4.8的40分。

三锤既落,价格壁垒、长任务瓶颈与模型规模门槛,均已不再是闭源模型的专属护城河。

但需指出,上述多数结果源自厂商自测,部分对比还涉及不同Agent工具链与运行环境混用。它们尚未能充分验证:在中国开源模型投入真实项目、经历反复调用与长时间运行后,其整体鲁棒性与稳定性是否已达闭源旗舰水准。

而这,正是DeepSeek-V4正式版亟待攻破的最后一道关隘。

V4还需击穿哪堵墙?

既然多项评测分数已实现追平,为何美国闭源模型API仍能溢价十余倍乃至数十倍?

月之暗面在K3官方模型卡中给出坦率回答:尽管K3在多个权威评测中跻身第一梯队,但其实际使用体验与Claude Fable 5、GPT-5.6 Sol相比,仍存在“明显差距”。

GLM-5.2亦面临类似挑战。它在Terminal-Bench 2.1中最高达82.7%,已接近顶级闭源模型;但在专门考核超长软件工程任务的SWE-Marathon中,智谱公布的测试结果显示,GLM-5.2仅获13分,而Claude Opus 4.8达26分。

对企业用户而言,这些细微误差直接转化为真金白银的成本。

企业在模型选型时,必须将API调用费与返工时间成本一并纳入核算。

以DeepSeek-V4-Pro为例,其百万Token非缓存输入/输出价格分别为0.435美元与0.87美元;Claude Opus 5对应报价则为5美元与25美元,输出单价约为前者的29倍。

价格优势固然显著,但若长任务执行至终局失败,工程师仍需回溯排查、手动修正并重新运行——前期节省的调用费用,很快将在返工中消耗殆尽。

因此,V4正式版真正需要交付的,不仅是更高分值,更是经得起反复压测的稳定工具调用能力、长上下文一致性表现,以及多轮迭代修改的可靠性。它要让开发者敢于将大型代码库分析、复杂科研建模、长时间Agent任务等关键场景,放心托付给开源模型。

截至目前,DeepSeek尚未公布V4正式版确切发布时间与详细规格。据近期流传的投资人沟通纪要,创始人梁文锋表态:公司大概率仍将开放最强版本,商业化目标仅为获取“合理利润”。

若此承诺如期兑现,V4正式版将继续沿用DeepSeek最具杀伤力的组合拳:能力对标美国旗舰、价格大幅下探、权重完全开源。

至此,OpenAI与Anthropic近期一系列动作便不难理解。

三锤已然连发,二者不愿坐等V4正式版落地后再被动应对。故而Kimi K3甫一开源,两家公司即推动华盛顿启动模型蒸馏专项调查,并探讨制裁措施与使用限制。一旦权重被大规模下载与部署,后续监管效力将大打折扣。

当下赛程已进入抢跑阶段——比拼的是DeepSeek-V4正式版的上市速度,与华盛顿限制政策的出台节奏。

第四锤的最终威力,一半系于DeepSeek能否交出稳定、低价、持续开源的终极版本,另一半则取决于主张限制中国开源模型的势力能否成功推动政策落地。

本文来自微信公众号“字母AI”,作者:小金牙,36氪经授权发布。

相关文章

PHP速学视频免费教程(入门到精通)
PHP速学视频免费教程(入门到精通)

PHP怎么学习?PHP怎么入门?PHP在哪学?PHP怎么学才快?不用担心,这里为大家提供了PHP速学教程(入门到精通),有需要的小伙伴保存下载就能学习啦!

下载

相关标签:

deepseek claude qwen

本站声明:本文内容由网友自发贡献,版权归原作者所有,本站不承担相应法律责任。如您发现有涉嫌抄袭侵权的内容,请联系admin@php.cn

相关专题

更多
Qt Creator按钮响应设置方法
Qt Creator按钮响应设置方法

信号槽是 Qt 开发的核心机制。本专题整理 Qt Creator 中按钮点击、菜单触发、输入变化、窗口事件、自定义信号、自动连接槽函数和手动 connect 写法,帮助用户理解界面控件如何和 C++ 代码联动。

2026.08.05

0

10

Qt Creator新建项目使用教程
Qt Creator新建项目使用教程

本专题整理 Qt Creator 新建项目、打开已有工程、项目模板选择、目录结构、源文件管理、构建目录、运行配置和项目迁移方法,重点解决新手不知道选 qmake 还是 CMake、项目打不开、文件不参与编译等常见问题。

2026.08.05

0

10

maven常用插件使用大全
maven常用插件使用大全

PHP中文网精心整理Maven主流插件用法合集,涵盖编译、测试、打包等常用插件使用大全。从基础配置到进阶实战,详细解析各插件功能与适用场景,助你轻松掌握Maven自动化构建,解决Java项目开发痛点,是开发者必备的实用指南。

2026.08.05

0

31

PyCharm快速入门指南
PyCharm快速入门指南

本专题汇总了PyCharm快速入门的全套指南与教程,涵盖从官网下载安装、创建第一个Python项目、配置虚拟环境,到代码编辑、运行调试等基础操作,并整理了版本控制(Git)集成、常用高效快捷键及实用插件等进阶技巧,助你快速上手这款高效的Python IDE。

2026.08.05

2

17

PyCharm运行程序教程大全
PyCharm运行程序教程大全

本专题汇总了PyCharm运行程序的多种方式与详细操作步骤,涵盖通过主菜单Run、点击工具栏绿色三角图标、使用快捷键Shift+F10(或Ctrl+Shift+F10)等基本运行方法,以及配置运行/调试参数、设置PYTHONPATH环境变量、管理多脚本运行与交互式Python控制台调试等进阶技巧,助您全面掌握在PyCharm中高效运行与管理Python程序的方法。

2026.08.05

0

14

Maven零基础入门教程
Maven零基础入门教程

本合集由PHP中文网精心整理,提供Maven零基础入门到完整使用的保姆级教程。内容涵盖环境安装、核心配置、仓库管理及项目构建等核心知识点。通过详细步骤解析与代码示例,助你快速掌握Maven的依赖管理与自动化构建,轻松解决Java项目中的各种痛点,是新手入门与进阶的必备指南。

2026.08.05

2

18

Maven安装及配置教程
Maven安装及配置教程

本合集由PHP中文网精心整理,提供Maven安装配置与环境配置详情指南。内容涵盖Maven下载、解压安装、环境变量配置、阿里云镜像加速及本地仓库修改等全流程。教程通俗易懂,帮助开发者轻松解决依赖管理难题,快速掌握Maven核心构建技能,是Java开发者的必备实战指南。

2026.08.05

2

24

Selenium WebDriver元素定位与页面操作教程
Selenium WebDriver元素定位与页面操作教程

本专题整理Selenium WebDriver元素定位、XPath、CSS Selector、等待机制、窗口切换、Frame处理、Alert弹窗、Cookie操作和文件上传等核心用法。

2026.08.05

8

26

Selenium Grid分布式测试与并行执行教程
Selenium Grid分布式测试与并行执行教程

本专题整理Selenium Grid架构、远程WebDriver、并行测试、Docker部署、Kubernetes动态Grid、浏览器矩阵和测试环境扩展方法,适合进阶自动化测试团队使用。

2026.08.05

4

18

热门下载

更多
网站特效
/
网站源码
/
网站素材
/
前端模板

精品课程

更多
相关推荐
/
热门推荐
/
最新课程
Kimi K2.6学习视频
Kimi K2.6学习视频

共1课时 | 103人学习

腾讯元宝使用手册
腾讯元宝使用手册

共0课时 | 0人学习

DeepSeek手册
DeepSeek手册

共0课时 | 0人学习