kimi k3完整模型权重正式登陆hugging face。
发布仅半小时,K3便收获超4000个点赞,强势登顶平台趋势榜首位。Hugging Face联合创始人兼CEO Clem Delangue直言,这是该平台有史以来增速最快的一次模型发布。
☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 多模态理解力帮你轻松跨越从0到1的创作门槛☜☜☜

美国科技界迅速响应。Vercel创始人兼CEO Guillermo Rauch盛赞K3为“当前全球最强的开源权重模型”,并确认Vercel已通过本土推理服务商完成K3接入。vLLM在权重公开当日即宣布支持;Fireworks AI、Together AI、Modal、Baseten及DigitalOcean等主流平台也相继官宣上线。
这场爆发式热度之下,亦暗涌着紧迫气息。
就在K3开放权重前夕,OpenAI与Anthropic正密集向华盛顿政策圈传递警示:中国开放模型可能借由高频调用美方闭源API、采集输出数据,实施高效蒸馏——从而以更低成本复现甚至超越原模型能力。API尚可通过账户与地域限制加以管控,而一旦模型权重公开,开发者即可自由下载、二次开发与本地部署,原始厂商将彻底失去控制权。美方耗费巨额算力与资金训练出的核心能力,或将迅速演变为全球可复用的公共基础设施。
黄仁勋则公开持不同立场。7月22日,他在接受Axios采访时强调,优秀的中国开源模型“理应被广泛采用”,美国企业也“完全有权使用中国模型”。

7月24日,英伟达、微软、Meta等25家头部科技公司与机构联合签署《开放权重与美国AI领导力》倡议书,呼吁华盛顿审慎对待开放模型监管,避免过早设限。

OpenAI、Google与SpaceX起初未列于首批签署名单,但于周末陆续加入。
该公开信核心诉求,并非否定蒸馏风险,而是反对将其扩大为对整个开放权重生态的系统性封禁。截至7月27日,在主要美国前沿AI公司中,Anthropic仍未签署。
其CEO Dario Amodei当日作出回应,明确表示公司从未主张全面禁止开源模型。他承认普通开源模型具备显著公共价值,但同时指出:顶尖模型一旦开放,极难维持原有安全防护机制,因此仍支持针对性打击工业级蒸馏行为、限制先进芯片对华出口,并要求所有高性能模型强制接受第三方安全评估。

值得注意的是,OpenAI立场亦显微妙:一面支持美国自身发展开源模型,一面持续向监管层提示中国企业在蒸馏环节潜在的合规风险。
此后,英伟达联合微软、IBM、Hugging Face、SpaceXAI等组建“开放安全AI联盟”。联盟公告披露,Hugging Face此前处理Agent越界安全事件时,部分闭源工具因安全策略拒绝配合取证;团队最终借助本地部署的GLM-5.2模型,分析逾1.7万次操作轨迹,成功定位并阻断入侵路径。由此联盟提出关键主张:防御方同样需要可本地化部署、可深度定制、可全链路审计的强模型能力。
分歧本质,源于商业模式的根本差异。
OpenAI与Anthropic依赖订阅制与API调用盈利,仅Claude Code一项,今年2月年化收入已突破25亿美元;而英伟达销售AI芯片、微软提供云服务、Meta致力于构建开发者生态——三者皆受益于低价、开放、易集成的模型供给。
今年1月,Kimi、Qwen与GLM三家齐聚清华AGI-Next峰会,“中国开源四杰”中唯DeepSeek缺席。各方共识高度一致:单纯比拼对话能力已难拉开代际差距,下一轮竞争焦点,将落于Agent能否稳定执行更长周期、更复杂逻辑的任务。
半年之后,DeepSeek、GLM与Kimi轮番迭代,已迫使硅谷公开选边站队。Kimi K3只是最新火种,真正引爆争议的,是中国开源模型过去三个月连续挥出的“三锤”。
中国“三锤”
2026年,中国开源模型已发起三轮精准打击,每一轮均直指美国闭源模型一项核心优势。
“第一锤”出自DeepSeek。
4月24日,DeepSeek发布V4预览版并同步开源全部权重。V4-Pro参数总量达1.6万亿,单次推理激活490亿参数,上下文窗口支持100万Token。

据DeepSeek官方模型卡披露的自测数据,V4-Pro在最高推理强度下的SWE-bench Verified得分为80.6%,与Claude Opus 4.6的80.8%基本持平;BrowseComp达83.4%,逼近Claude Opus 4.6的83.7%,且高于GPT-5.4的82.7%。
更具冲击力的是定价策略。5月23日,DeepSeek宣布将原限时75%折扣永久化,自5月31日起长期执行。当前非缓存输入/输出费用分别为每百万Token 0.435美元与0.87美元。
这意味着,开发者仅需支付美国闭源旗舰模型零头级别的费用,即可获得性能旗鼓相当的开源替代方案。
“第二锤”来自智谱。
6月16日,智谱发布GLM-5.2,同样支持100万Token上下文,并以MIT许可证完全开源。

其战略重心已从通用问答转向持续性任务执行——包括深度阅读大型代码库、高频调用外部工具,并在数百轮交互中完成端到端软件工程闭环。
依据智谱汇总的各平台最优测试结果,GLM-5.2在Terminal-Bench 2.1中得分82.7%,略逊于GPT-5.5的83.4%,但显著优于Claude Opus 4.8的78.9%。
尽管不同模型所用Agent工具链存在差异,这一成绩仍清晰表明:开源模型在真实终端环境与复杂工作流中的落地能力已快速逼近闭源标杆,后者在Agent领域的技术代差正在加速收窄。
第三锤来自Kimi K3。
7月27日,月之暗面正式开放K3全部权重。按官方表述,这是全球首个开源的3万亿级参数模型:总参数达2.8万亿,单次激活1040亿参数,原生支持图像、视频多模态输入,并兼容100万Token上下文。此前难以在开源模型中同时实现的大规模、多模态与超长上下文三大能力,K3首次集于一体。
在月之暗面公布的基准测试中,K3于Terminal-Bench 2.1取得88.3%成绩,超越Claude Fable 5的88.0%,距GPT-5.6 Sol的88.8%仅差0.5个百分点;在专测超长软件工程任务的SWE-Marathon中,K3得分42分,高于GPT-5.6 Sol的39分与Claude Opus 4.8的40分。
三锤既落,价格壁垒、长任务瓶颈与模型规模门槛,均已不再是闭源模型的专属护城河。
但需指出,上述多数结果源自厂商自测,部分对比还涉及不同Agent工具链与运行环境混用。它们尚未能充分验证:在中国开源模型投入真实项目、经历反复调用与长时间运行后,其整体鲁棒性与稳定性是否已达闭源旗舰水准。
而这,正是DeepSeek-V4正式版亟待攻破的最后一道关隘。
V4还需击穿哪堵墙?
既然多项评测分数已实现追平,为何美国闭源模型API仍能溢价十余倍乃至数十倍?
月之暗面在K3官方模型卡中给出坦率回答:尽管K3在多个权威评测中跻身第一梯队,但其实际使用体验与Claude Fable 5、GPT-5.6 Sol相比,仍存在“明显差距”。
GLM-5.2亦面临类似挑战。它在Terminal-Bench 2.1中最高达82.7%,已接近顶级闭源模型;但在专门考核超长软件工程任务的SWE-Marathon中,智谱公布的测试结果显示,GLM-5.2仅获13分,而Claude Opus 4.8达26分。
对企业用户而言,这些细微误差直接转化为真金白银的成本。
企业在模型选型时,必须将API调用费与返工时间成本一并纳入核算。
以DeepSeek-V4-Pro为例,其百万Token非缓存输入/输出价格分别为0.435美元与0.87美元;Claude Opus 5对应报价则为5美元与25美元,输出单价约为前者的29倍。
价格优势固然显著,但若长任务执行至终局失败,工程师仍需回溯排查、手动修正并重新运行——前期节省的调用费用,很快将在返工中消耗殆尽。
因此,V4正式版真正需要交付的,不仅是更高分值,更是经得起反复压测的稳定工具调用能力、长上下文一致性表现,以及多轮迭代修改的可靠性。它要让开发者敢于将大型代码库分析、复杂科研建模、长时间Agent任务等关键场景,放心托付给开源模型。
截至目前,DeepSeek尚未公布V4正式版确切发布时间与详细规格。据近期流传的投资人沟通纪要,创始人梁文锋表态:公司大概率仍将开放最强版本,商业化目标仅为获取“合理利润”。
若此承诺如期兑现,V4正式版将继续沿用DeepSeek最具杀伤力的组合拳:能力对标美国旗舰、价格大幅下探、权重完全开源。
至此,OpenAI与Anthropic近期一系列动作便不难理解。
三锤已然连发,二者不愿坐等V4正式版落地后再被动应对。故而Kimi K3甫一开源,两家公司即推动华盛顿启动模型蒸馏专项调查,并探讨制裁措施与使用限制。一旦权重被大规模下载与部署,后续监管效力将大打折扣。
当下赛程已进入抢跑阶段——比拼的是DeepSeek-V4正式版的上市速度,与华盛顿限制政策的出台节奏。
第四锤的最终威力,一半系于DeepSeek能否交出稳定、低价、持续开源的终极版本,另一半则取决于主张限制中国开源模型的势力能否成功推动政策落地。
本文来自微信公众号“字母AI”,作者:小金牙,36氪经授权发布。











