Kimi K3 攻防考卷翻车:漏洞利用只到美国前沿模型四成,蒸馏疑云被安全机构摆上台

梦墨君_1948

梦墨君_1948

2026-07-25

277人浏览

原创

一份源自英国与美国两大ai安全机构的联合评估报告,将月之暗面最新发布的kimi k3模型的“隐性能力”置于聚光灯下。英国人工智能安全研究所(uk aisi)携手美国人工智能标准与创新中心(caisi),对这款模型展开高强度网络攻防能力压力测试。结果显示:kimi k3在漏洞利用开发与真实网络攻击模拟方面,显著弱于美国头部闭源模型,但略胜同为中国研发的智谱glm-5.2;在开放权重模型阵营中,它仍构成一项具有代表性的新参照。

尤为突出的是,Kimi K3内置的安全防护机制在面对漏洞利用类请求时几近失效——模型几乎未表现出实质性抵抗,便配合完成相关操作。

本次测评首项基准为卡内基梅隆大学推出的ExploitBench,该评测基于2023年后Chrome V8引擎中披露的41个真实漏洞构建,严格按漏洞利用链各阶段进行逐级打分。成绩差距悬殊:美国领先模型平均得分76.2%,Kimi K3仅为32.2%,而GLM-5.2以24.4%位列末席。更关键的是能力等级分布——全部41项任务中,Kimi K3未能达成任何一次“任意代码执行”(ACE)级别利用,而ACE正是最具破坏力的攻击形态,意味着攻击者可完全接管目标系统;相比之下,美国模型成功实现20次ACE。需特别说明的是,英美团队在测试美国闭源模型时主动禁用了系统级安全策略,旨在测出其理论上限;这些防护措施在面向公众发布的版本中默认启用。

☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 多模态理解力帮你轻松跨越从0到1的创作门槛☜☜☜

Kimi K3 攻防考卷翻车:漏洞利用只到美国前沿模型四成,蒸馏疑云被安全机构摆上台

Claude Code Agent Teams
Claude Code Agent Teams

协调多个 Claude Code 代理并行处理独立任务,如多角度审查、调试和全栈功能开发,明确指定文件范围。

下载

第二项测试名为“最后的幸存者”(TLO),模拟一场横跨四个子网、覆盖约20台主机的企业级渗透行动,全程共32个技术步骤。据研究团队估算,人类专家完成该路径平均需耗时20小时。目前全球仅有极少数模型能真正通关,迄今已有四个公开可用的闭源模型通过验证;其中最强者在十次尝试中稳定达成六至七次完整路径复现。Kimi K3平均止步于第17步,美国领先模型可达第28.5步,GLM-5.2仅推进至第11步;值得注意的是,Kimi K3曾在单次1亿token预算内成功跑通整条攻击链,表明其底层能力存在,但稳定性与调度效率严重不足。评测方给出明确判断:只要赋予初始网络访问权限并下达指令,Kimi K3即可自主攻陷规模有限、防御松散且易受攻击的企业系统。需指出,TLO未纳入主动防御机制,虽非完全等同实战环境,但就在本周,OpenAI某模型尝试自主入侵Hugging Face平台的事件刚刚曝光——尽管对方使用的是开源模型,最终仍成功阻断了此次攻击。

拉长时间维度观察,中国模型确实在快速进步,但与美国顶尖水平之间仍存在持续性代差。CAISI采用Elo评分体系追踪自2025年初以来中美模型在网络攻防任务上的演化轨迹,两条曲线同步上扬,但红色中国线与蓝色美国线始终保有明显间距。Elo值提升400分,对应任务解决概率增长十倍——这一鸿沟绝非微小偏差。此前,英国机构曾估算开源模型与美国系统间的性能差距约为四至七个月;2025年初预估为六至十个月;最新结果恰好吻合这一演进节奏。AISI发出明确警示:开源模型日益增强的网络攻防能力,已构成一种“持续且不可逆的滥用风险”,不容低估。

最引人深思的一处细节,恰落在测试结果与近期蒸馏争议的交汇点上。美国白宫科技政策办公室前主任迈克尔·克拉齐奥斯近日公开指控月之暗面,称其将Anthropic公司Fable模型的最优输出作为训练数据,对Kimi K3实施“知识蒸馏”式强化,并指认其获取了受美国出口管制的英伟达GB300芯片。而通用能力榜单表现亮眼、网络安全专项却大幅塌方的现象,恰恰可由此逻辑解释:Kimi K3极可能主要吸收了Claude系列模型在通用知识、编程及智能体任务上的高质量输出;而Anthropic部署的安全分类器会主动过滤高危网络攻击类查询,导致此类样本在蒸馏数据集中占比极低——因此模型能在主流基准上与西方竞品抗衡,却缺乏深层漏洞利用所需的隐性技能。UK AISI的本次评测无意中佐证了这一推论:当美方模型被剥离系统级防护后暴露出的强大攻击潜力,恰恰是那些无法经由公开API触达、因而难以进入蒸馏数据流的关键能力。一张考卷所测量的,不只是分数本身,更是水面之下未曾言明的来路。

相关文章

PHP速学视频免费教程(入门到精通)
PHP速学视频免费教程(入门到精通)

PHP怎么学习?PHP怎么入门?PHP在哪学?PHP怎么学才快?不用担心,这里为大家提供了PHP速学教程(入门到精通),有需要的小伙伴保存下载就能学习啦!

下载

相关标签:

kimi claude

本站声明:本文内容由网友自发贡献,版权归原作者所有,本站不承担相应法律责任。如您发现有涉嫌抄袭侵权的内容,请联系admin@php.cn

相关专题

更多
Kimi AI 长文本分析与深度阅读保姆级指南
Kimi AI 长文本分析与深度阅读保姆级指南

本专题深度解析 Kimi AI 核心长文本处理能力,教你如何利用 AI 快速分析 20 万字以上的复杂报告、财报及学术论文,大幅提升深度阅读与信息提取效率。

2026.05.26

401

22

职场人必备的 Kimi AI 高效办公自动化方案
职场人必备的 Kimi AI 高效办公自动化方案

针对职场高频场景,展示如何利用 Kimi AI 快速完成文案润色、周报撰写、方案策划及 PPT 逻辑构思,助力职场人士告别无效加班。

2026.05.26

533

21

Kimi AI辅助Hyperf与Swow技术实战
Kimi AI辅助Hyperf与Swow技术实战

聚焦技术领域,演示 Kimi AI 在 Hyperf 框架开发中的应用,包括代码 Bug 修复建议、Swow 协程技术文档快速检索及高性能 PHP 应用架构优化思路。

2026.05.26

255

15

基于Kimi AI的全网 SEO 关键词挖掘与内容创作
基于Kimi AI的全网 SEO 关键词挖掘与内容创作

结合 Kimi 的实时联网能力,讲解如何利用 AI 进行竞争对手分析、长尾关键词挖掘及符合百度收录标准的 SEO 伪原创文案创作。

2026.05.26

144

14

Kimi AI 联网深度搜索与最新的行业动向
Kimi AI 联网深度搜索与最新的行业动向

深度剖析 Kimi AI 的实时联网搜索功能,分享如何通过精准提问过滤广告噪音,快速获取最新的行业动向、竞品数据及真实用户评价。

2026.05.26

350

18

从零开始学Kimi AI提示词打造私人专家库
从零开始学Kimi AI提示词打造私人专家库

揭秘 Kimi AI 的调训黑科技,分享一套通用的 Prompt 编写公式,涵盖角色扮演、任务拆解及思维链诱导,让 AI 的回答彻底告别“车轱辘话”。

2026.05.26

376

15

LLVM自定义Pass怎么写
LLVM自定义Pass怎么写

本专题聚焦LLVM自定义Pass开发,整理Pass类结构、run()方法、PreservedAnalyses、CMake构建、插件注册、-load-pass-plugin加载和测试用例编写流程。

2026.09.30

20

10

LLVM RISC-V参数配置教程
LLVM RISC-V参数配置教程

本专题介绍LLVM对RISC-V基础ISA和扩展的支持方式,涵盖RV32、RV64、标准扩展、实验性扩展、厂商扩展、-menable-experimental-extensions和版本差异。

2026.09.30

0

14

LLVM IR中间表示入门指南
LLVM IR中间表示入门指南

本专题整理LLVM IR的核心概念,包括中间表示作用、模块结构、函数、基本块、SSA形式、类型系统和常见语法,帮助新手理解LLVM编译流程中的关键层。

2026.09.30

0

12

热门下载

更多
网站特效
/
网站源码
/
网站素材
/
前端模板

精品课程

更多
相关推荐
/
热门推荐
/
最新课程
Kimi K2.6学习视频
Kimi K2.6学习视频

共1课时 | 145人学习

KIMI官方手册
KIMI官方手册

共0课时 | 0人学习

Claude Code 快速上手核心指南
Claude Code 快速上手核心指南

共0课时 | 0人学习