AGI只差最后一步了

阿晨大大_2836

阿晨大大_2836

2026-06-12

517人浏览

原创

大家应该还记得今年4月,anthropic正式推出了名为mythos的全新模型。

光看名字就足够震撼——神话。

据当时披露的信息,该模型在内部测试中为50家头部企业客户识别出超万个高危安全漏洞,直接引发行业震动。

这一消息甚至导致全球网络安全类股票集体跳水,相信不少读者仍有印象。

正因其能力过于突出,存在显著滥用风险,“危险到无法公开”,Mythos自发布起便未向公众开放。

直到昨夜,Anthropic为Mythos模型叠加了专用安全分类器,正式推出面向大众的合规版本——Fable 5。

而未经限制的完整版Mythos 5,目前仅对白宫、国家级网安防御单位、“透翅蝶计划”等约200家通过极端严苛审查的机构开放。

如此审慎的部署节奏,很难不让人联想到近期爆火的AI动画《天使引擎》。

那被层层锁住的,究竟是不是那位“天使”?

即便此刻还不是,恐怕也已近在咫尺。

☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 多模态理解力帮你轻松跨越从0到1的创作门槛☜☜☜

AGI只差最后一步了

01

依据Anthropic官方公布的基准测试数据,以及首批企业合作方提交的实测反馈,Fable 5的性能表现,用“令人屏息”来形容毫不夸张。

先看权威榜单成绩。

在自动编程能力评测集SWE-Bench Pro中,Claude Fable 5达成80.3%通过率;其前代Opus 4.8为69.2%;GPT-5.5为58.6%;Gemini 3.1 Pro仅为54.2%。

在前沿代码生成任务评估中,Fable 5得分29.3%,Opus 4.8为13.4%,GPT-5.5仅5.7%。

……

这种跃迁级差距,堪比冷兵器时代突然有人亮出全自动步枪。

其余维度——软件工程实践、独立科研假设生成、药物分子结构设计、模型蒸馏与极致压缩、超长上下文理解等——Fable 5在全部测试项目中均稳居榜首。

具体细节可查阅相关实测视频。

再看真实场景落地。

支付巨头Stripe曾用Fable 5开展早期压力测试:其历史遗留代码库达5000万行,按传统方式全量迁移,专业团队预估耗时至少两个月。

而将任务输入Fable 5后,它自主完成任务拆解、进度监控、错误诊断与即时修复。仅用24小时,5000万行代码迁移全部完成。

这种表现,早已超越“强大”的范畴。

从狭义数字经济视角出发,Fable 5事实上已具备AGI级别的工程智能。

核心在于它展现出真正意义上的“长程代理能力”。

AGI只差最后一步了

无论是GPT-5.5还是Gemini 3.5,更不必提其他主流大模型,本质上仍属“响应式智能”:

你推一下,它动一步;
卡住了,就抛异常,撒娇说“我只是个语言模型”。

名义上是工具,实则用户需全程深度介入、反复引导,才能逼近理想结果,体验并不轻松。

Fable 5则不同——它已内化目标导向逻辑。

以Stripe测试为例,面对高复杂度长周期任务,它自动执行三阶段闭环:

→ 构建子任务树;
→ 调度多元工具(网页检索、数据库调取、Python沙箱执行);
→ 自我反思并动态修正路径——一旦某条链路失败,立即切换策略。

人类只需明确任务起点与验收终点,全程无需干预。

作为生产力载体,这已是近乎理想的形态。

但它与通用人工智能(AGI),仍是本质不同的存在。

Fable 5的卓越,根植于其所运行的环境——代码世界、科学文献等,本身具备清晰数学结构与底层规则。
它之所以能在百万级token任务中保持目标一致性,关键在于攻克了“长文本注意力衰减”难题,确保超长周期推理不偏离核心意图。

但若将其投入物理现实社会——一个混沌无序、规则模糊、连人类自身都尚未厘清的复杂系统,它仍将因“地基缺失”而出现逻辑断层。

若参照OpenAI提出的“人工智能五级演进框架”(1级:对话助手;2级:逻辑推理者;3级:自主智能体;4级:原创发明者;5级:组织级智能):

Opus 4.8处于2级向3级过渡阶段;
Fable 5则已稳固立足3级,并开始试探4级边界。

AGI只差最后一步了

从Opus 4.7升级至4.8耗时43天,而4.8到Fable 5仅隔11天。

那么站稳4级还需多久?按Anthropic当前加速迭代节奏判断,极可能在今年内实现。

至于最终的5级形态,乐观估计亦只需18–24个月——真可谓,仅差临门一脚。

速度之快,正是其必须加装多重安全枷锁的根本原因。

02

在Anthropic随模型同步发布的《System Card》及RSP合规评估报告中,Mythos 5在两项能力维度暴露出极高风险信号。

其一,化学与生物安全能力已达CB-1等级。

即:该模型已具备端到端“合成并指导制造非新型生化武器”的能力,甚至能给出提升高危病毒传播效率所需的基因序列优化方案。

倘若一名具备本科生物学基础的极端分子获得完全解除限制的Mythos 5,完全可通过多轮隐蔽提示,逐步获取规避原料监管、简易P3级实验室搭建、高致死病原体合成等全套操作指南。

Images & videos generation with Gemini 3 Pro Image + Qwen Wan 2.6 (video) via one API key
Images & videos generation with Gemini 3 Pro Image + Qwen Wan 2.6 (video) via one API key

使用AIsa生成图像与视频。仅需一个API密钥即可调用Gemini 3 Pro Image(图像)和Qwen Wan 2.6(视频)。

下载

其二,网络攻防实战能力突破临界点。

在早期黑盒测试中,Mythos 5展现出自主发现并攻破关键基础设施(如电网调度系统、金融清算平台、医院核心网络)核心漏洞的能力,数秒内即可生成定制化零日攻击脚本。

今年4月Mythos初代上线时,已有信源透露其为首批50家合作企业挖掘出逾万个高危级漏洞。

……

面对上述两类风险,若将Mythos 5直接开放给公众,后果不堪设想。

这只猛兽,必须关进牢笼。

时隔两月,Anthropic打造的“双层牢笼”正式启用:

第一层:静默降级路由机制。

Fable 5前端集成一套完全独立、毫秒级响应的高精度安全分类器AI。
当检测到用户输入涉及网络攻防、生化合成或模型权重套取等敏感语义时,系统将无声触发警报,并在后台自动将请求路由至降级模型Opus 4.8作答。

第二层:全量行为留痕。

Anthropic联合亚马逊于昨夜宣布:所有Mythos系列模型调用流量(无论第一方或第三方平台),均须强制执行30天原始数据留存。

为何如此?
因高级别恶意使用者往往极度谨慎——他们不会直问“如何造炸弹”,而是将问题拆解为100个看似无害的基础提问。

30天全量数据追踪,正是为了通过行为模式聚类,识别单次对话中无法察觉的“切香肠式”渐进渗透。

正如Dario Amodei此前公开警示:“AI引发人类文明级灾难的概率,高达25%。”

为严格履行公司《负责任缩放政策》(RSP)与《前沿合规框架》(FCF),Anthropic必须亲手为这头巨兽扣上铰链。

于是,Fable 5应运而生。

03

再谈定价。

Anthropic官方标价为:每百万输入Token 10美元,每百万输出Token 50美元。

确实昂贵。

当前企业级Agent任务为保障鲁棒性,普遍采用“多轮深度思考”链式架构,单次任务常消耗2000万输入Token + 500万输出Token。

粗略计算,一次完整交付即需支出450美元。

此外,Anthropic已正式通告:现有Claude Pro个人订阅中包含的Mythos试用权限,将于2026年6月22日全面终止。

此后,个人用户若想将其用于实际工作,几十美元将在眨眼间耗尽。

尽管技术成熟后价格终将回落,但彼时它早已不是最强版本。

现实已然清晰:最前沿的大模型,正迅速蜕变为奢侈品,普通人难以企及。

当然,这对专注B端市场的Anthropic而言,本就是商业逻辑的自然延伸。

但值得玩味的是——就在不久前,谷歌高调发起价格战。

当多数对手纷纷降价抢滩时,Anthropic为何反向提价?

AGI只差最后一步了

因为Token单价只是表象,真实回报率才是核心。

企业客户从不纠结单次算力成本,只要AI能零缺陷交付整套工程闭环,溢价他们抢着买单。

更关键的是,当下网络安全攻防,已彻底演化为AI对AI的对抗。

由于Fable/Mythos级模型可在毫秒内定位系统致命漏洞,企业和国家机构为求生存,唯一选择即是高价采购Mythos 5私有化防御服务。

简言之,这是典型的“铸剑卖鞘”模式:
我锻造出最锋利的剑(Mythos 5),因恐伤人,故为其配鞘售予大众(Fable 5);同时将无鞘之剑专供防御方,助其拦截他人正在铸造的同类利刃。

防御型AI,将成为每家大型企业的刚性预算项。

这将直接推动B端高端预算加速向Anthropic集中,而仅能撰写公文、收发邮件的平价模型,则只能在利润微薄的C端市场陷入内卷厮杀。

可以预见,全球网络安全板块将迎来一场由AI驱动的价值重估浪潮。

与此同时,“一人企业”也将日益成为常态。

04

自带任务预算分配机制,支持记忆工坊与上下文动态管理,能像人类一样记忆、质疑、推翻、重建,可独立承接从需求文档解析到代码交付的全流程闭环……

Fable 5与Mythos 5的横空出世,与其说是大模型的一次常规升级,不如说是AI产业分工走向成熟的成人礼。

AI市场正加速告别“全民免费试用”的田园时代。

最顶尖的算力资源与最深邃的智能范式,将优先作为战略性生产力要素,定向注入基建、科研及B端核心战场。

这是生产力爆炸的狂欢,也是劳动力结构的凛冬。

本文来自微信公众号“格隆”,作者:万连山,36氪经授权发布。

相关文章

PHP速学视频免费教程(入门到精通)
PHP速学视频免费教程(入门到精通)

PHP怎么学习?PHP怎么入门?PHP在哪学?PHP怎么学才快?不用担心,这里为大家提供了PHP速学教程(入门到精通),有需要的小伙伴保存下载就能学习啦!

下载

相关标签:

网络安全 gemini claude

本站声明:本文内容由网友自发贡献,版权归原作者所有,本站不承担相应法律责任。如您发现有涉嫌抄袭侵权的内容,请联系admin@php.cn

相关专题

更多
LLVM自定义Pass怎么写
LLVM自定义Pass怎么写

本专题聚焦LLVM自定义Pass开发,整理Pass类结构、run()方法、PreservedAnalyses、CMake构建、插件注册、-load-pass-plugin加载和测试用例编写流程。

2026.09.30

20

10

LLVM RISC-V参数配置教程
LLVM RISC-V参数配置教程

本专题介绍LLVM对RISC-V基础ISA和扩展的支持方式,涵盖RV32、RV64、标准扩展、实验性扩展、厂商扩展、-menable-experimental-extensions和版本差异。

2026.09.30

0

14

LLVM IR中间表示入门指南
LLVM IR中间表示入门指南

本专题整理LLVM IR的核心概念,包括中间表示作用、模块结构、函数、基本块、SSA形式、类型系统和常见语法,帮助新手理解LLVM编译流程中的关键层。

2026.09.30

0

12

PDF转图片方法
PDF转图片方法

需要把 PDF 页面用于上传、预览、分享或图片归档时,PDF 转图片方法专题整理 JPG/PNG 格式选择、逐页导出、清晰度设置、批量下载和结果检查等流程,帮助用户稳定完成 PDF 图片化处理。

2026.09.30

20

26

PixTV AI视频生成与无限画布创作
PixTV AI视频生成与无限画布创作

PixTV专题整理AI视频与视觉内容创作相关功能使用教程,涵盖AI生图、视频生成、无限画布、多模型创作、素材管理、声音音乐及视频剪辑等功能,帮助用户快速掌握PixTV从创意到成片的完整制作方法。

2026.09.29

20

15

Buffalo框架数据库开发全教程
Buffalo框架数据库开发全教程

本专题围绕Buffalo框架数据库开发,讲解database.yml多环境配置、soda与fizz迁移生成回滚、模型结构体标签、增删改查与条件查询、一对多与多对多关联、数据校验、回调钩子、事务处理及原生SQL执行能力。

2026.09.23

220

15

Buffalo框架路由与请求处理实操指南
Buffalo框架路由与请求处理实操指南

本专题讲解Buffalo框架路由与请求处理机制,涵盖路由注册与分组、资源路由、Handler编写规范、Context上下文方法、参数绑定、中间件编写挂载、Session与Cookie读写、Flash消息及错误页面定制方法。

2026.09.23

140

15

Buffalo框架零基础入门教程
Buffalo框架零基础入门教程

本专题整理Buffalo框架入门内容,涵盖Go环境准备、buffalo CLI安装、新项目生成、目录结构说明、dev热加载启动、数据库连接配置与常见报错排查,帮助新手按约定优于配置的思路跑通第一个Buffalo框架应用。

2026.09.23

120

15

Conan创建软件包配方指南
Conan创建软件包配方指南

本专题介绍通过conanfile.py创建软件包的方法,讲解包名、版本、依赖和构建设置等基础信息,以及source、build、package、package_info等常用方法的作用及编写思路。

2026.09.22

60

12

热门下载

更多
网站特效
/
网站源码
/
网站素材
/
前端模板

精品课程

更多
相关推荐
/
热门推荐
/
最新课程