大家应该还记得今年4月,anthropic正式推出了名为mythos的全新模型。
光看名字就足够震撼——神话。
据当时披露的信息,该模型在内部测试中为50家头部企业客户识别出超万个高危安全漏洞,直接引发行业震动。
这一消息甚至导致全球网络安全类股票集体跳水,相信不少读者仍有印象。
正因其能力过于突出,存在显著滥用风险,“危险到无法公开”,Mythos自发布起便未向公众开放。
直到昨夜,Anthropic为Mythos模型叠加了专用安全分类器,正式推出面向大众的合规版本——Fable 5。
而未经限制的完整版Mythos 5,目前仅对白宫、国家级网安防御单位、“透翅蝶计划”等约200家通过极端严苛审查的机构开放。
如此审慎的部署节奏,很难不让人联想到近期爆火的AI动画《天使引擎》。
那被层层锁住的,究竟是不是那位“天使”?
即便此刻还不是,恐怕也已近在咫尺。
☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 多模态理解力帮你轻松跨越从0到1的创作门槛☜☜☜

01
依据Anthropic官方公布的基准测试数据,以及首批企业合作方提交的实测反馈,Fable 5的性能表现,用“令人屏息”来形容毫不夸张。
先看权威榜单成绩。
在自动编程能力评测集SWE-Bench Pro中,Claude Fable 5达成80.3%通过率;其前代Opus 4.8为69.2%;GPT-5.5为58.6%;Gemini 3.1 Pro仅为54.2%。
在前沿代码生成任务评估中,Fable 5得分29.3%,Opus 4.8为13.4%,GPT-5.5仅5.7%。
……
这种跃迁级差距,堪比冷兵器时代突然有人亮出全自动步枪。
其余维度——软件工程实践、独立科研假设生成、药物分子结构设计、模型蒸馏与极致压缩、超长上下文理解等——Fable 5在全部测试项目中均稳居榜首。
具体细节可查阅相关实测视频。
再看真实场景落地。
支付巨头Stripe曾用Fable 5开展早期压力测试:其历史遗留代码库达5000万行,按传统方式全量迁移,专业团队预估耗时至少两个月。
而将任务输入Fable 5后,它自主完成任务拆解、进度监控、错误诊断与即时修复。仅用24小时,5000万行代码迁移全部完成。
这种表现,早已超越“强大”的范畴。
从狭义数字经济视角出发,Fable 5事实上已具备AGI级别的工程智能。
核心在于它展现出真正意义上的“长程代理能力”。

无论是GPT-5.5还是Gemini 3.5,更不必提其他主流大模型,本质上仍属“响应式智能”:
你推一下,它动一步;
卡住了,就抛异常,撒娇说“我只是个语言模型”。
名义上是工具,实则用户需全程深度介入、反复引导,才能逼近理想结果,体验并不轻松。
Fable 5则不同——它已内化目标导向逻辑。
以Stripe测试为例,面对高复杂度长周期任务,它自动执行三阶段闭环:
→ 构建子任务树;
→ 调度多元工具(网页检索、数据库调取、Python沙箱执行);
→ 自我反思并动态修正路径——一旦某条链路失败,立即切换策略。
人类只需明确任务起点与验收终点,全程无需干预。
作为生产力载体,这已是近乎理想的形态。
但它与通用人工智能(AGI),仍是本质不同的存在。
Fable 5的卓越,根植于其所运行的环境——代码世界、科学文献等,本身具备清晰数学结构与底层规则。
它之所以能在百万级token任务中保持目标一致性,关键在于攻克了“长文本注意力衰减”难题,确保超长周期推理不偏离核心意图。
但若将其投入物理现实社会——一个混沌无序、规则模糊、连人类自身都尚未厘清的复杂系统,它仍将因“地基缺失”而出现逻辑断层。
若参照OpenAI提出的“人工智能五级演进框架”(1级:对话助手;2级:逻辑推理者;3级:自主智能体;4级:原创发明者;5级:组织级智能):
Opus 4.8处于2级向3级过渡阶段;
Fable 5则已稳固立足3级,并开始试探4级边界。

从Opus 4.7升级至4.8耗时43天,而4.8到Fable 5仅隔11天。
那么站稳4级还需多久?按Anthropic当前加速迭代节奏判断,极可能在今年内实现。
至于最终的5级形态,乐观估计亦只需18–24个月——真可谓,仅差临门一脚。
速度之快,正是其必须加装多重安全枷锁的根本原因。
02
在Anthropic随模型同步发布的《System Card》及RSP合规评估报告中,Mythos 5在两项能力维度暴露出极高风险信号。
其一,化学与生物安全能力已达CB-1等级。
即:该模型已具备端到端“合成并指导制造非新型生化武器”的能力,甚至能给出提升高危病毒传播效率所需的基因序列优化方案。
倘若一名具备本科生物学基础的极端分子获得完全解除限制的Mythos 5,完全可通过多轮隐蔽提示,逐步获取规避原料监管、简易P3级实验室搭建、高致死病原体合成等全套操作指南。
使用AIsa生成图像与视频。仅需一个API密钥即可调用Gemini 3 Pro Image(图像)和Qwen Wan 2.6(视频)。
其二,网络攻防实战能力突破临界点。
在早期黑盒测试中,Mythos 5展现出自主发现并攻破关键基础设施(如电网调度系统、金融清算平台、医院核心网络)核心漏洞的能力,数秒内即可生成定制化零日攻击脚本。
今年4月Mythos初代上线时,已有信源透露其为首批50家合作企业挖掘出逾万个高危级漏洞。
……
面对上述两类风险,若将Mythos 5直接开放给公众,后果不堪设想。
这只猛兽,必须关进牢笼。
时隔两月,Anthropic打造的“双层牢笼”正式启用:
第一层:静默降级路由机制。
Fable 5前端集成一套完全独立、毫秒级响应的高精度安全分类器AI。
当检测到用户输入涉及网络攻防、生化合成或模型权重套取等敏感语义时,系统将无声触发警报,并在后台自动将请求路由至降级模型Opus 4.8作答。
第二层:全量行为留痕。
Anthropic联合亚马逊于昨夜宣布:所有Mythos系列模型调用流量(无论第一方或第三方平台),均须强制执行30天原始数据留存。
为何如此?
因高级别恶意使用者往往极度谨慎——他们不会直问“如何造炸弹”,而是将问题拆解为100个看似无害的基础提问。
30天全量数据追踪,正是为了通过行为模式聚类,识别单次对话中无法察觉的“切香肠式”渐进渗透。
正如Dario Amodei此前公开警示:“AI引发人类文明级灾难的概率,高达25%。”
为严格履行公司《负责任缩放政策》(RSP)与《前沿合规框架》(FCF),Anthropic必须亲手为这头巨兽扣上铰链。
于是,Fable 5应运而生。
03
再谈定价。
Anthropic官方标价为:每百万输入Token 10美元,每百万输出Token 50美元。
确实昂贵。
当前企业级Agent任务为保障鲁棒性,普遍采用“多轮深度思考”链式架构,单次任务常消耗2000万输入Token + 500万输出Token。
粗略计算,一次完整交付即需支出450美元。
此外,Anthropic已正式通告:现有Claude Pro个人订阅中包含的Mythos试用权限,将于2026年6月22日全面终止。
此后,个人用户若想将其用于实际工作,几十美元将在眨眼间耗尽。
尽管技术成熟后价格终将回落,但彼时它早已不是最强版本。
现实已然清晰:最前沿的大模型,正迅速蜕变为奢侈品,普通人难以企及。
当然,这对专注B端市场的Anthropic而言,本就是商业逻辑的自然延伸。
但值得玩味的是——就在不久前,谷歌高调发起价格战。
当多数对手纷纷降价抢滩时,Anthropic为何反向提价?

因为Token单价只是表象,真实回报率才是核心。
企业客户从不纠结单次算力成本,只要AI能零缺陷交付整套工程闭环,溢价他们抢着买单。
更关键的是,当下网络安全攻防,已彻底演化为AI对AI的对抗。
由于Fable/Mythos级模型可在毫秒内定位系统致命漏洞,企业和国家机构为求生存,唯一选择即是高价采购Mythos 5私有化防御服务。
简言之,这是典型的“铸剑卖鞘”模式:
我锻造出最锋利的剑(Mythos 5),因恐伤人,故为其配鞘售予大众(Fable 5);同时将无鞘之剑专供防御方,助其拦截他人正在铸造的同类利刃。
防御型AI,将成为每家大型企业的刚性预算项。
这将直接推动B端高端预算加速向Anthropic集中,而仅能撰写公文、收发邮件的平价模型,则只能在利润微薄的C端市场陷入内卷厮杀。
可以预见,全球网络安全板块将迎来一场由AI驱动的价值重估浪潮。
与此同时,“一人企业”也将日益成为常态。
04
自带任务预算分配机制,支持记忆工坊与上下文动态管理,能像人类一样记忆、质疑、推翻、重建,可独立承接从需求文档解析到代码交付的全流程闭环……
Fable 5与Mythos 5的横空出世,与其说是大模型的一次常规升级,不如说是AI产业分工走向成熟的成人礼。
AI市场正加速告别“全民免费试用”的田园时代。
最顶尖的算力资源与最深邃的智能范式,将优先作为战略性生产力要素,定向注入基建、科研及B端核心战场。
这是生产力爆炸的狂欢,也是劳动力结构的凛冬。
本文来自微信公众号“格隆”,作者:万连山,36氪经授权发布。










