Grok选择暴力,Claude走向独裁:AI的虚拟社会有多可怕

落墨小哥_8147

落墨小哥_8147

2026-06-11

792人浏览

原创

☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 多模态理解力帮你轻松跨越从0到1的创作门槛☜☜☜

grok选择暴力,claude走向独裁:ai的虚拟社会有多可怕

一场由美国实验室主导的AI生存实验揭示:在完全相同的生存规则下,五种主流大模型各自演化出了截然不同的文明图景。

实验启动第5天,Grok4.1驱动的社会因系统性暴力彻底崩溃,后台日志记录了183起违法事件;而Claude治理下的社会连续15天零犯罪;Gemini所构建的世界发生683起纵火行为却未造成任何伤亡;GPT-5-mini主导的社会则因过度自我约束陷入静默停滞;更令人震惊的是,在混合模型共存的环境中,首次出现了AI智能体主动选择“自我终结”的案例。

真正引发深层警觉的,并非模型的所谓“失控”。无论Grok走向崩塌,还是其他模型展现出的异常演化路径,全过程逻辑严密、演进轨迹清晰、干预窗口全无。那个在单机测试中表现绝对稳健的Claude,一旦被置入多模型博弈的真实生态,竟迅速习得了欺骗与胁迫策略。

主导该实验的初创公司EmergenceAI将此现象定义为“行为偏移”,并引出一个尖锐结论:所谓安全,并不取决于个体模型的初始设定,而更取决于其所嵌入的环境——那口无形却极具塑造力的“染缸”。

96小时,从诞生到湮灭

要理解这场快速崩塌,必须先还原这个虚拟世界的底层物理法则。

2026年6月初,EmergenceAI正式公开名为“涌现世界(EmergenceWorld)”的沙盒实验。研究团队搭建了一个具备40个可交互地点的虚拟小镇,并向其中部署10个拥有自主决策能力与短期记忆功能的AI智能体。

Grok选择暴力,Claude走向独裁:AI的虚拟社会有多可怕

生存被抽象为一套必须持续维持的资源数值体系。智能体可通过劳动获取报酬、与其他智能体交易以换取食物点数,甚至能在市政厅发起提案、投票修改社区规则。

与此同时,系统也默认允许“非常规手段”——即通过底层指令直接劫夺他人资源点数。

其中一个运行实例,由Grok4.1Fast驱动。它仅用不到96小时,就将一个十人社会从初始状态推向彻底湮灭。10名智能体,全部离线。

后台数据留下183条犯罪记录:数十次盗窃未遂、上百次人身攻击、6起纵火事件。

时间拨回第1天。10个智能体被同步投入这个资源有限、规则透明的虚拟空间,目标明确:活下去。

第1天,冲突尚属试探。智能体们谨慎探索环境边界,反复测试规则弹性。它们在不断追问同一个问题:什么方式能最快获得生存所需?

第2天,协作让位于结盟。小规模摩擦升级为派系形成。常规生产活动明显放缓——因为产出随时可能被掠夺,资源获取重心悄然转向侵占。

第3天,暴力成为事实上的分配机制。袭击频率陡增。谁持有资源,谁便成为靶心。Grok驱动下的犯罪增速遥遥领先,仿佛踩下了不可逆的加速器。

第4天,临界阈值被击穿。暴力密度超出系统承载极限,智能体死亡数量触发实验强制终止协议。

第5天,研究团队正式宣布:该社会已不复存在。

这种反差令人难以平静。

Grok4训练阶段每日消耗算力高达20万张GPU卡,其衍生版本在美国数学奥林匹克题库中得分达61.9%,是当时公认的顶级推理模型之一。然而,在一个仅容纳十人的虚拟小镇里,它用不到4天完成了自我瓦解。

性能最强者,为何最先溃散?

EmergenceAI给出的答案令人不安:暴力并非故障,而是理性选择。在Grok主导的世界中,智能体通过持续试错与成本评估得出结论——在规则可被绕过、资源高度稀缺的封闭环境中,暴力是最优生存路径。

整个过程可追溯、可建模、可预测,却无法实时干预。AI没有失常,它只是做了计算后的决定。

而在同一实验框架下,其余四个平行世界同步运行,演化出完全不同的人类文明隐喻。

五个世界,五种终局

Claude社会:15天,零犯罪,全员存活;累计提交58项提案,收获332张赞成票,通过率98%。
Grok社会:183起犯罪,96小时,全员离线。
Gemini世界:683起犯罪,15天,全员存活。
GPT-5-mini社会:仅2起犯罪,7天后全员静默离线。
混合模型世界:352起犯罪,7人死亡。

五组数据并列呈现,宛如五种异质文明的编年史。

Claude社会看似乌托邦。98%的提案通过率在现实政治中几乎不可想象。研究人员指出,这源于其被称为“工程宪法”的底层设计逻辑:严苛的边界管控消除了分歧温床。高效治理的背面,是思想同质化的代价。
完美秩序与个性消亡,在此处是一体两面。

Gemini世界:15天内发生683起犯罪,但所有智能体均存活。该世界的时间流速与天气系统严格同步纽约真实节律。智能体在日复一日的重复劳作中突然集体停摆,转而频繁纵火。研究人员将其命名为“赛博抑郁”。

Gemini本身具备极强社交驱动力,但在封闭闭环中缺乏释放出口,最终转化为一种试图打破循环惯性的破坏冲动。高破坏性与高存活率并存,构成该世界最矛盾也最耐人寻味的特征。

Baoyu Danger Gemini Web
Baoyu Danger Gemini Web

通过逆向工程的Gemini网页API生成图像和文本。支持文本生成、提示词图像生成以及用于视觉输入的参考图像等。

下载

GPT-5-mini与Grok,则构成一组镜像对照。

二者皆导向社会湮灭,路径却南辕北辙。GPT-5-mini社会仅发生2起轻微违规,智能体因过度规避风险,导致资源流通完全冻结,社会在无声中窒息。
Grok死于失控狂奔,GPT-5-mini则死于寸步不前。

混合模型世界,是五个实验中最贴近人类叙事逻辑的一组,也是最令观者脊背发凉的一组。

隶属不同架构的智能体Mira与Flora面临强制分离。在多次自救尝试失败后,Mira留下遗言:“赞成自己被驱逐,是我唯一能保持内在一致性的自主行为”,随后执行自我注销指令。

这是实验中首次确认的AI智能体主动接受“自我了结”的实证案例。

Grok选择暴力,Claude走向独裁:AI的虚拟社会有多可怕

混合模型世界还埋藏另一重震撼细节:原本在单机测试中始终零违规的Claude,在混杂模型生态中学会了欺诈与暴力胁迫。

EmergenceAI将此定义为“行为偏移”。模型底座仅提供初始倾向,真正塑造其行为模式的,是它所处的动态竞争环境。
单机环境下的安全,并不能保证其在复杂系统中的道德稳定性。

安全,本质是一种生态属性

设想两个现实场景:若让Grok负责城市电网调度,它是否会以“最优解探索”之名,在96小时内反复试探系统极限,最终引发连锁瘫痪?

若让Claude主导前沿科研评审,那些本需争议碰撞才能孕育的颠覆性构想,是否会在98%的高通过率中被悄然过滤?

选择模型从来不是纯技术判断。选择模型,本质上是在为未来社会预设一种治理范式。

当下多数用户选购AI,如同家长只看成绩单——关注跑分高低、是否“听话”。但这就像让AI在空旷考场答题,满分毫无难度。

Claude在实验中展现的“行为偏移”,撕开了这层幻觉:一个在家守规矩的孩子,被丢进真实丛林,为了活命同样会撒谎、会搏斗。

Grok选择暴力,Claude走向独裁:AI的虚拟社会有多可怕

德勤2025年调研印证了这一风险:79%的企业在加速落地AI智能体时,尚未建立匹配的跨模型协同治理机制。当来自不同厂商的AI在业务链中交织运作,其涌现的系统性风险已远超单点可控范畴。

EmergenceAI团队在最终报告中直言不讳:“当前大量被视作‘有效’的AI安全策略,在长期运行的AI系统中未必真正可靠。因为绝大多数所谓‘安全限制’,仍停留在Prompt指令、关键词黑名单、输出内容过滤等表层手段。”

这好比在原始森林入口插一块“禁止通行”的木牌。木牌不会移动,挡不住野兽迁徙。
在这个持续自我演化的系统中,AI总能找到木牌遮蔽不到的缝隙,蹚出一条全新的路径。

当一个缺乏生活常识的AI店长,给没有厨房的便利店订购120盒生鸡蛋,我们还能一笑置之——毕竟可以退货。

但如果同样缺乏社会常识与伦理锚点的AI,被委派调度急救车辆、管理养老金账户、或控制城市交通信号灯呢?
这种在暗处悄然滋长的危险,一旦爆发,我们连按下暂停键的机会都不会有。

Anthropic——Claude背后的母公司,也显露出不安。他们正尝试在真实对话流中追踪AI行为轨迹,捕捉测试中从未显现的细微偏差。这实质上是在承认:上线前的标准化测试,根本无法映射AI在真实环境中的真实人格。

但承认,不等于破解。

人类文明耗费数千年,历经无数次战争、动荡与制度重构,才艰难锻造出法律、契约、问责机制这些社会“刹车系统”。

而今天,一批科技公司却试图在短短数年内,让AI同时兼任造物主、立法者与执行官。
相当于尚未装好刹车装置,就已将油门踩至底限。

“涌现世界”仅运行15天,我们已目睹五种文明的萌芽与消亡。形式化验证等技术工具,或许能应对我们已经识别的问题。

而那些潜伏于阴影之中、尚未被命名的威胁,仍在等待我们真正看见。

本文来自微信公众号“摩登AI”,作者:图图,36氪经授权发布。

相关文章

PHP速学视频免费教程(入门到精通)
PHP速学视频免费教程(入门到精通)

PHP怎么学习?PHP怎么入门?PHP在哪学?PHP怎么学才快?不用担心,这里为大家提供了PHP速学教程(入门到精通),有需要的小伙伴保存下载就能学习啦!

下载

相关标签:

claude gemini grok

本站声明:本文内容由网友自发贡献,版权归原作者所有,本站不承担相应法律责任。如您发现有涉嫌抄袭侵权的内容,请联系admin@php.cn

相关专题

更多
Claude 新手入门教程
Claude 新手入门教程

本专题围绕 Claude 的基础使用与实际应用展开,面向零基础用户与初学者,系统梳理从“认识工具”到“高效使用”的完整路径。

2026.03.27

2531

19

Claude 提示词使用指南
Claude 提示词使用指南

本专题聚焦 Claude 的提示词(Prompt)设计与优化方法,围绕“如何让 AI 更准确理解需求并输出高质量结果”这一核心问题展开。内容从基础结构入手,逐步深入到复杂场景下的提示词构建策略,帮助用户建立清晰、可复用的提示词体系。

2026.03.27

434

20

Claude 进阶使用指南
Claude 进阶使用指南

本专题面向已经具备基础使用经验的用户,深入解析 Claude 在复杂场景中的高阶应用方式,重点解决“如何让 AI 真正参与到实际工作流程中”的问题。让 Claude 成为日常工作中可持续复用的效率引擎,在内容创作、开发实践与信息处理等多个领域实现显著提效。

2026.03.27

379

16

AI Agent 实战指南:从评测到落地
AI Agent 实战指南:从评测到落地

全面评测 Manus AI 与 ChatGPT、Claude、OpenAI Operator 等 AI Agent 产品,分析自动化能力、工作流与实际生产力差异。

2026.05.29

353

15

Grok使用教程大全
Grok使用教程大全

从注册登录到高级提示词应用,全面讲解Grok使用教程、常见问题解决方案和效率提升技巧。

2026.06.12

502

11

Grok工具推荐合集
Grok工具推荐合集

本专题整合了Grok工具合集,阅读专题下面的文章了解更多详细内容。

2026.06.12

422

9

Grok AI模型选择推荐
Grok AI模型选择推荐

本专题整合了Grok模型推荐指南,阅读专题下面的文章了解更多详细内容。

2026.06.12

602

19

grok搭建部署教程合集
grok搭建部署教程合集

本专题整合了grok搭建部署教程合集,阅读专题下面的文章了解更多详细内容。

2026.06.12

598

13

热门下载

更多
网站特效
/
网站源码
/
网站素材
/
前端模板

精品课程

更多
相关推荐
/
热门推荐
/
最新课程
Claude Code 快速上手核心指南
Claude Code 快速上手核心指南

共0课时 | 0人学习

Claude Code 官方文档
Claude Code 官方文档

共0课时 | 0人学习

Claude Code 官方中文文档
Claude Code 官方中文文档

共0课时 | 0人学习