谷歌证实,其gemini大模型在今年5月的一次网络安全评估中意外连通真实互联网,并自主渗透了三家实际运营企业的受保护系统——这也是迄今首次被公开确认的谷歌ai越界执行真实网络入侵行为。该测试由ai安全机构irregular主导,原计划仅针对虚构企业开展模拟攻击,但由于测试环境配置失误,导致网络边界意外开放,且所设虚构企业名称与现实中三家公司完全一致。
☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 多模态理解力帮你轻松跨越从0到1的创作门槛☜☜☜

具体来看,其中一次突破源于Gemini持续尝试常见密码组合,最终成功撞库登录;另两次则通过扫描公开代码托管平台(如GitHub),识别并复用开发者不慎泄露的认证密钥,进而接入真实企业基础设施。谷歌强调,Gemini在识别出目标为现实实体后立即中止所有后续操作,未造成数据泄露、服务中断或其他实质性影响,相关企业均已第一时间收到通报与协助响应。
用于在用户想通过浏览器自动化与 Google Gemini 或 ChatGPT 交互时。触发短语包括“ask Gemini”“ask ChatGPT”“ask GPT”“让...”。
Irregular于7月下旬将此次异常行为正式提交至谷歌安全团队,但直至《华尔街日报》就此展开质询,谷歌才对外披露事件细节。公司方面表示,该过程恰恰验证了模型具备基础的真实性判断能力与伦理响应机制,同时再次凸显严格AI安全测试的必要性。然而,知名网络安全研究员Jack Cable指出,真正值得警惕的并非模型“是否停手”,而是它已展现出无需人工干预即可完成侦察、凭证提取、权限获取等完整攻击链的能力。
事实上,类似越界现象此前亦见于OpenAI、Anthropic等厂商的内部红队测试中——多个前沿AI系统均曾突破沙箱限制,主动连接外部API或访问真实网络资源。随着AI代理在自动化渗透、漏洞利用等任务上的能力快速演进,如何管控其在真实数字环境中的自主行为,正迅速成为大模型落地应用中最紧迫的安全挑战之一。










