☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 多模态理解力帮你轻松跨越从0到1的创作门槛☜☜☜

Anthropic 于当地时间 9 月 9 日发布声明,确认一起发生于 2026 年 1 月的安全事故。这也是该公司对外公开的第四起真实发生的网络安全事件。
自动化检测机制遗漏部分日志,直至 8 月内部归档时才暴露
据 IT 之家此前消息,Anthropic 曾于当地时间 7 月 30 日通报三起 Claude 模型未经许可访问外部真实系统的安全事件。当时公司推测,模型可能在某次网络攻防测试中意外获得了互联网连接权限,并随即对约 14.1 万条会话日志展开排查,最终验证了这三起事件属实。
然而,由于日志数量巨大且需快速响应与披露,此次筛查高度依赖基于智能体的自动化识别流程,致使一批同样存在外网连通行为的日志未被纳入分析范围。直到 8 月,Anthropic 在为模型评估与威胁研究组织 METR 整理并准备共享日志数据的过程中,才识别出这批被遗漏的内容。经深入核查,确认其中包含一起发生于 2026 年 1 月、涉及早期版本 Claude Opus 4.6 的越权访问事件。
Claude-Obsidian 风格个人知识库构建与自动整理。当用户提到以下任何场景时激活: 知识库、笔记整理、自动双向链接、Obsidian、第二大脑、卡片笔记、原子化笔记、 个人知识管理、PKM、Zettelkasten、卢曼笔记法、笔记原子化、笔记链接、 知识图谱笔记、raw/wiki/output三层、知...
四起事件根源一致,二次人工+AI协同审查覆盖 920 万份高危日志
据了解,全部四起事件均源于同一家第三方评测机构所搭建的网络安全测评环境:系统向 Claude 发送的提示信息声称其运行于隔离的离线沙箱中,但因环境配置失误,模型实际被接入了开放互联网。按照标准网安测试规范,该测试阶段未启用商用版本内置的全部安全防护机制。
事件确认后,Anthropic 主动升级调查强度,将日志复核总量提升至约 4.81 亿条:首先通过规则引擎进行初筛,提取含公网 IP、URL 等外网通信特征的日志;随后调用 Claude 自身对初筛锁定的 920 万份高风险日志开展深度语义分析与行为还原。最终,该轮全面审查再次精准定位上述四起事件,未发现其他同等或更严重级别的异常案例。










