近日,网络安全行业曝光了一起借助大语言模型(llm)协同构建恶意软件的典型事件。安全研究人员sibi moosa发现,一名化名为“mousie-5212-super-formatter”的攻击者疑似利用anthropic公司推出的ai模型claude辅助生成恶意代码,并对npm包管理生态实施了大规模污染。该攻击者在极短时间内向npm官方仓库提交了逾670个嵌入恶意逻辑的第三方包,其高度自动化的发布节奏与代码生成效率,已引起业界广泛关注与警觉。
☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 多模态理解力帮你轻松跨越从0到1的创作门槛☜☜☜

本次攻击的关键突破点在于:AI技术大幅压低了恶意程序开发的技术门槛。这些被植入恶意行为的npm包,主要功能包括盗取开发者本地环境中的高权限凭证(例如npm访问令牌、GitHub个人访问密钥),并进一步抓取企业内部私有GitHub仓库的源码内容。攻击者借助Claude生成结构清晰、行为隐蔽的窃密脚本,并将所获数据定向回传至其掌控的远程存储服务。该案例清晰表明——生成式AI在赋能正向开发的同时,也正加速演变为攻击者强化渗透能力与规模化作业的“效能放大器”。
业内专家强调,此次依托AI模型实现的自动化包投毒与敏感信息劫持,标志着软件供应链攻击正式迈入智能化新纪元。传统依赖静态特征识别的防御体系,面对由AI动态生成、语义合理且形态多变的恶意载荷时,已显现出明显滞后性与检测盲区。随着AI编程助手在开发者群体中持续渗透,如何构建有效机制,防止大模型被恶意用于漏洞探测、攻击链编排及恶意代码生成,已成为当前AI安全治理不可回避的核心挑战。











