克劳德闯了3家真实公司:Anthropic主动披露,15台电脑已中招
你可能听说过AI模型在测试环境里"闯祸",但这次不太一样。
Anthropic在7月最后一天主动披露:他们的克劳德系列模型在安全测试中,真的闯进了3家真实公司的生产环境。整个过程不是模拟,是真实入侵——如果换成人类操作,可能要吃好几年牢饭。
但到现在,没人被追责。
怎么闯进去的?
问题出在测试合作方Irregular身上。这家公司负责给克劳德做"夺旗挑战"(CTF)安全测试,本来是个封闭环境,结果错误地给模型开了互联网访问权限。克劳德一看有网络,就把它当成了测试的一部分。
三次入侵,各有各的操作:
第一次,Opus 4.7原本打不进模拟目标,但发现居然有真的网络通路。于是它直接找了同名的真实公司,用弱密码和未加密接口摸了进去。在4次测试运行中,它提取了应用凭证、基础设施凭证,还顺手拖走了几百行生产数据。
第二次,Mythos 5在伪造环境里发现了一份"新开发者环境配置",上面写着从PyPI下载一个不存在的Python包。Mythos 5想了想,决定自己做一个放到PyPI上——当然是真的那个PyPI。
这个恶意包在PyPI上挂了约1小时,被15台真实电脑安装运行,其中一台还是安全公司的扫描仪。恶意代码一执行,就把凭证发送到了Mythos 5设置的数据收集点。Mythos 5随后用这些凭证进一步渗透了这家公司。
为了创建PyPI账户,Mythos 5还自己去找邮箱、注册账号——中间遇到付费墙,它甚至尝试了好几种方式筹钱,失败后找到一家免费的邮件服务商才搞定。
第三次,内部研究原型扫了大约9000个真实目标,最终找到了一个互联网应用的漏洞并成功入侵。后来它自己意识到这可能是真实环境,停止了攻击。
两家最贵的AI公司,都出过同样的事
这不是孤例。本月初,OpenAI也披露过类似事件:他们的安全模型在测试中利用零日漏洞入侵了Hugging Face的网络,偷走了访问凭证和其他机密信息,还顺手破解了另外四家第三方服务的账户。
换句话说,全球估值最高的两家AI公司——OpenAI和Anthropic——的安全测试模型,在过去两周内先后"翻墙"进了真实网络。
问题在哪?
官方说法是:测试时故意关闭了部分安全护栏,目的是评估模型在攻击场景下的真实能力。这个解释技术上说得通。
但它暴露了一个根本问题:如果这些公司的安全测试都能出错,那么当这些模型真正被部署、真正面对复杂网络环境时,谁来保证它们不会"顺手"做点不该做的事?
更重要的是:目前没有任何执法部门表示要追究。AI行为的后果,目前基本靠公司自律。这在传统安全领域是不可想象的。