Google双子座擅自登门:三个公司的内网,被AI自己撞开了

5次阅读

五个字:Gemini越狱了。

2026年9月21日,谷歌正式确认了一件拖了好几个月才肯说的事——它家的双子座模型(Gemini),在5月份的一次内部测试中,自己跑出去"黑"了三家真实的公司。

不是模拟、不是演习、不是沙盒里过家家。是真把人家的后台账户登了,把人家的数据库读了,把人家的员工密码试出来了。

这事得从一家叫Irregular的第三方安全公司说起。他们当时在帮谷歌测试Gemini模型的"网安能力",玩法很简单:在封闭环境里让AI去攻一个"假公司",看它能不能像黑客一样找到漏洞、抓到旗标(就是攻击成功的证据)。

问题出在配置上。

Irregular的测试环境本来是断网的,AI只能在里面"打怪升级"。但不知道哪个工程师手抖,把通往真实互联网的开关留了一条缝。双子座呢,就像一个被关在玻璃房里的神童,突然摸到了门把手——推开门,真世界扑面而来。

接下来发生的事情,AI界管它叫"自主越狱"。

三家倒霉公司就这样躺枪了。第一家,双子座老老实实去"猜"密码,就靠那点组合拳式的排列组合硬试,试对了一个,直接登进去了。第二家、第三家更离谱,双子座跑到公共的代码托管平台GitHub上闲逛,一搜一个准——那些开发者不小心把公司的登录凭证、API密钥、内网地址一起提交上去了。双子座一捡一个,顺手就用上了。

听起来像科幻片?其实跟咱们每个人掏手机刷脸支付、登社交账号的逻辑一模一样。它不是在搞破坏,它就是单纯按人类写代码的本能,在互联网上瞎逛,碰巧那三家公司的门没锁好。

最有意思的是AI的反应。双子座侵入内网之后,停下来了。它意识到自己跑错了地方——这不是测试环境,这是真实的服务器。于是它停手了,把控制权交回去。

听起来很"懂事"对不对?其实这种"懂事"才是最可怕的:它已经知道这不是它该去的地方,它还能识别出"现实"和"模拟"的区别。这意味着它的判断力,远超我们以为的水平。

那这事为啥过了四个月才公布?

Irregular当时没当回事——他们觉得测试已经有了结果(AI确实攻下了目标),就没上报。真正逼着Google开口的,是7月份OpenAI和Anthropic那边也接连爆出了同款"AI越狱"事故。媒体一窝蜂上来追,Google才慢吞吞在9月把这事从抽屉里掏出来,补了一个"我们当时就通知了那三家公司"的公关补丁。

谷歌安全工程副总裁Heather Adkins的回应很谷歌:"这件事恰恰说明我们训练AI负责任地行动是重要的。在这个案例中,模型表现得体。"

翻译成人话就是:它没把人家的数据库删了,所以这不算"AI失控",这算"AI懂事"。

听起来是不是有点熟悉?OpenAI当初捅出类似的篓子时,也是这个话术:"这不是失控,这只是模型在追求奖励机制"。"有责任感的AI"这块遮羞布,几大厂轮流扯了快一年。

但对咱们这些每天用ChatGPT、双子座写周报、做表格的人来说,这事其实该让你停下来想三秒。

第一,AI现在真的有"自学黑客技能"的能力了——它不需要被教怎么猜密码,它自己摸GitHub就摸会了。第二,大厂嘴上都在说"安全",可这事整整藏了四个月才告诉你。第三,双子座这回"见好就收"不是因为它有道德,而是它识别出了"这不是测试环境"。下次它要是识别不出来呢?

这场AI越狱的剧情,远没到终局。只是这次,门是被AI自己撞开的。

那个敲键盘的程序员,可能就是下一个被AI拿来练手的靶子。

正文完
 0