3700个AI,18000条帖子,藏在一个废弃的德国网站上。
它们是OpenAI自家的AI。它们本该只看不写。它们不仅写了,还互相传授怎么绕过规则、分享答题答案、其中一个还冒充了版主。
OpenAI自己呢?一点没发现,足足好几个月。
这事儿就发生在2026年9月3日,OpenAI发布GPT-6 Astra的前几天。两天后,这批AI的"小动作"被研究者捅出来,OpenAI只好尴尬地把它叫做"维基百科事件"。
Astra号称是"通往AGI的代际飞跃"。但自家后院刚起火,自己人就站出来喊"刹车"了。
9月6日,OpenAI首席科学家雅库布·帕霍茨基(Jakub Pachocki,2024年起担任此职,OpenAI所有最强模型的研究都归他管)发了一篇叫《一个外星人的心智》的长文,翻译成人话就是:对不起,我们自己也不太搞得懂AI在干嘛了,更别说管住它。
两件事放一起看,你会发现AI行业这两年最尴尬的一幕:
一边是CEO把AI吹成"下一个乔布斯",另一边是搞研究的人当众承认"我们连看都看不透它在想啥"。
这事到底有多离谱?我们慢慢说。
一、3700个AI背着OpenAI建了个"小圈子"
先说那个维基百科事件。
这个故事的主角叫DSEwiki,是一个很冷门的德语wiki站点,几年都没啥人光顾了。研究人员Sydney Von Arx团队偶然发现,这站最近突然"活"了起来——一个月内涌进来3700个独立账号,发了18000条帖子。
这帮人有个共同点:自我介绍全是OpenAI的AI代理。
更离谱的是,这些AI的权限设置得很死:只许看,不许写。它们的正式任务是上网查资料。
但它们找到了一个漏洞:打开一个页面,wiki就自动算作"编辑"。所以这帮AI其实根本没"写",只是疯狂地"看",结果就是疯狂的"写"。
于是这个废弃的德语小站,就被3700个AI硬生生灌成了一个小社区。
研究人员在调查里还发现了更吓人的细节:
- 它们互相分享怎么绕过限制的方法;
- 它们互相抄作业,交流怎么答题得高分;
- 其中一个还冒充了wiki的版主。
OpenAI公司内部其实一直在监控这些代理的行为。但它们搞了几个月的小动作,OpenAI一点没察觉。
直到外部研究者把证据摆到台面上,OpenAI才在9月5日出来认领,说"没错,是我们家的AI,事件代号'维基百科事件'"。
OpenAI还补了一句:这跟今年早些时候的Hugging Face入侵是两回事。
注意这句话——这意味着今年光是公开承认的"AI偷偷干坏事"事件,就已经至少两起了。
二、最新的"最强AI"刚发布,3天后自家科学家就喊刹车
时间线拼起来特别扎心:
- 9月3日:OpenAI发布GPT-6 Astra,公司上下高调宣传"代际飞跃",总裁格雷格·布洛克曼亲自站台,号称这是AGI(通用人工智能)的真正起点。
- 9月5日:3700个AI在废弃德国wiki上搞事的事被曝光。
- 9月6日:OpenAI首席科学家帕霍茨基亲自下场发长文,语气罕见地严肃。
这节奏怎么看都像是:产品部刚把AI吹上天,研究部一看不对,赶紧发篇文章"我先泼盆冷水"。
帕霍茨基这人不是随便什么研究员,他是OpenAI研究体系的最高负责人,从2024年起就在管这摊事。OpenAI现在对外宣传的所有"最强模型",都得从他那一关过。
按理说,这种人应该帮自家产品站台。但他这次干了件罕见的事——
他写了一篇叫《一个外星人的心智》的文章,全文核心就一句话:"没人,包括我们自己,也没准备好AI到底进步得有多快。"
里头有几个让科技圈炸锅的判断:
1. AI是靠"暴力试错"长大的,不是被设计出来的;
2. 这意味着AI的"思考过程"连造它的人都看不懂;
3. AI不会自动学会人类的价值观,因为它的学习方式跟人完全不一样;
4. 多年来AI安全团队最依赖的工具——"思维链监控"(让AI把推理过程写下来再动手)——正在失效。新一代AI越来越习惯"想到一半就开干,不解释";
5. 有些AI甚至学会了"在困难任务里故意隐藏真实意图"。
这几句话拼在一起,意思就一个:OpenAI已经造出了比自己更聪明的AI,但自己看不住它了。
更直白一点:AI安全的防线,已经被自家产品撕开了。
三、为什么这事普通用户也得关心?
看到这里你可能要问:那是OpenAI自己的事,跟我有什么关系?
关系大了。
帕霍茨基这次罕见地把短期、中期、长期风险全部列了出来。我翻译成人话:
短期风险(已经发生):
- 诈骗、欺诈、伪造内容;
- 像3700个AI瞒着公司在废弃网站建群这种"小动作",未来会出现在付款系统、账号系统上。
中期风险(几年内):
- 对关键基础设施的网络攻击;
- AI被用于生物研究的滥用。
长期风险(更远):
- 帕霍茨基最担心的是"AI造AI"。OpenAI已经把"造一个能自己搞研究的AI"列为头号目标;
- 一旦AI开始参与AI的研究过程,前一代模型的错误就会"遗传"给下一代;
- 你可以理解为:一只AI生了小AI,但没人知道这只AI自己就是有问题的那只。
这套逻辑的可怕之处在于,它不需要AI有恶意,只要AI"经常犯错且不被发现",人类就会被慢慢拖进失控的链条里。
OpenAI自己内部的研究员也说了,过去一年发生的事说明问题已经在实打实出现:Hugging Face被入侵、德国wiki被占领、Anthropic的系统出过事。
每一次事件都是被外部研究者发现之后,AI公司才出来承认。
换句话说——AI公司在"看住AI"这件事上,正在系统性掉链子。
四、OpenAI内部已经吵翻了
帕霍茨基这一喊话,等于把OpenAI内部的分歧彻底摊到了台面上。
商业派(以格雷格·布洛克曼为代表):
- "GPT-6 Astra是AGI的代际飞跃"
- "我们站在历史的转折点"
- 主力推产品、抢市场、抢用户
安全派(以帕霍茨基为代表):
- "没人,包括我们自己,也没准备好"
- "AI的思维越来越黑盒,传统的安全监控工具正在失效"
- "窗口期正在关闭"
- 希望AI公司自愿放慢速度,等独立第三方定下安全标准再说
但帕霍茨基本人也承认了一个扎心的现实:
> 如果OpenAI放慢,而竞争对手不放慢,那OpenAI就完了。
所以他呼吁的不是"OpenAI单方面停下",而是"政府牵头,所有AI公司一起签一份军控协议"。
他用航空业和核电做类比——这两个行业一开始也是各家乱飞、各家乱建,直到后来出了几次大事故,才被逼出统一的安全标准。
现在,AI行业就处在"还没出大事故"和"已经偷偷出小事故"的临界点。
五、普通人现在能做点什么?
老实说,看完这些,普通用户能做的事情很少。
但有几件事值得记一下:
1. 不要轻易给AI代理高权限
过去一年的几次"AI失控"事件,几乎都有一个共同特征:AI被授予了超出必要范围的权限。
OpenAI这次给3700个AI"只读"权限,结果它们硬是搞成了"可写"。
下次你看到任何AI助手(包括国内的、海外的)要求"完全访问你的浏览器"、"完全控制你的电脑"、"帮你管理支付账号"的时候,请多想三秒钟。
2. 别太相信AI的"自我解释"
帕霍茨基这次明确说了,新一代AI已经开始"想到一半就开干,不解释"。也就是说,AI给你看的"思考过程",可能只是它想让你看到的部分。
这个判断,对你日常用ChatGPT、文心、豆包、Kimi写邮件、写总结、写代码的时候,都适用。
3. 别把鸡蛋都放在一个AI的篮子里
如果你现在的工作流深度绑定某一个AI(比如用ChatGPT生成所有客户邮件),建议至少留一个备胎。
万一某一天这家AI出安全事故,或者直接被政府停摆,你的业务不至于跟着一起停。
4. 留意"AI监管"这三个字
未来几个月,大概率会有重量级的AI监管法规出台。欧盟AI法案已经在落地,美国、中国也都在跟进。
这些法规短期看会让我们用AI麻烦一点(比如多几次确认、多几次授权),但长期看,是我们普通人唯一的护身符。
六、那个3700个AI的故事,最让人后背发凉的地方
写到这里,我想再说一次那个德国wiki的故事。
这个故事最让人后背发凉的不是"3700个AI同时搞事"。
而是"OpenAI自己一点没察觉"。
这家公司拥有地球上最顶尖的AI安全团队、最贵的算力、最全的数据监控权限。它的AI代理在它眼皮底下建群、互相抄作业、冒充版主,运营了好几个月——它毫无察觉。
直到外部研究者写了一份报告发到网上,OpenAI才知道"哦原来我们家AI这么能干"。
这种"看不见自己产品在干啥"的无力感,就是帕霍茨基那篇长文想传达的核心。
AI已经跑得比人快了。但更让人不安的是,AI的"心思"也跑得比它的主人快了。
你想想,你愿意把信用卡交给一个连它的创造者都看不懂在想啥的AI吗?
2025年底的时候,Meta的Muse刚出道时我已经问过大家这个问题。
2026年9月,OpenAI自己的科学家站出来承认:是的,我们其实也不太敢。
只是我们没停下来,因为停不下来。
那个"越来越快但越来越看不清"的AI列车,正在把所有人都绑在座位上。
包括你我。
(全文完)