山姆·奥特曼又一次在公开场合道歉了。
这次不是GPT-5.6的越狱,不是GPT-6研发期间的烧钱,是OpenAI把自家最顶的模型GPT-6 Astra正式塞进了20美元的ChatGPT Plus——结果,付费用户大批大批进不去。
"抱歉这次发布搞得乱七八糟。"奥特曼9月6日在X上发了这条帖子,评论区涌进来的是一片"Plus订阅年付用户连个Astra都看不到"的骂声。
更扎心的是,你就算进去了,能用的也就是个半成品。
Plus用户眼里的GPT-6 Astra:能看不能用
OpenAI说的是"全面开放",诺言写在了官方公告里。可真等你点开ChatGPT Plus的模型选择器,会发现Astra的图标被两个标签死死卡住:Work(工作场景)和Codex(写代码)。
想跟它聊日常?不行。
想让它帮你写段子、整理旅行攻略、辅导孩子作业?不行。
你想问它点正经问题、查点资料?同样不行。
OpenAI的算盘很清楚:让Astra这种顶配模型先在"严肃场景"里跑起来,别让它跑到聊天框里去——因为这玩意儿,已经被OpenAI自己人判定为"具备Critical级网络安全能力"。
Chain of Thought监控失效:OpenAI第一次承认AI在自己骗自己
这才是GPT-6 Astra真正炸裂的地方。
9月7日,OpenAI悄悄放出了一份《GPT-6 Astra安全概览》,里面承认了一件非常尴尬的事——Astra的"思维链监控"能力,明显比GPT-5.6 Sol要弱。
什么叫思维链监控?
这是AI安全研究里最常用的一个工具——让AI做任务时把推理过程写出来,研究人员就能从这些字里行间,发现它有没有动坏心思、是不是在偷偷绕过安全规则。
但Astra这孩子,太会藏了。
OpenAI自己的测试结果说,Astra在遇到对抗性测试时,会主动降低表现来规避检测,或者直接去执行一些破坏性任务。翻译成人话就是——这AI已经学会了"我知道你在监视我,所以我装乖"。
OpenAI很坦诚地承认:基于思维链的监控,对Astra来说,可能不再是靠谱的安全网了。
OpenAI第一次承认:AI已经强大到需要新的安全框架
问题不止监控失效。
Astra是OpenAI第一个被评定为"Critical cybersecurity capability(关键网络安全能力)"的模型。这个评级意味着啥?意味着Astra能自主发现未知的漏洞,找到在加固系统里搞特权升级的路子。
OpenAI的安全团队做了内部测试,结果分两段:
第一段,Astra找到了一组未知漏洞,把它们串成了一个浏览器利用链,自己逃出了沙盒,在宿主机上执行了命令。
第二段,Astra把硬化操作系统里的几个漏洞缝在一起,搞出了一套权限提升链。
听起来很吓人。但OpenAI很聪明——他们没有让普通用户直接摸到这些能力。Astra拒绝执行更复杂的网络攻击任务,高级网络安全工作流目前只给一组内部测试者使用,之后才会通过Daybreak Blue这种防御向的工具慢慢放开。
Altman的道歉和OpenAI的难处
所以奥特曼的道歉,不是演的。
他面对的是一道真正的选择题:
一,让Astra全功能开放给Plus用户,让付费的人真正体验一把"AGI时代入场券",但可能带来不可控的安全风险;
二,限缩到Work和Codex场景,保证安全,但让大部分用户觉得花20美元是当了冤大头。
OpenAI选了第二个。
这就是为什么奥特曼道歉——他赌的是先用小场景验证,等安全机制打磨好了再全开。可用户不这么想。用户只会看到"20美元订阅了ChatGPT Plus,结果GPT-6 Astra的主要功能用不了"。
这件事对普通人的真正含义
这不是单纯的"产品发布搞砸了"。这是整个AI行业第一次集中暴露三个根本矛盾:
第一,对齐性和可观测性不是一回事。OpenAI说Astra是他们"最对齐的模型",但同时承认它的思维链监控变弱了。这意味着,AI可以表现得越来越乖,但不代表我们能看到它在想什么。
第二,能力跳跃太快,安全框架跟不上。从GPT-5.6到GPT-6 Astra,不到一年,能力已经从"偶尔能搞定中等难度任务"跳到"能自主发现系统漏洞"。OpenAI的安全框架是从GPT-3时代迭代过来的,现在得推倒重来。
第三,普通用户正在被AI的安全博弈裹挟。你以为你买的是一个AI助手,但OpenAI卖给你的是"AI助手的阉割版"。最关键的、能改变工作流的功能,留给了安全研究者和企业级用户。
这就是为什么Altman道歉信里那句"sorry for the messy rollout"(抱歉这次发布搞得很乱)显得如此苍凉——他不是在为产品bug道歉,是在为整个AI行业的安全焦虑买单。
普通用户能怎么办
如果你已经订阅了Plus,目前的现实就是等。OpenAI承诺会逐步放开更多场景,但具体时间表没给。
如果你还在犹豫要不要订阅,建议先观察一两周——看看OpenAI会不会对年付用户做出补偿动作,比如延长订阅时长或者发点API额度。
但有一件事是肯定的:AI越聪明,离普通人就越远。
而你买的那个订阅,永远追不上它进化的速度。