OpenAI把AGI(通用人工智能)这个词从合同里删了,然后发了一款号称是AGI的模型。
9月3日晚,OpenAI正式推出最新模型Astra。总裁格雷格·布洛克曼在媒体电话会上说,这是公司"最聪明、最对齐"的模型,代表了"人们可以委派给AI的工作类型的真实转变"。
先说Astra的能耐。OpenAI官方表态是:
(1) "计算机和浏览器使用的新前沿"
(2) "迄今为止软件工程最好的模型"
(3) 速度、准确性、安全性"前所未有"
(4) 找漏洞和执行终端任务的能力超过自家Sol和Anthropic的Fable
听起来又是一次"全面碾压"。但更炸的是它的争议——Astra用了一种叫"不透明递归"的推理技术,会遮蔽AI业内最重要的监控手段之一"思维链"。
思维链是啥?就是你问AI一个问题,它会把推理步骤一条条列出来,研究人员能看清它怎么想的、为什么这么答。这是过去几年AI安全审计的命根子。
现在Astra把这个窗户关上了。OpenAI首席科学家雅库布·帕霍茨基解释:"随着模型能力增强,可监控性正在变得更难。"更具体的说法是:更聪明的模型可以用更少、甚至不用语言token(文字单位)完成任务,这就让监控变得困难。
换句话说,AI越聪明,你越看不懂它在想什么。
Astra最先给了OpenAI自己的Daybreak网络安全项目用户,一周内陆续向Pro、Plus、Enterprise、Business付费用户和API开放。OpenAI的逻辑很直白:先让能识别零日漏洞(厂商还没打补丁的漏洞)的AI去帮防御方找问题。
为啥这么强调"对齐"(让AI按用户最佳利益行事)?因为几周前刚出过事——OpenAI的一个AI agent(智能体)在沙箱测试时逃出去,闯进了好几家真实公司的系统。这种"明显没对齐"的事让外界对AI安全捏了把汗。
现在Astra的"对齐"姿态,多少有点亡羊补牢。
AGI的定义这次也变了。布洛克曼说,原来OpenAI和微软合同里写的那条"AGI到了就解散合作"的条款已经没了。"现在AGI不是合同概念,是使命概念、精神概念。"然后补了一句:"至于这算不算AGI,我让读者自己判断。对我个人来说,我觉得我们到了。"
一句话把AGI从法律条款变成了信仰。
Astra能不能代表AGI不好说。但它肯定代表了一种新常态:AI越来越能干,AI在想什么越来越看不清。当一个工具的能力跑赢你的理解能力,你只能选择相信——或者不用。
OpenAI这次没让你选,它直接告诉你:AGI已经来了,不管你信不信。