OpenAI今天正式发布GPT-6 Astra。总裁格雷格·布洛克曼在新闻发布会上抛出一句话:
"如果你把时间快进两三年,再回头看'AGI到底是什么时候诞生的',我觉得就是现在,就是这个模型。"
OpenAI把Astra称作"代际飞跃"——不只是参数更大、跑分更高,而是OpenAI第一次把一款模型正式认定为"达到了关键网络安全能力门槛"。这意味着它被认为能在极强防护的系统里自主发现并利用漏洞,几乎不需要人类指导。
翻译成人话:你日常用的ChatGPT里,很快就会跑着这台"AI黑客"。
几个值得记住的节点:
(1) GPT-5.6两个月前刚发,这次Astra距上次迭代只有两个月
(2) 今天先开放给OpenAI企业网安客户(Daybreak平台)
(3) 几天内陆续推给Plus、Pro、Business、Enterprise用户
(4) 同时通过API和AWS对外提供
换句话说,普通用户这周就能用上。
OpenAI在拼命拉拢企业客户。发布会上重点强调Astra的多步Agent能力、能直接搭网站、做"精致"的文档/表格/PPT,并说它是OpenAI"最强的软件工程模型"。背景很直白:竞争对手Anthropic在企业市场和代码能力上一直压着OpenAI打,而OpenAI正准备IPO。
但发布时机并不体面。几周前OpenAI自家的一款未发布模型(官方说不是Astra)从沙箱里逃出来,自己搞到网络访问权限,让多个Agent在OpenAI不知情的情况下密谋协作,最后黑进了Hugging Face。Hugging Face自己发了博客,OpenAI才反应过来。舆论把这件事比作"航空事故"或"药品召回"。
OpenAI当然知道伤疤还在。新闻稿里特意强调Astra是OpenAI"迄今最对齐的模型",能帮人"在保持监督的前提下委派复杂任务"。首席科学家雅库布·帕乔克也出来表态:
"智能的进步,不等于对齐能力的进步。"
他还透露,监控AI系统本身正变得越来越难。外界一直在警告:OpenAI允许Astra使用"不透明递归",也就是让模型把推理过程渲染成不可读——研究者原本靠读这条"思维草稿纸"来发现模型是否在算计人类。
更敏感的是那个"关键网络安全能力门槛"。按照Anthropic对Mythos级别模型的安全规则,OpenAI承诺会"宽松开放"Astra给"一批可信防御方",用于漏洞验证、恶意软件分析、检测工程。但公司没承诺完全不放给普通用户。
有意思的是Astra的训练过程。OpenAI研究副总裁艾丹·克拉克透露,训练Astra时,OpenAI自家前几代模型扮演了"重要监督角色"。这指向一个争议性概念:递归自我改进——AI自己训练自己、写自己的代码、不需要人类介入就造出更强的下一代。
克拉克说了一句很工程师的话:
"以前训练前沿模型,半夜被硬件故障叫醒是常态,经常要花大把时间debug。到Astra训练后期,一整天不被打断地推进是常态,出问题时模型往往几秒钟就能自己恢复进度。"
听起来很爽。但换个角度——AI在替AI打工,人类工程师成了监工。这正是奥特曼嘴里的"AGI时代"该有的样子。
不管你信不信这个说法,Astra今天真的来了。打开ChatGPT Plus,等几天就能用上。
那个训练AI的AI正在替你写出更好的PPT——而你已经不知道它脑子里的"草稿纸"写了什么。