GPT-6把旗舰AI砍到1/5价:普通人第一次拿到了"够用还便宜"的版本

4次阅读

9月22号那天,OpenAI干了一件挺反常的事。

它没发新旗舰,而是把上个月才发布的旗舰模型GPT-6 Astra的能力,塞进了两款便宜模型里——GPT-6 Sol和GPT-6 Luna,价格直接砍一半。同一天,它的老对手Anthropic也悄悄上线了更便宜的Claude Opus 5.5。

两家公司,在同一天,选了同一条路:往便宜走。这是去年那波"暂停AI"的喊话之后,大模型圈第一次集体转向。

一、错率减半,这不是小升级

先把数据摆出来,别被"便宜"两个字带跑了。

GPT-6 Sol最关键的一个变化是:事实错率比上一代GPT-5.6 Sol砍了一半。说人话就是,以前你问它"唐朝哪年建立的",它可能一本正经告诉你两千年前;现在这种胡说八道的概率直接腰斩。

官方拿它跟Anthropic的Opus 5对标,在AutomationBench和DeepSWE 1.1这种实打实的任务基准上,Sol能做到接近甚至打平,任务成本只要对手的1/5到1/10。

GPT-6 Luna更狠。这个轻量模型在高强度设置下,能干上一代出来吃肉的Sol模型的所有活,成本只要百分之一。

百分之一。你没看错。

二、为什么不堆参数,改抠效率了

过去两年,大模型圈的路子是越卷越大——参数从千亿堆到万亿,token从4K扩到150万,谁参数多谁就是老大。

OpenAI这次反着来。GPT-6 Sol和Luna都没在参数规模上做文章,而是死磕"用更少的资源挤出更多的活"。

这种打法,背后是一个越来越明显的现实:堆参数的天花板到了。继续往上堆,边际收益越来越低,反而是推理成本直线往上飙——钱最后烧的还是用户的订阅费,和企业的IT预算。

于是大家开始换个思路:别让模型更"博学",让它更"靠谱"。

三、安全性也跟着提了

有个数据你得知道:在测试"模型会不会被诱导做不该做的事"这种场景里,上一代GPT-5.6 Sol有52%的概率会上当,新版本GPT-6 Sol直接压到了11%。

52%掉到11%,这是五倍的差距。

之前不是曝出来过嘛——有人用"角色扮演"骗AI写代码删数据库,或者让AI假装成系统管理员绕过权限。OpenAI没回避这个事,反而把测试数据主动公开了。

这是好事。以前大模型公司对这种事遮遮掩掩,出问题就甩锅用户,现在摆到台面上让大家监督——虽然不完美,但至少是个态度。

四、对普通人意味着什么

这次调整,落到你身上其实是三个变化。

第一,ChatGPT Plus可能更值了。Sol这个档位的模型,以前是API专属,你得是开发者、自己写代码才能用。现在它直接进了ChatGPT的Plus订阅里。你打开ChatGPT,默认可能就用上Sol——那个错率砍半的新版本。

第二,免费用户也能摸到新东西了。GPT-6 Luna是冲着免费层去的。它的定位就是"上一代旗舰的能力,这一代白菜价"。如果你是免费用户,接下来几周可能会发现ChatGPT的回答质量悄悄提了一档,不是你变聪明了,是底层换了。

第三,以后AI写东西终于"像人话"了。OpenAI这次特别提到,新模型改了一种沟通风格:更短、更直接、更少废话。那些"作为一个人工智能语言模型"的开场白,那些"这是一个很好的问题!"的客套,都在被砍掉。

这个变化对企业用户更敏感——你以前用AI写周报、写邮件,是不是经常一上来先来一段"在当今数字化时代"?以后可能就直接进入正题了。

五、Anthropic同步动作,行业转向已经确认

OpenAI发新模型的同一日,Anthropic也把自家旗舰Opus 5.5的价格往下压了。

两家公司,在同一天,选了同一条路。

这不是巧合。

这是去年那波"暂停AI"的喊话之后,大模型圈第一次集体转向——不是冲参数去,不是冲能力去,是冲成本去。

以前大家拼的是"我比你强",现在拼的是"我比你便宜还好用"。这种竞争,最后受益的是所有用AI的人,不管是个人还是企业。

对企业IT部门来说,这也是个信号——别再囤"最贵最强"的API配额了。便宜档位的模型,能力已经够用,真要冲最贵的那一档,得先算算账。

六、最后说一句

AI这行有个规律:每一次"集体降价"之后,都会跟着一波应用爆发。

2023年那次降价,催生了遍地开花的AI Agent和AI搜索。2024年的多模态降价,把文生图、文生视频拉进了普通人的手机。这次2026年下半年这一波,大概率会把"个人AI助手"从奢侈品打成日用品。

你以后可能不会再为ChatGPT的月费纠结——因为更便宜的模型,能力已经够你日常90%的场景了。

那个"AI好贵用不起"的时代,正在悄悄过去。

正文完
 0