AI大模型同时宣布降价:OpenAI和Anthropic把价格砍了一半,你猜谁急了

5次阅读

9月22号,AI圈出了件有意思的事。

OpenAI和Anthropic,这两家平时恨不得把对方踩在脚底下的死对头,在同一天各自发了新模型。巧的是,两家讲的故事一模一样——花更少的钱,办更多的事。

先把价格摆出来。

OpenAI这次发了GPT-6 Sol和Luna两款模型。Sol的API定价是每百万输入token 2美金,输出10美金。Luna更狠,输入只要0.1美金,输出0.5美金。对比一下上个月发的旗舰Astra,Sol和Luna的价格直接腰斩。

Anthropic那边发的是Opus 5.5。输入4美金,输出20美金每百万token。比上一代Opus 5便宜了20%。缓存读取更夸张——0.2美金每百万token,直接砍掉六成。官方说典型工作负载下,实际成本能省40%。

两家算账的方式不一样,但结果都一样:变便宜了。

看到这里你可能要问:AI公司不都是天天烧钱吗,怎么突然开始降价了?

这事要从几个月前说起。

DeepSeek、阿里、智谱这些玩家把开源模型做到接近GPT-4水平之后,企业用户开始动脑子了。既然便宜的开源模型能解决80%的问题,为啥还要花大钱用最贵的?于是模型路由这个概念火起来——简单的活儿让便宜模型干,难的再上旗舰。

这招管用。高通和IDC的预测说,到2028年七成企业都会用动态路由。Cursor这么搞之后成本砍了六成,AT&T更夸张,省了九成。

OpenAI和Anthropic看在眼里,急在心里。再不降价,企业客户真就跑光了。

于是就有了这一轮集体降价。

但你要是以为这是AI公司良心发现,那可就天真了。

Anthropic在公告里特别提了一嘴:Opus 5.5在高风险领域(比如网络安全、生物)能力很强,所以沿用了Fable 5.1那套保护机制——如果你问的东西踩了红线,系统会自动把你的请求悄悄转到旧模型去,你压根不知道。

翻译成人话:模型越强,管得越严。你以为自己在用最厉害的版本,其实背后有人在把关。

OpenAI这边的玩法更直接。Astra是最猛的(也是最贵的),Sol是日常主力,Terra是均衡款,Luna是便宜大碗。对应到Anthropic的Fable、Opus、Sonnet、Haiku,定位几乎一一对应。

说白了,两家在玩同一个游戏:把模型分成三六九等,让用户按预算挑着用。

这背后藏着一个很微妙的信号——AI技术进步的速度开始慢下来了。

现在的模型够用了,瓶颈不在模型能力,而在怎么把这些模型用好。编排能力、工作流设计、人机协作的脚手架比模型升级更重要。

这跟半年前的画风完全不一样。那时候大家比的是我的模型又破纪录了、我的参数又翻倍了。现在呢?开始比我的模型便宜了多少。

风向变了。

对咱们普通用户来说,这事的影响是实实在在的。

用ChatGPT写周报、做表格、整理资料的人,下个月账单大概率会少一截。用Claude写代码、调试程序的程序员,缓存成本降六成,这笔钱省下来够请顿火锅。

更大的影响在企业层面。当模型路由变得普及,哪个模型最强这个问题就没那么重要了,怎么组合不同模型把事情办成才是真本事。

说到底,AI这场竞赛已经从造火箭阶段进入怎么把火箭开好阶段。

火箭上天那一刻不算亮眼,时不时落下来才是。

正文完
 0