0.28美元。这是DeepSeek新模型跑一百万token的价钱。同样的活儿,Claude Opus 4.8要收你25美元。99%的价差,就这么摆在那儿。
这不是在打价格战。这叫价格屠杀。
7月31日,DeepSeek V4 Flash上线。编程能力对标Anthropic最贵的模型,但收费是对方的1%。参数总量2840亿,每次请求只唤醒130亿——像一栋大楼,需要用哪个办公室就开哪个灯,其余全灭着。省电,快,还便宜。
消息一出,整个硅谷都在问同一个问题:我们的定价逻辑还成立吗?
7月,整个行业都在降价
DeepSeek不是一个人在动手。整个7月,AI圈经历了一场集体跳水。
OpenAI在7月30日把GPT-5.6 Luna的价格砍了80%。这款模型刚上线才三周。$1/$6直接变成$0.20/$1.20。Terra中端模型也跟着降了20%。只有旗舰Sol守住了原价。
谷歌发了三个新 Gemini flash模型,全瞄着「高效便宜」这个方向。SpaceXAI上线了Grok 4.5。Meta悄悄推出Muse Spark 1.1,闭源,定价激进,专门抢开发者。
7月还没结束,AI价格战已经打完了第一局。
有几个数字值得关注:
(1) DeepSeek V4 Flash:$0.28/百万输出token,Claude Opus 4.8:$25/百万输出token
(2) OpenAI GPT-5.6 Luna:上线三周后降价80%
(3) 中国模型已拿下美国企业API市场46%的份额(OpenRouter数据)
(4) DeepSeek最新一轮融资74亿美元,估值突破500亿美元,正在准备港股IPO,估值目标710亿美元
Anthropic在赌什么
全场只有一家公司没有跟风降价:Anthropic。
Claude Opus 5还是$5/$25,纹丝不动。他们在赌一件事:安全和精准值得溢价。
这个赌注有道理,但也有风险。当「够用且便宜」和「好一点但贵100倍」摆在一起,大多数用户会选哪个?
OpenAI前市场负责人Zack Kass管这叫「模型回报递减」。性能差距缩小的同时,下一代模型带来的体验提升越来越不值钱。这时候用户就开始看价格了。
真正的赢家不是模型,是路由器
但你仔细看这场价格战,真正的最大受益者可能既不是DeepSeek,也不是OpenAI。
是高通。
或者说,是所有在做「模型路由」的公司。
路由器的逻辑很简单:同一个任务,路由器自动判断该用哪个模型——DeepSeek处理简单活儿,OpenAI处理复杂推理,Anthropic处理安全敏感的场景。用户不需要选,系统自己挑。
高通AI产品VP Vinesh Sukumar直接说了:这种路由架构会从根本上改变市场。IDC的2026预测更直接:到2028年,70%的大型AI企业会采用多模型动态路由架构。
实际案例已经跑出来了:
(1) Cursor(AI编程工具)7月上线自研路由器,生产环境A/B测试节省60%成本
(2) AT&T用路由框架后,AI运营成本最高节省90%
这意味着什么?一旦路由器成了标配,没有哪家实验室能靠单一模型维持溢价。AI会像电一样——你不关心是哪个电厂发的,你只关心多少钱一度,以及灯能不能亮。
对前沿实验室来说,这是个存在性问题。花几百亿美元训练一个「稍微聪明一点」的模型,可以换来短期领先,但换不来长期的定价权。
用得多就能赚回来?
山姆·奥特曼在给另一种叙事背书:价跌不要紧,只要用量涨得更快。
他的逻辑:薄利多销。OpenAI不需要高利润率,只要用户量够大,总收入就能覆盖成本。
Uber已经拿自己验证了一把——2026年的AI预算到4月就烧完了。需求确实在暴涨,哪怕成本在崩。
但这是赌注,不是保证。十年前的云计算大战也是这个叙事,有人赢麻了,有人输没了。
对普通开发者来说,现在就是最好的时代——AI便宜得不像话。对投资者来说,该看的不是模型层,而是路由层。价值正在往那里迁移。
一句话:中美两国都在抢着把智能弄得越来越便宜。现在的问题是,谁来证明「便宜也能赚钱」。