Claude Fable 5.1来了:缓存成本砍掉75%,AI编程的"电费"要降了

7次阅读

Anthropic在9月1日悄悄放出了Claude Fable 5.1。

没开发布会,没搞直播,就是一篇推文加一纸说明。但内容很劲爆:输入输出价格一分没降,缓存读取价格直接砍了75%。

这意味着什么?用AI写代码、研究、写文档的人,每月的API账单可能要缩水一半。

几个关键数据:

(1) 输入价格依然是10美元/百万tokens,输出50美元/百万tokens,跟Fable 5完全一样

(2) 缓存读取从1美元/百万tokens降到0.25美元/百万tokens

(3) Terminal-Bench-Science测试成绩翻了一倍多

(4) Terminal-Bench 4.0测试提升了13分

(5) 上下文窗口还是100万tokens,但推理效率更高

Fable 5.1不是全面降价的版本,它是"对症下药"的版本。Anthropic没有动基础价格,而是把目标对准了那些反复读取同样信息的场景——长编程任务、多步骤研究、文档处理。

简单说:你让AI读一万字的代码,它记住了。下次再问类似问题,它不用从头读,直接从缓存里调。Fable 5的时候这个"调取"动作要花1美元,Fable 5.1只要2毛5。

对于天天用AI写代码的程序员来说,这就是直接省电费。

Anthropic这步棋很聪明。OpenAI和谷歌都在疯狂卷"更便宜的基础价格",但Anthropic选择了另一个战场:不降价,降使用成本。

为什么?因为真正烧钱的是那些长时间运行的AI Agent——它们会在缓存里反复调用同一段上下文。如果你是一家公司的CTO,手下有100个AI Agent在跑,光是缓存费用就能吃掉一半的AI预算。

Fable 5.1直接把这块成本砍掉四分之三,等于在企业级市场扔了一颗炸弹。

现在通过Claude API、Amazon Bedrock、谷歌云、微软Foundry都能用上Fable 5.1。Pro、Max、Team、Enterprise订阅用户也已经可以访问。

但有个坑要注意:老版本Fable 5读不懂Fable 5.1的"思考块"。API会自动删除这些块,Fable 5看不到,Fable 5.1能看到。这意味着混用两个版本的项目可能会遇到兼容问题。

还有,Fable 5.1不是所有场景都能省45%。一次性提问的任务几乎没差别,只有那些反复调用同一上下文的场景才能真正省到钱。

Anthropic跟OpenAI、谷歌的战争已经进入下半场。上半场拼的是"谁更聪明",下半场拼的是"谁更省钱"。

Fable 5.1不是最便宜的模型,但它可能是让AI Agent真正能跑起来的那个版本。

当AI Agent开始在企业里大规模干活,胜负不取决于谁能写出最好的代码,而取决于谁能用最少的电费,让这些Agent跑最久。

Anthropic这一刀,砍到了点子上。

正文完
 0