🎯 AI · 大模型

🔥 Anthropic发布Fable 5.1,缓存读取价格暴跌75%,全球AI模型价格战进入白热化

一、最强编程模型来了,性能全面碾压竞品

当地时间9月1日,AI公司Anthropic正式发布新一代旗舰模型Claude Fable 5.1,定位为"全球最先进的编程与知识工作模型"。在多项核心基准测试中,Fable 5.1实现了代际式跃升,其自主科研能力基准Terminal-Bench-Science0.1得分从上一代的24.7%飙升至52.6%,直接将OpenAI的GPT-5.6 Sol(22.4%)甩在身后。在HLE测试中,Fable 5.1得分59.1%,也超过了Fable 5此前创下的55.5%最高纪录。更值得关注的是,Fable 5.1强化了智能体长时复杂任务处理能力,可连续数小时完成编程、研究等工作,并自主验证结果和调整任务优先级。

在智能体评估中,Fable 5.1在τ³-Banking测试中比Fable 5提升了9分,在SciCode测试中达到62.0%的满分水平,均创下该平台迄今最高分。这些数据表明,Anthropic在模型能力上的"军备竞赛"并未停歇,依然在多个维度刷新LLM的能力天花板。

二、价格战打响,缓存读取降价75%成最大亮点

与性能提升同样引人注目的是定价策略的调整。Anthropic宣布将缓存读取(Cache Read)价格从每百万Token 1美元大幅下调至0.25美元,降幅高达75%。缓存读取是指模型读取已经处理并存储过的输入内容时产生的费用,在智能体任务和长对话场景中,大量重复读取缓存是常态。

官方测算显示,在典型工作负载下,Fable 5.1的使用成本较Fable 5降低约25%;对于高度智能体化的任务,成本降幅最高可达约45%。这意味着,企业用户以更低成本获得更强模型,"最强性能+大幅降价"的组合拳正将全球AI大模型竞争从"能力竞赛"加速转向"商业化落地"。

三、缓存降价≠单次任务成本下降,AI成本逻辑正在演变

不过,缓存降价并未带来单次任务成本的同步下降。Fable 5.1(最高难度)的智能指数任务单次成本为3.76美元,较Fable 5高出20%,主因是其输出Token用量达到了后者的1.7倍。缓存读取降价在智能体评估中为每次任务节省约1.40美元,这类场景大部分输入Token都来自缓存命中。

这一价格结构折射出前沿模型成本逻辑的微妙变化:输入侧的缓存降价意在降低智能体场景的调用门槛,但模型本身更强的推理深度意味着更长的输出链,最终单次任务的总成本不降反升。对于重度依赖智能体工作流的企业用户而言,缓存命中率将成为决定实际使用成本的关键变量。

综合财联社、界面新闻、第一财经报道 | 2026年9月2日