🎯 科技 · AI大模型

🔥 Anthropic发布Fable 5.1,成本直降25%,编程与Agent能力刷新天花板

一、全球最强大模型来了,性能全面超越GPT-5.6 Sol

当地时间9月1日,Anthropic正式推出新一代旗舰模型Fable 5.1,同时面向拥有Mythos访问权限的用户发布Mythos 5.1。Anthropic将其定位为"全球最先进的编程和知识工作模型"。在第三方测评平台Artificial Analysis的数据中,Fable 5.1在人工智能分析智能指数中名列前茅,多项基准测试表现均优于上一代Fable 5和竞争对手OpenAI的GPT-5.6 Sol,继续刷新LLM的能力天花板。

具体数据显示,Fable 5.1在HLE测试中得分59.1%,超过此前55.5%的最高分;在Terminal-Bench v2.1(91.4%)和SciCode(62.0%)测试中均取得平台迄今最高分;τ³-Banking测试比Fable 5提升9分。

二、成本大降25%,缓存读取降价75%成关键

此次升级的一大重点是降低使用成本。Anthropic将缓存读取(cache reads)价格从每百万token 1美元大幅下调至0.25美元,降幅达75%。标准定价维持不变:输入每百万token 10美元、输出50美元、缓存写入12.5美元。

典型工作负载的预期使用成本较Fable 5下降约25%,对于高度Agent化任务,成本降幅最高可达约45%。Anthropic表示,Fable 5.1在中低推理强度下即可用更低成本达到上一代高推理强度相当甚至更好的表现。

三、智能体能力大幅增强,长时间复杂任务不在话下

Fable 5.1尤其强化了智能体能力。相比上一代,它更擅长处理持续时间较长、步骤较多的复杂任务,比如连续数小时完成编程、研究和知识工作,并在过程中自主验证结果、调整优先级,减少中途"跑偏"或只完成表面工作的情况。

不过需要指出的是,缓存降价并未带来单次任务成本的同步下降——Fable 5.1最高难度智能指数任务单次成本为3.76美元,较Fable 5高出20%,主因是输出token用量达到了后者的1.7倍。这一价格结构折射出前沿模型成本逻辑正在发生微妙变化:缓存命中率将成为企业用户实际使用成本的关键变量。

综合第一财经、财联社报道 | 2026-09-02