🎯 科技 · 人工智能

🔥 Anthropic发布Claude Fable 5.1旗舰大模型,缓存读取价格直降75%,智能体任务成本最高降幅达45%

一、旗舰模型刷新多项基准,科研能力实现翻倍跃升

当地时间9月1日,人工智能公司Anthropic正式发布新一代旗舰大模型Claude Fable 5.1与Claude Mythos 5.1,将其定位为"全球最先进的编程与知识工作模型"。这是Anthropic继今年6月发布Fable 5系列之后,三个月内再次更新自家旗舰。

在最具标志性的Terminal-Bench-Science0.1基准测试中,Fable 5.1以52.6%的得分将上一代Fable 5(24.7%)和OpenAI的GPT-5.6Sol(22.4%)甩在身后,甚至超过了自家定位更高的Opus 5(29.0%),实现了超过一倍的performance跃升。这一基准测试衡量的是AI模型在终端环境中自主完成科学研究任务的能力,被业内视为判断模型科研潜力的核心指标。

在HLE测试中得分为59.1%,超过Claude Fable 5此前创下的55.5%的最高分;在Terminal-Bench v2.1(91.4%)和SciCode(62.0%)测试中均取得该平台迄今为止见过的最高分,各项基准指标全面刷新。

二、缓存读取降价75%,智能体场景成最大受益者

价格层面,Anthropic将缓存读取(命中)价格从每百万token 1美元大幅下调至0.25美元,降幅达75%。标准定价则维持不变:输入每百万token 10美元、输出50美元、缓存写入12.5美元。这一调整将显著降低代理工作负载的成本。

缓存读取是指模型读取已经处理并存储过的输入内容时的计费项,在实际的智能体任务和长对话场景中,大量重复读取缓存是常态。Anthropic官方测算,典型工作负载下Fable 5.1的使用成本比Fable 5低约25%,而对于高度智能体化的工作负载,成本降幅最高可达约45%。

Fable 5.1保持了100万Token的上下文窗口和12.8万Token的最大输出长度,在降低使用门槛的同时,不妥协模型能力上限。这种"同款模型、两套安全策略"的发布模式,旨在推动模型能力前沿突破的同时,有效管控高风险领域的潜在滥用。

三、零数据保留承诺落地,企业隐私安全再升级

在数据安全方面,Anthropic正式践行了承诺过的"零数据保留",允许客户在自己的基础设施上运行Anthropic模型,同时确保数据不会外泄。这是此前公司因安全顾虑而未面向Fable开放的高隐私服务(被称为"企业前沿安全护栏"EFS),将于今年秋季向用户推出。

值得注意的是,Mythos 5.1版本向经过审核的美国网络安全与生命科学机构开放,在蛋白质设计、天文数据解析、GPU内核优化等科研场景展现较强落地能力。而公开版本Fable 5.1加装了更为严格的安全护栏,能够防止模型在生物学、网络安全等高风险双重用途领域执行特定任务。

在Anthropic发布新模型的同一天,OpenAI也宣布即将推出下一代模型Astra,成为首个突破其"关键"网络安全能力阈值的模型。头部厂商同一时间窗口密集释放新模型信号,标志着短暂"熄火"后的前沿模型更迭竞争再次提速,安全部署从后台议题正式走向行业前台。

综合界面新闻、第一财经、每日经济新闻、澎湃新闻报道 | 2026年9月2日