🎯 科技 · AI大模型
一、全球最强编程模型,成本却大幅下调🔥 大模型竞争从"拼性能"转向"拼性价比",Anthropic用成本战提前抢跑IPO
当地时间9月1日,Anthropic正式推出新一代旗舰模型Fable 5.1,被定位为"全球最先进的编程和知识工作模型"。这款新模型在多项基准测试中超越了上一代Fable 5以及OpenAI的GPT-5.6 Sol,继续刷新LLM的能力天花板。最关键的变化不是性能,而是成本——典型工作负载的使用成本较Fable 5降低了约25%。
这次降价的核心逻辑在于缓存读取(cache reads)价格的调整。Anthropic将缓存读取价格从每百万token 1美元下调至0.25美元,降幅高达75%。在软件开发、代码审查等需要模型遍历整个应用代码库的任务中,缓存命中往往消耗超过一半的token用量,这次降价将显著降低企业用户的调用门槛。
二、Agent能力强化,大模型竞争进入新阶段与单纯追求基准测试分数不同,Fable 5.1的重点升级方向是智能体(Agent)能力。相比上一代,它更擅长处理持续时间较长、步骤较多的复杂任务——比如连续数小时完成编程、研究和知识工作,并在过程中自主验证结果、调整任务优先级,减少中途"跑偏"或只完成表面工作的情况。
数据显示,Fable 5.1在Terminal-Bench v2.1测试中取得91.4%的得分,在SciCode测试中达到62.0%,均为该平台迄今见过的最高分。在τ³-Banking测试中,Fable 5.1比Fable 5提升了9分。同时,新模型在中等或低推理强度下即可用更低成本达到上一代高推理强度相当甚至更好的表现,这意味着企业用户可以在保证效果的前提下大幅削减AI支出。
随着头部模型能力差距逐渐缩小,大模型竞争正在从单纯追求基准测试性能,进一步转向性价比和服务质量的综合较量。
三、IPO前夜的关键一役Fable 5.1的发布时间节点尤为关键。此前有报道称,Anthropic计划在美国劳动节后公开招股书,最快有望在9月底登陆美股市场,并有望刷新SpaceX创下的全球最高IPO募资纪录。业界此前一直把Fable 5.1当作Anthropic应对OpenAI下一代旗舰模型的对策卡,但现在看来,它同时也是向资本市场证明自身持续创新能力的"投名状"。
与此同时,OpenAI在同日也发布了安全相关动向,称其即将推出的Astra模型已突破"关键"网络安全能力阈值——这种正面交锋标志着AI头部厂商的竞争已从技术层面延伸到商业层面,谁能以更低的成本提供更强的能力,谁就能在即将到来的AI应用中占据更有利的位置。
综合财联社、第一财经、科创板日报报道 | 2026年9月2日