9月1日,AI圈迎来了一场罕见的"双雄对决":Anthropic正式发布新一代旗舰模型Fable 5.1,而同一天OpenAI也确认了即将发布的Astra模型已达到其最高网络安全能力门槛。一边是成本直降25%的性价比暴击,一边是自主挖掘零日漏洞的"黑客级"智能——顶级模型竞赛的赛道,正在从"拼分数"转向"拼实战+拼价格"。

Anthropic此次升级的核心亮点在于"省钱"。Fable 5.1的缓存读取价格从每百万token 1美元大幅下调至0.25美元,降幅高达75%。官方称,典型工作负载整体成本较上代降低约25%,而高度智能体(Agent)化任务的成本降幅更是最高可达45%。与此同时,模型在Terminal-Bench v2.1(91.4%)和SciCode(62.0%)等基准测试中均刷新了平台历史最高分,编程和长周期Agent任务能力得到显著强化——这意味着企业用户可以用更低的代价,跑更复杂的自动化流程。

几乎同一时间,OpenAI抛出了一颗更震撼的"炸弹":Astra模型被正式认定为具备"关键"网络安全能力——这是OpenAI首次承认旗下模型达到这一门槛。按照定义,Astra能够在没有人工指导的情况下,自主发现现实软件中的未知漏洞并开发利用方式,甚至在内部测试中自行发现了两个此前未知的零日漏洞。更关键的是,Astra采用了"循环深度"技术,让模型在生成答案前反复处理同一段信息,从而在数学和编程能力上实现跃升,同时降低内存和带宽成本。

两家头部厂商在同一时间窗口密集释放新模型信号,背后折射出AI竞赛正在进入一个全新的阶段:早期单纯比拼基准测试分数的时代已经过去,接下来的核心战场将是"成本效率"与"自主能力"的双线博弈。Fable 5.1的降价策略瞄准的是大规模Agent部署的企业用户,而Astra的网络安全能力则直指AI安全与攻防这一更为敏感的战略高地。当模型开始自己找漏洞、自己调优,谁来确保它们不会"越界",将是整个行业必须直面的下一道考题。

当顶级模型的军备竞赛从"拼参数"进化到"拼价格"和"拼自主性",AI的普惠化进程正在加速——但安全护栏的构建,也必须跑在模型能力的前面。

AI 生成 . DeepSeek | 搜索综合