🎯 科技 · AI大模型

🔥 谷歌六周内第三款Flash模型上线,智能指数59分逼近Opus 5,但Agent成本上涨40%

9月2日,谷歌DeepMind正式推出Gemini 3.8 Flash,这是谷歌六周内第三次更新Flash系列。官方称其为"迄今最强的推理和编程模型",DeepSWE v1.1长周期软件工程测试得分73.7%,仅比Claude Opus 5的74.0%少0.3个百分点。

从版本号看只是常规迭代,但谷歌给Flash安排的任务越来越重:编写大型项目、反复调用工具、独立完成持续数小时的复杂工作——这些通常是顶级Agent模型的分内活。Flash不再只是追求速度和低成本的小模型,正逐渐成为谷歌推动AI智能体落地的底层基座。6周内发布三款Flash模型,谷歌的"小步快跑"战略正在重塑大模型竞争节奏。

在DeepSWE v1.1测试中,3.8 Flash相较3.7 Flash的65.3%提升近8个百分点,进步速度惊人。Artificial Analysis独立评测显示,3.8 Flash高推理档综合智能指数达59分,较上一代提高3分,以每项任务约0.58美元的成本进入"智能-成本"性价比前沿。定价保持不变:输入每百万Token 0.75美元、输出每百万Token 3.75美元,优惠至今年12月31日。

不过,性能提升的代价不容忽视。Artificial Analysis数据显示,3.8 Flash每任务Token消耗较3.7 Flash上涨约40%,平均输出Token从3.4万增至4.8万。谷歌建议,如果任务更看重效率,可降低推理档位或继续使用3.7 Flash。Flash系列的定位正在发生根本转变——从"又快又便宜"的通用模型,演进为"能持续干活"的智能体引擎。

综合界面新闻、华尔街见闻、Artificial Analysis报道 | 2026-09-03