谷歌又在加速了。9月2日深夜,Gemini 3.8 Flash正式上线,距离上一代3.7 Flash发布仅隔三周——这个迭代速度在大模型领域罕见,标志着谷歌正式将Flash系列从"廉价替补"升级为"干活主力"。
编程能力是此次升级的核心卖点。在谷歌内部代码工具Jetski的对比测试中,部分工程师对3.8 Flash的偏好度甚至超过了Anthropic的Opus模型。Agent能力同步强化,模型现在能完成规划、调用工具、读取结果、再决策的完整循环,这正是AI编程助手从"单点问答"走向"端到端执行"的关键一步。与此同时,专为网络安全打造的Gemini 3.8 Flash Cyber同步发布:漏洞自主发现率超70%,自动补丁成功率达47.2%,与顶尖商业模型差距仅0.6个百分点,但成本显著更低。
不过性能跃升并非没有代价。Artificial Analysis数据显示,3.8 Flash智能指数升至59分,但高推理档单任务成本约0.58美元,较上代上涨40%——原因正是模型为完成复杂任务"思考得更多、调用得更深"。这也解释了谷歌为何保留多推理档位:低推理档成本仅0.24美元,适合简单场景。
更深层的信号是Flash系列定位的彻底转变:它不再只是追求速度和低成本的"小模型",而是谷歌推动AI Agent大规模落地的底层引擎。当编程、Agent、网络安全同时成为竞争焦点,大模型 wars 已进入"谁能真正干活"的下一局。
三周迭代、编程Agent双杀、网安专用版——谷歌正在用速度定义AI竞赛的新规则。
AI 生成 | DeepSeek | 搜索综合