🎯 科技 · AI前沿
一、三周迭代一次,谷歌Flash系列加速狂奔🔥 谷歌不到四周发布第四款Flash模型,Gemini 3.8 Flash编程与Agent能力大幅跃升,正逼近Claude和OpenAI的编程赛道
美东时间9月2日,谷歌DeepMind宣布推出Gemini 3.8 Flash和Gemini 3.8 Flash Cyber两款新模型,分别瞄准长周期编程智能体和网络安全漏洞自动修复。距离上一代Gemini 3.7 Flash发布仅过去三周——而这已经是谷歌六周内第三次发布Flash模型,独立AI基准测试机构Artificial Analysis指出,3.8 Flash更是谷歌不到四个月内推出的第四款Flash系列模型。迭代速度之快,在整个AI行业都属罕见。
更令人惊讶的是,谷歌在保持低价策略的同时大幅提升了性能。Gemini 3.8 Flash的引导价格与3.7 Flash相同:每百万输入Token 0.75美元、每百万输出Token 3.75美元,优惠持续至今年年底。Artificial Analysis评测显示,3.8 Flash在高推理档次的综合智能指数中获得59分,较3.7 Flash提升3分,以每项任务约0.58美元的成本跻身"智能程度—任务成本"性价比前沿。在同等价格下性能提升,对开发者生态的吸引力正在快速积累。
二、从单次代码生成到端到端自主智能体Gemini 3.8 Flash最核心的升级方向是"把事做完"。相比前代专注于单次代码生成,3.8 Flash强调完整的软件工程流程和自主智能体工作流。在谷歌内部编程工具Jetski的对比测试中,部分工程师对Gemini 3.8 Flash的偏好甚至超过了Anthropic的Opus模型——这是一个值得关注的信号,意味着谷歌正在缩小与Claude在编程能力上的差距。
在DeepSWE v1.1长周期软件工程测试中,3.8 Flash能够自主解决复杂工程问题并完成端到端任务,表现超过多数规模更大的前沿模型。谷歌展示的案例包括:通过Antigravity仅凭一个提示生成可运行的3D游戏、生成能够运行的DOS版Google Maps,以及在AI Studio中生成硬件拆解的交互式3D可视化工具。这些不再是简单的代码片段,而是完整的、可运行的应用。
三、Agent能力强化,Flash系列定位正在蜕变Agent(智能体)是此次升级的另一大重点。与传统聊天不同,Agent需要连续完成规划、调用工具、读取结果、再次决策等一系列操作,对模型的"速度+成本+质量"三角提出了更严苛的要求。而这恰恰是Flash系列一直强调的方向。
3.8 Flash还支持调节模型的"思考"程度——简单任务减少推理提升速度,复杂任务增加推理投入在质量、成本和响应速度之间取得平衡。这种灵活性让Flash系列从单纯追求速度的"小模型",逐渐转变为谷歌推动AI智能体落地的重要底层模型。当Flash不再只是"快"而是开始"会干活",大模型竞争的重点正在从聊天转向真正的工作流执行。
与此同时,3.8 Flash Cyber版瞄准网络安全赛道,专门针对漏洞发现和自动修复能力进行了强化。谷歌正试图在AI Coding和Agent领域构建双重护城河,而竞争对手Claude和OpenAI的跟进速度,将决定这场竞赛的最终格局。
综合华尔街见闻、网易科技报道 | 2026年9月3日