🎯 科技 · AI大模型
🔥 谷歌六周内第三次迭代Flash,编程与Agent能力齐飞,性价比再掀价格战
美东时间9月2日,谷歌DeepMind正式推出Gemini 3.8 Flash和Gemini 3.8 Flash Cyber两款新模型,再次刷新了AI大模型迭代速度的"世界纪录"。
距离上一代Gemini 3.7 Flash发布仅过去三周,谷歌就又一次完成了迭代——这也是谷歌六周内第三次发布Flash系列模型,独立评测机构Artificial Analysis指出,3.8 Flash已是谷歌不到四个月内推出的第四款Flash模型。这个迭代节奏,比手机厂商换代还勤快。
此次升级的核心,聚焦两大方向:长周期编程与自主智能体(Agent)。在DeepSWE v1.1长周期软件工程测试中,3.8 Flash能够自主解决复杂工程问题并完成端到端任务,表现超过多数规模更大的前沿模型;在金融、法律等专业领域的智能体测试中也有所提升,HLE-Verified测试得分达到54.9%。
谷歌的解释是:模型"更加努力"了。面对复杂任务,3.8 Flash会执行更多推理步骤,反复调用工具,并通过长时间运行的智能体循环对自身结果进行评估和优化。这意味着Flash系列正从"又快又便宜的轻量模型",逐渐蜕变为推动AI智能体落地的核心引擎。
更吸引人的是价格:3.8 Flash维持每百万输入Token 0.75美元、输出3.75美元的定价,优惠持续至今年年底。Artificial Analysis综合智能指数评分为59分,较3.7 Flash提升3分,以约0.58美元/任务的成本进入"智能—成本"性价比前沿。换句话说,更强的能力、更低的价格、更快的迭代——这是谷歌向OpenAI和Anthropic发起的新一轮围剿。
与此同时发布的3.8 Flash Cyber版本则面向网络安全领域,在一项覆盖20种编程语言的内部漏洞发现测试中成功率超过70%,但仅通过Fairwind Program向可信机构开放,普通用户暂无法接触。
综合界面新闻、华尔街见闻报道 | 2026-09-03