🎯 AI · 谷歌 Gemini
🔥 六周内第三款Flash,谷歌靠"大力出奇迹"追上第一梯队
9月2日,谷歌宣布推出Gemini 3.8 Flash和Gemini 3.8 Flash Cyber两款新模型。这是谷歌在六周内发布的第三款Flash模型,独立评测机构Artificial Analysis指出,3.8 Flash已是谷歌不到四个月内推出的第四款Flash变体。
一位AI创业者感慨:"Flash从3.7更新到3.8只用了14天,模型升级周期现在比你的评估周期还短。"这届网友给Gemini 3.8 Flash起了个外号叫"邪修"——当OpenAI和Anthropic都在努力让模型更强、步骤更少时,谷歌反其道而行,让模型"做得更多"。
价格方面,谷歌延续了此前策略:每百万Token输入0.75美元、输出3.75美元,与3.7 Flash完全一致,优惠持续至年底。不涨价,只加量,这是谷歌在中端模型市场的杀手锏。
在性能上,Gemini 3.8 Flash确实有亮点。在DeepSWE v1.1(衡量模型自主解决复杂工程问题能力)中,3.8 Flash得分73.7%,仅比Claude Opus 5的74%低0.3个百分点,超过GPT-5.6 Sol的72.7%,也远超上代3.7 Flash的65.3%。在LMArena Agent榜单上,3.8 Flash空降第14名,以微弱优势险胜DeepSeek-V4-Pro。
谷歌称之为"邪修"的原因在于:3.8 Flash并非通过更强的底层智能取胜,而是靠"多走几步推理、反复迭代调用工具"的策略来弥补能力差距。在复杂任务中,模型执行更多推理步骤,通过长时间运行的智能体循环对自身结果进行评估和优化——简单说,就是靠量变堆出质变。
代价也不小:每项智能指数任务成本约0.58美元,较3.7 Flash上涨约40%。谷歌解释称,这是为提高首次成功率、减少死循环重试和人工干预的合理投入。
与主模型同时发布的还有Gemini 3.8 Flash Cyber——一款网络安全专用模型,能够自动挖掘漏洞、生成修复补丁。该模型依托谷歌"Fairwind计划",将定向向政府机构、关键基础设施运营商及软件维护机构开放。
谷歌DeepMind核心成员姚顺宇在推荐新模型时写道:"对模型而言,这只是迈出了一小步;但对于RSI(递归自我改进)来说,是一次巨大的飞跃。"RSI指的是让AI自己参与设计、训练和改进下一代AI,谷歌暂未展开细节。
不管外界如何评价"邪修",谷歌用速度和性价比证明了一件事:在AI军备竞赛中,Flash系列正在从"速度小模型"蜕变为"落地主力军"。
综合第一财经、华尔街见闻、量子位报道 | 2026年9月3日