🎯 AI大模型 · 谷歌
一、六周三款Flash,谷歌"邪修"上线🔥 谷歌六周内发布第三款Flash模型,Gemini 3.8 Flash靠"大力出奇迹"险胜DeepSeek,AI模型迭代速度史无前例
9月2日,谷歌正式发布Gemini 3.8 Flash,定位"最智能的主力模型"。这是谷歌在六周内推出的第三款Flash系列模型,上一次3.7 Flash问世还不到三周。DeepMind核心成员姚顺宇在博客中评价:"对模型来说,这只是迈出了一小步;但对RSI(递归自我改进)来说,是一次巨大的飞跃。"
模型升级周期比评估周期还短,一位创业者感慨。在OpenAI和Anthropic都在努力让模型用更少步骤完成任务时,谷歌选择了另一条路——让模型多走几步推理,靠循环迭代调用工具,主打"大力出奇迹"。
二、DeepSWE得分73.7%,逼近旗舰模型在软件工程基准测试DeepSWE v1.1中,Gemini 3.8 Flash得分73.7%,仅比Claude Opus 5的74%低0.3个百分点,超过GPT-5.6 Sol的72.7%。在LMArena Agent榜单上,它以微弱优势险胜DeepSeek-V4-Pro,空降第14名。
Chrome安全团队用它修漏洞,产出的正确补丁数量是最强商业模型的2.6倍。Google Cloud漏洞研究团队更夸张——用它不到两小时就挖出一个以往需要研究数月的高危漏洞。不过这个安全专用版本Gemini 3.8 Flash Cyber只通过Fairwind计划向可信机构开放,不对公众完全开源。
三、定价不变但实际成本上涨40%Gemini 3.8 Flash延续促销定价:每百万Token输入0.75美元、输出3.75美元。但Artificial Analysis数据显示,由于每任务输出Token增加30%、智能体评估回合数增多,实际每项任务成本从0.42美元升至0.58美元,涨幅约40%。谷歌解释称,多消耗Token是为了提高首次成功率,减少死循环重试和人工干预。
谷歌旗舰Pro模型仍延期数月,Flash系列不得不承担更多复杂任务。这款"性价比模型"的定位,既守住了成本和速度的基本盘,也在弥补谷歌前沿模型落后的焦虑。
综合第一财经、量子位、界面新闻报道 | 2026年9月3日