今
🤖 AI模型 · 谷歌Gemini
🔥 谷歌三周速推Gemini 3.8 Flash,编程推理双升级,价格仅前代一半,性价比碾压OpenAI和Claude
一、三周一次的"邪修"节奏
9月2日,谷歌正... 展开 ▼
🤖 AI模型 · 谷歌Gemini
🔥 谷歌三周速推Gemini 3.8 Flash,编程推理双升级,价格仅前代一半,性价比碾压OpenAI和Claude
一、三周一次的"邪修"节奏
9月2日,谷歌正式リリースGemini 3.8 Flash,距离上一代3.7 Flash发布仅过去三周。这已经是谷歌六周内第三次推出Flash系列模型,被业内戏称为"邪修式迭代"。Artificial Analysis数据显示,3.8 Flash在高推理档综合智能指数获得59分,较3.7 Flash提升3分,以每项任务约0.58美元的成本登上智能-成本前沿。更引人注目的是,这款走量定位的Flash模型在LMArena Agent榜单空降第14名,以微弱优势险胜DeepSeek-V4-Pro。
谷歌内部测试显示,在编程工具Jetski对比中,部分工程师对Gemini 3.8 Flash的偏好甚至超过Anthropic的Opus模型。这种"大力出奇迹"的迭代策略,折射出AI竞赛已进入白热化阶段。
二、编程与Agent能力全面升级
Gemini 3.8 Flash主打长周期软件工程、自主智能体和复杂企业工作流。它支持100万Token上下文窗口,最高6.4万输出Token,并新增低、中、高三档thinking强度,可在性能、延迟和成本之间灵活调整。在DeepSWE v1.1长程软件工程测试中,模型能自主处理复杂工程问题,通过持续迭代调用工具并校验结果,显著提升多步骤任务完成质量。
#谷歌发布Gemini 3.8# 不仅是参数升级,更是定位转变。模型开始向更高能力区间靠近,在保持Flash系列速度和成本优势的同时,逐步弥合与高端模型的差距。这种"性价比战士"策略,让中小企业也能负担得起高质量的AI编程助手。
三、安全与网安双轨并行
同步发布的还有Gemini 3.8 Flash Cyber,专攻网络安全漏洞发现和自动修复。谷歌启动Fairwind计划,向经审核的云客户、政府机构和网安合作伙伴开放先进模型,用于自主漏洞修复。谷歌强调,该模型优先漏洞修复能力而非攻击性开发,旨在赋予防御方专家级优势。
与此同时,OpenAI的Astra模型已在ExploitBench达到100%得分,Anthropic则推出"企业前沿防护"方案。AI安全治理正成为全球科技巨头的必争之地,而谷歌选择了一条更克制、更强调防御的技术路线。
综合界面新闻、华尔街见闻、量子位报道 | 2026年9月3日
收起 ▲