🎯 科技 · AI大模型

🔥 阿里通义千问刷新旗舰模型上限,Qwen3.8-Max编程能力登顶全球权威榜单

2026年9月初,阿里云宣布更新旗舰模型Qwen3.8-Max,这标志着中国开源大模型阵营又亮出一记重拳。在刚刚发布的全球权威编程能力榜单CodeArena中,新版本以1691分的成绩超越Claude Opus 5、Kimi K3等一众国际强手,强势登顶总榜第一。

此次更新的核心亮点在于,阿里对模型进行了专项后训练,重点强化编程(Coding)和专业办公(Cowork)两大场景的能力。这意味着Qwen3.8-Max不再只是"什么都会一点"的通用模型,而是开始朝垂直场景的深度优化方向演进。

CodeArena是全球首个专注于前端编程能力的权威评测榜单,其评分体系涵盖代码生成、调试、重构等多个维度。1691分的含金量在于,它领先第二名Claude Opus 5约40分,且在性价比维度同样表现突出——每百万Tokens综合平均仅5美分,性价比位居帕累托前沿第一梯队。

更值得关注的是,此次更新发生在"大模型周抛时代"的背景下。据钛媒体报道,过去两周内DeepSeek V4 Pro、Grok 4.6、Gemini 3.7 Flash、智谱GLM-5.3等模型密集亮相,最快48小时内即可推出新版本。阿里选择在如此密集的竞争节奏中更新旗舰模型,释放的信号十分明确:中国模型厂商正从"跟随者"转变为"规则制定者"。

千问团队在开源Qwen3.8-Flash-Next时曾透露,其新架构将是全新一代Qwen4系列的雏形。结合本次Max版本的更新,可以看出阿里正在构建一个分层清晰的产品矩阵:Flash系列主打性价比和速度,Max系列则承担旗舰性能和技术探索的双重使命。

从行业动态来看,OpenAI的GPT-6 Astra、谷歌的Gemini 3.8 Flash、Meta的Muse Spark 1.3也在同一周期密集发布。全球大模型竞争已进入"加速迭代+场景深耕"的双轮驱动阶段,Qwen3.8-Max的登顶,是中国模型在这一轮竞赛中的重要里程碑。

综合钛媒体、新浪财经报道 | 2026年9月5日