🤖 AI大模型 · 深度评测

🔥 Qwen3.8-Max以2.4万亿参数、95B激活参数杀入全球第一梯队,用闭源模型1/3的价格打出旗舰性能,"能打又便宜"成为其最硬核标签。

一、参数与架构:国产模型迈入2T时代

8月3日,阿里千问团队正式发布Qwen3.8-Max,总参数量达到2.4万亿,激活参数95B,支持100万Token上下文窗口。这是继月之暗面Kimi K3之后,国产开源模型再次突破万亿门槛——开源大模型全面进入"2T时代"

Qwen3.8-Max基于Qwen 3.5的架构基础构建,在编程、办公、科研以及长周期任务等方面实现了全面提升。团队同时宣布下周将开源模型权重,并同步开源Qwen3.8-27B,延续了千问系列一贯的开放策略。

二、榜单表现:冲进全球第一梯队

在最新发布的大模型竞技场Arena榜单中,Qwen3.8-Max的表现相当亮眼:文本能力排名第二,编程能力排名第三,视觉能力排名第二,在一众闭源模型中杀出重围。特别是在编程能力上,Qwen3.8-Max甚至超过了Claude Opus 5和Fable 5的High版本,在涉及多步骤推理及工具调用的编程智能体测试中表现突出。

与竞品的横向对比更显其竞争力:对比DeepSeek V4 Flash,两者在长程Agent场景下性能接近,但Qwen价格更具优势;对比Kimi K3,综合能力处于同一档位,互有胜负——日常任务和开发场景下已很难拉开明显差距。更关键的是价格:国内每百万Token输入12元、输出36元,隐式缓存命中仅1.5元,输入输出国际价格仅为Claude Opus 5的40%和24%。

三、用户实测:前端、写作、编程三线开花

首批用户反馈印证了榜单成绩。有开发者用一条提示词就让Qwen3.8-Max搭出完整、可交互的开发者作品集;OpenCode团队评价"第一印象就是非常快,几乎能完美解决所有编程任务"

前端能力尤其突出,网页结构、视觉层级、组件细节和动效的生成质量获一致好评。更令人意外的是写作能力——多位内容创作者反馈,Qwen3.8-Max在语气、节奏和留白的把控上表现出难得的语感,有博主甚至评价"让我有了一种用Claude Opus 4.6的感觉"。在Coding和Agent能力疯狂内卷的大背景下,写作反而是Qwen3.8-Max最大的惊喜点。背靠DeepSeek涨价、Kimi K3会员门槛飙升的市场窗口,Qwen3.8-Max以"便宜大碗"的定价策略,很可能成为下半年AI开发者的新宠。

综合第一财经、量子位、数字生命卡兹克、AI产品阿颖等报道 | 2026年8月9日