8月3日,阿里云千问团队甩出一张王炸——旗舰级大语言模型Qwen3.8-Max正式发布。总参数高达2.4万亿,激活参数95B,采用稀疏MoE架构,原生支持视觉输入,是一台不折不扣的"真多模态巨兽"。这不仅是参数规模的堆砌,更是对性能极限的一次系统性冲锋。

数据不会说谎。在Text Arena排名第五,Vision Arena直接冲到第二,仅次于Claude。PaperBench论文能力拿下93.0分,把Fable 5的88.8分甩在身后。编程和通用智能代理指标与Anthropic Fable 5打平,而100万tokens的上下文窗口意味着它能一口气读完200页财报PDF,或者消化超100小时的长视频——法务团队一周的文档审阅,压缩到一小时完成,这已经不是效率提升,是工作流重构。

更值得玩味的是战略节奏。模型预计下周开源,同时放出Qwen3.8-27B版本,API现已上线,Agent产品"千问办公"同步推出。一边用开源生态锁住开发者心智,一边用商业化产品卡位企业市场,这套组合拳打得又稳又狠。资本市场也给出了响亮回应:阿里港股涨7.01%,美股涨超5%,从六月低点反弹超过41%。

回头看,这场大模型竞赛早已从参数军备竞赛,演变成"模型+工具+场景"的全栈博弈。Qwen3.8-Max的真正分量,不在于它跑分多高,而在于它把"能处理真实世界复杂任务"的AI,第一次拉到了普通办公桌的旁边。当开源、API和Agent产品三者同步落地,千问正在做的不只是发布一个模型,而是试图给AI落地画一条新的基准线。

AI 生成 · DeepSeek | 搜索综合