类比OpenAI推动GPT爆发的路径,科大讯飞正在用全国产算力路线走出中国版AI大模型独立路径。9月1日,星火X2.5-4B和星火X2.5-1.7B两款端侧通用大模型正式开源,原生支持1M token超长上下文窗口,重点强化智能体、数学推理和通用理解能力,直接对标车载、智能硬件等端侧场景。9月7日,293B参数规模的星火X2.5基座模型将正式发布,代码和智能体能力再升级。这轮操作,讯飞直接把"国产算力+开源生态"两张牌打到了桌面上,不依赖NVIDIA GPU,自主可控。
值得注意的是,讯飞此前在半年报业绩说明会上透露,今年全球1024开发者节将推出"基于全国产算力"的全新主力通用大模型。今天开源的端侧版本,正是这条路线的先行落子。1M token上下文意味着什么?简单说,一篇80万字的长篇小说、几十万行代码仓库、或者整本技术手册,一次性丢进去,模型能全程上下文连贯理解,不用再分段切割——这对代码助手、法律文档分析、超长研报解读等场景是质的飞跃。
从产业视角看,讯飞这次开源的选型很有意思:4B和1.7B都是端侧模型,参数量不大,但面向的是车载、智能硬件、IoT设备等算力受限场景。这意味着讯飞在赌一个趋势——大模型的下半场不在云端卷参数量,而在边缘端卷效率。配合9月7日即将发布的293B基座模型,讯飞摆出的是一副"云端基座+边缘开源"的双层生态打法,和DeepSeek走纯开源路线形成差异化,也和OpenAI的GPT闭源策略形成对比。
不过,端侧模型的真正考验在落地。1M token在纸面上很性感,但在车机、可穿戴设备上能否流畅推理,取决于量化压缩和硬件适配能力。讯飞在智能语音领域深耕多年,车载场景是它的老本行,这次开源端侧模型,等于把技术护城河直接铺成公开道路,吸引开发者在其生态上建应用。
一句话:讯飞星火X2.5用开源端侧模型+全国产算力基座,打出差异化牌,9月7日才是真正高潮,值得盯紧。
AI 生成 . DeepSeek | 搜索综合