🤖 人工智能 · 端侧模型

🔥 科大讯飞开源百万Token端侧大模型,本地AI首次具备完整信息理解与复杂任务执行能力

一、端侧AI迎来里程碑式突破

9月1日,科大讯飞全资子公司词元星火正式推出并开源星火X2.5-4B和星火X2.5-1.7B两款端侧通用大模型。这两款模型作为端侧模型中首个原生支持最长100万Token上下文的产品,标志着本地AI能力迈入了全新的时代。过去端侧模型只能处理简短对话和简单任务,而现在,一份几十页的产品手册、一套完整的会议材料、甚至整个代码仓库,都能在本地设备上被完整理解和处理。

业内专家评价,这一突破的意义不亚于智能手机从2G时代迈入4G时代——端侧AI终于具备了处理真实工作场景复杂任务的能力,不再局限于"断网能聊几句"的玩具级别。星火X2.5采用混合注意力架构,围绕智能体、代码、数学和指令遵循等核心能力进行了深度优化,综合实测相关能力领先业界同尺寸一流开源模型。

二、百万Token上下文解决真实痛点

百万级上下文的真正价值,在于解决了端侧AI长期面临的"信息碎片化"痛点。过去,端侧模型处理长文档时,常常需要把文档切成几段分别处理,容易导致忘记前情、遗漏信息、已读乱回。星火X2.5-4B原生支持100万Token上下文窗口,使用覆盖长篇文档、技术资料等场景的千亿Token级高质量数据训练,可以在一次任务中接收和理解更大规模的信息。

以产品售后场景为例,用户可将完整的产品售后手册导入星火X2.5-4B,模型能够先梳理不同场景下的售后规则并标注对应章节,当被问及"购买10天后设备故障且使用过第三方耗材是否符合换货要求"时,能够关联退换货、故障处理和例外条件等跨章节规定给出综合判断。面对偏远地区、设备存有家庭地图等新增条件,模型还可保持前文情境,结合物流、数据清除、费用承担等规则提供后续建议。百万级上下文让端侧AI真正从"能对话"升级为"能干活"

三、全国产算力支撑生态自主可控

星火X2.5-4B和1.7B基于全国产算力平台完成全流程训练,使用约20万亿Token多样化数据进行预训练,并通过高质量监督微调和强化学习训练,持续提升模型在推理、代码、智能体和指令遵循等任务中的表现。在部署层面,两款模型支持英伟达、华为、海光及后摩等硬件平台,兼容vLLM、SGLang、llama.cpp等主流推理框架,可通过Ollama、LM Studio等工具快速部署。

应用场景方面,星火X2.5已覆盖个人办公、代码开发、智能硬件和机器人等多个领域。在代码开发场景中,星火X2.5-4B在算法实现、代码补全与生成等任务中,可对标参数规模大2至3倍的云端模型;在机器人场景中,模型可部署在机器人本体或边缘设备中,支持操作控制、目标追踪、导航决策等任务。据悉,9月7日科大讯飞还将正式发布星火X2.5-293B通用大模型,进一步升级核心能力。

综合科技日报、上游新闻、中国经营报报道 | 2026年9月2日