🤖 AI · 端侧智能
一、重磅发布:端侧模型迎来"百万时代"🔥 科大讯飞开源星火X2.5:端侧模型首次支持百万Token上下文,让小模型真正能干大活
9月1日,科大讯飞全资子公司词元星火正式推出并开源星火X2.5-4B和星火X2.5-1.7B两款端侧通用大模型。这两款模型的核心突破在于:作为端侧模型中首个原生支持最长100万Token上下文的模型,把百万级信息处理能力带入了本地设备。
过去,端侧模型在处理长内容时,常常要把文档切成几段分别处理,容易导致忘记前情、遗漏信息、已读乱回。星火X2.5解决了这个痛点——用户可以将完整的产品售后手册、会议材料、代码仓库一次性导入,模型能够在一次任务中接收和理解更大规模的信息,基于完整上下文进行连续交互和复杂问题处理。
二、场景实测:一份手册,毫秒级精准问答以产品售后场景为例:用户可将完整的产品售后手册导入星火X2.5-4B,先梳理不同场景下的售后规则并标注对应章节;当进一步询问"购买10天后设备故障,且使用过第三方耗材,是否符合换货要求"时,模型能够关联退换货、故障处理和例外条件等跨章节规定,给出综合判断。
在代码开发场景,星火X2.5-4B在算法实现、代码补全与生成等任务中,可对标参数规模大2至3倍的云端模型。代码编写、脚本生成和调试辅助工作可以不出本地直接完成,具备低延迟、离线使用和代码资产本地化管理等优势。智能硬件场景同样表现亮眼:在Domux智能家居测试集上,星火X2.5-1.7B控制指令端到端执行正确率达到90.3%,平均响应时间仅为0.85秒。
三、自主可控:全国产算力训练,20万亿Token数据炼成大模型进入更多行业和智能终端,既需要模型能力持续提升,也需要自主可控的算力支撑。星火X2.5-4B和1.7B基于全国产算力平台完成全流程训练,使用约20万亿Token多样化数据进行预训练,并通过高质量监督微调和强化学习训练,持续提升模型在推理、代码、智能体和指令遵循等任务中的表现。
在部署层面,两款模型支持英伟达、华为、海光及后摩等硬件平台,兼容vLLM、SGLang、llama.cpp等主流推理框架,可通过Ollama、LM Studio等工具快速部署。多硬件、多框架适配,进一步降低了开发者和行业伙伴在不同环境中部署、微调和应用端侧模型的门槛。
四、机器人落点:减少云端依赖,实现本地决策机器人是端侧智能的重要落点。星火X2.5-4B和1.7B适用于机器人等需要持续感知和连续执行的场景,模型可以部署在机器人本体或边缘设备中,支持操作控制、目标追踪、导航决策等任务,减少对云端连接和固定预设程序的依赖。
从"能够在设备上对话"到"能够在本地完成任务",星火X2.5正在拓展中小底座的能力和应用边界。端侧AI从"聊天玩具"走向"生产工具"的时代,正在加速到来。
综合经济日报、中国日报报道 | 2026年9月3日