🎯 科技 · AI大模型

🔥 端侧AI新突破:星火X2.5支持百万Token上下文,让小模型也能干大活

一、百万上下文不是"塞更多字",而是"看全信息"

9月1日,科大讯飞全资子公司词元星火正式推出并开源星火X2.5-4B和星火X2.5-1.7B两款端侧通用大模型,成为端侧模型中首个原生支持最长100万Token上下文的模型。这意味着普通手机、PC、汽车座舱、智能家居和机器人等终端设备,将首次具备百万级信息处理能力。

在科大讯飞开源端侧百万上下文模型这一消息发布后,科技圈迅速热议。真实工作场景里,用户交给模型的往往不是一段提问,而可能是一份售后手册、一套会议材料、一批项目文档,甚至是完整代码仓库。过去,端侧模型处理长内容时,常常要把文档切成几段分别处理,容易导致忘记前情、遗漏信息。如今星火X2.5原生支持百万级上下文,可以在一次任务中接收和理解更大规模的信息。

以产品售后场景为例,用户可将完整的产品售后手册导入模型,当询问"购买10天后设备故障,且使用过第三方耗材,是否符合换货要求"时,模型能够关联退换货、故障处理和例外条件等跨章节规定,给出综合判断。百万级上下文真正解决的是:让模型基于完整信息,在连续交互中持续理解和处理复杂问题。长上下文解决的是"信息能不能看全",智能体和工具调用能力解决的则是"看完之后能不能动手"

二、全国产算力训练,多硬件多框架适配

星火X2.5-4B和1.7B基于全国产算力平台完成全流程训练,使用约20万亿Token多样化数据进行预训练,并通过高质量监督微调和强化学习训练,持续提升模型在推理、代码、智能体和指令遵循等任务中的表现。全国产算力训练,为端侧智能构建了自主、可持续演进的技术底座。

在部署层面,两款模型支持英伟达、华为、海光及后摩等硬件平台,兼容vLLM、SGLang、llama.cpp等主流推理框架,可通过Ollama、LM Studio等工具快速部署,并支持使用LLaMA-Factory开展增量训练。多硬件、多框架适配,进一步降低了开发者和行业伙伴在不同环境中部署、微调和应用端侧模型的门槛。

三、从"能对话"到"能干活",端侧智能迎来拐点

在代码开发场景中,星火X2.5-4B在算法实现、代码补全与生成等任务中,可对标参数规模大2至3倍的云端模型。开发者可通过DeepSeek Harness、OpenCode、Codex、Pi等开源Harness,将模型接入本地开发和自动化脚本流程。代码编写、脚本生成和调试辅助工作,可以不出本地直接完成。

机器人同样是端侧智能的重要落点。模型可以部署在机器人本体或边缘设备中,支持操作控制、目标追踪、导航决策等任务,减少对云端连接和固定预设程序的依赖。依托端侧部署,模型还具备低延迟、离线使用和代码资产本地化管理等优势。从"能够在设备上对话"到"能够在本地完成任务",星火X2.5端侧模型正在拓展中小底座的能力和应用边界。

综合经济日报、中国日报、新京报报道 | 2026年9月2日