🎯 科技 · AI大模型

🔥 科大讯飞开源百万上下文端侧大模型,本地AI能力迎来质变

一、端侧模型首次支持百万Token上下文

9月1日,科大讯飞全资子公司词元星火正式推出并开源星火X2.5-4B和星火X2.5-1.7B两款端侧通用大模型。作为端侧模型中首个原生支持最长100万Token上下文的产品,星火X2.5把百万级信息处理能力带到了本地设备,被称为端侧的"小巨人"模型。

过去,端侧模型在处理长内容时,常常要把文档切成几段分别处理,容易导致忘记前情、遗漏信息、已读乱回。星火X2.5-4B和1.7B原生支持最长100万Token上下文窗口,可以在一次任务中接收和理解更大规模的信息。综合实测,其相关能力领先业界同尺寸一流开源模型。

二、从"能聊天"到"能干活",端侧AI能力跃升

百万级上下文并非单纯为了"塞下更多字",而是为了解决真实场景中的复杂任务。以产品售后为例,用户可将完整的产品售后手册导入星火X2.5-4B,模型能够关联退换货、故障处理和例外条件等跨章节规定,给出综合判断。面对偏远地区、设备存有家庭地图等新增条件,模型还可保持前文情境,结合物流、数据清除、费用承担和处理时限等规则提供后续建议。

在代码开发场景中,星火X2.5-4B在算法实现、代码补全与生成等任务中,可对标参数规模大2至3倍的云端模型。开发者可通过DeepSeek Harness、OpenCode、Codex、Pi等开源Harness,将模型接入本地开发和自动化脚本流程。在智能家居测试集上,星火X2.5-1.7B控制指令端到端执行正确率达90.3%,平均响应时间仅0.85秒。端侧AI正从"能在设备上对话"走向"能在本地完成任务"。

三、全国产算力训练,适配多硬件平台

星火X2.5-4B和1.7B基于全国产算力平台完成全流程训练,使用约20万亿Token多样化数据进行预训练,并通过高质量监督微调和强化学习持续提升推理、代码、智能体和指令遵循等任务表现。在部署层面,两款模型支持英伟达、华为、海光及后摩等硬件平台,兼容vLLM、SGLang、llama.cpp等主流推理框架,可通过Ollama、LM Studio等工具快速部署。

即日起,模型权重已在Hugging Face、GitHub等平台开放,对应API也已上线讯飞星辰MaaS平台,限时免费。9月7日,科大讯飞还将正式发布全新一代旗舰通用大模型星火X2.5-293B,进一步升级代码和智能体等核心能力。国产端侧大模型的开源化进程正在加速,本地AI的自主可控能力迈上新台阶。

综合科技日报、中国经营报、快科技报道 | 2026-09-01