🤖 AI大模型 · 端侧智能

端侧首个百万Token上下文大模型开源,本地AI从"能聊"迈入"能干"新阶段

一、百万Token,端侧模型的"质变"时刻

9月1日,科大讯飞全资子公司词元星火正式推出并开源星火X2.5-4B和星火X2.5-1.7B两款端侧通用大模型。这是端侧模型中首个原生支持最长100万Token上下文的产品,将百万级信息处理能力直接带入手机、PC、智能家居和机器人等本地设备。

过去,端侧模型处理长文档只能切割分段,容易忘记前情、遗漏信息、已读乱回。星火X2.5-4B和1.7B采用混合注意力架构,原生支持100万Token上下文窗口,使用覆盖长篇文档、技术资料等场景的千亿Token级高质量数据开展训练,可以在一次任务中接收和理解更大规模的信息。以产品售后为例,用户将完整手册导入模型后,面对"购买10天后设备故障且使用过第三方耗材是否符合换货要求"的复杂咨询,模型能关联退换货、故障处理、例外条件等跨章节规定,给出综合判断。

二、从"回答问题"到"动手干活"

百万级上下文解决的是"信息能不能看全",智能体和工具调用能力解决的才是"看完之后能不能动手"。星火X2.5端侧模型围绕智能体、代码、数学和指令遵循四大核心能力全面优化,真正实现从对话助手到任务执行者的跨越。

在个人办公场景中,用户上传销售明细表并提出中英文业绩报告需求后,星火X2.5-4B可自动完成数据汇总、关键指标提取、趋势分析,生成约3000字中文报告后沿用原有格式生成英文版,最后完成内容、结构和排版校验,实现从原始数据到双语报告交付的完整流程,无需云端介入。在代码开发场景中,星火X2.5-4B在算法实现和代码补全任务中可对标参数规模大2至3倍的云端模型,开发者可通过DeepSeek Harness、OpenCode等开源框架将模型接入本地开发流程。

在智能硬件和机器人场景中,星火X2.5-1.7B在Domux智能家居测试集上控制指令端到端执行正确率达90.3%,平均响应时间仅0.85秒;两款模型可部署于机器人本体或边缘设备,支持操作控制、目标追踪、导航决策等任务,大幅减少对云端连接的依赖,在断网或弱网环境下依然可靠运行。

三、全国产算力底座,生态兼容是核心竞争力

两款模型基于全国产算力平台完成全流程训练,使用约20万亿Token多样化数据进行预训练,通过高质量监督微调和强化学习持续提升推理、代码、智能体和指令遵循等任务表现。在部署层面,支持英伟达、华为、海光及后摩等硬件平台,兼容vLLM、SGLang、llama.cpp等主流推理框架,可通过Ollama、LM Studio等工具快速部署,并支持LLaMA-Factory开展增量训练。

即日起,星火X2.5-4B和1.7B已在Hugging Face、GitHub等平台开放模型权重、代码仓库和部署文档,对应API已上线讯飞星辰MaaS平台,限时免费。此外,9月7日科大讯飞还将正式发布旗舰通用大模型星火X2.5-293B,进一步升级代码和智能体等核心能力。

综合科技日报、上游新闻、中国经营报报道 | 2026年9月2日