🎯 科技 · AI人工智能

🔥 端侧模型首次原生支持100万Token,让AI真正走进本地生产场景

9月1日,科大讯飞全资子公司词元星火正式推出并开源星火X2.5-4B和星火X2.5-1.7B两款端侧通用大模型。作为端侧模型中首个原生支持最长100万Token上下文的模型,这两款产品把百万级信息处理能力带到了本地设备。

过去,端侧模型在处理长内容时,常常要把文档切成几段分别处理,容易导致忘记前情、遗漏信息。现在,用户可以将一份几十页的产品手册完整导入,让模型一次读完、提炼重点、跨章节关联分析。

一、从"能聊天"到"能干活"的能力跃迁

星火X2.5-4B在算法实现、代码补全与生成等任务中,可对标参数规模大2至3倍的云端模型。开发者可通过DeepSeek Harness、OpenCode、Codex等开源框架,将模型接入本地开发流程。

在Domux智能家居测试集上,星火X2.5-1.7B控制指令端到端执行正确率达到90.3%,平均响应时间仅为0.85秒,兼顾准确度与速度。

二、从"云端依赖"到"本地自治"的架构革新

端侧部署意味着低延迟、离线使用和代码资产本地化管理。对于医疗、金融等对数据安全敏感的场景,模型运行在本地设备,数据不出域,既满足合规要求,又保障业务连续性。

机器人同样是端侧智能的重要落点。模型可部署在机器人本体或边缘设备中,支持操作控制、目标追踪、导航决策等任务,减少对云端连接和固定预设程序的依赖。

基于全国产算力平台完成全流程训练,使用约20万亿Token多样化数据进行预训练,为端侧智能构建了自主、可持续演进的技术底座。

三、从"单点工具"到"生产引擎"的角色升级

企业真实的工作,往往不是提出一个问题、得到一个答案,而是要让AI从原始数据、内部资料和业务规则出发,完成信息提取、分析判断、内容生成和结果校验,最终交付一份可以使用的报告或可执行的决策结果。

星火X2.5端侧模型的发布,标志着端侧AI开始从"聊天窗口"走向"生产工具",真正进入企业核心业务流程。

综合经济日报、中国日报、证券时报报道 | 2026年9月3日