🎯 科技 · 人工智能
一、端侧首个百万Token上下文模型来了🔥 科大讯飞开源星火X2.5百万Token端侧大模型,本地AI能力再破天花板
9月1日,科大讯飞全资子公司词元星火正式推出并开源星火X2.5-4B和星火X2.5-1.7B两款端侧通用大模型。这是端侧模型中首个原生支持最长100万Token上下文的产品,将百万级信息处理能力直接带到手机、PC、汽车座舱和机器人等本地设备中。
过去,端侧模型处理长内容时往往需要将文档切成多段分别处理,容易忘记前情、遗漏信息。星火X2.5-4B和1.7B原生支持最长100万Token上下文窗口,使用覆盖长篇文档、技术资料等场景的千亿Token级高质量数据训练,可以在一次任务中接收和理解更大规模的信息。百万级上下文真正解决的是让模型基于完整信息,在连续交互中持续理解和处理复杂问题。
二、本地就能干活,不只是聊天长上下文解决的是信息能不能看全,智能体和工具调用能力解决的则是看完之后能不能动手。在代码开发场景中,星火X2.5-4B在算法实现、代码补全与生成等任务中,可对标参数规模大2至3倍的云端模型,开发者可通过DeepSeek Harness、OpenCode等开源框架将模型接入本地开发流程。
在智能家居场景中,Domux测试集显示星火X2.5-1.7B控制指令端到端执行正确率达到90.3%,平均响应时间仅0.85秒。机器人场景下,两款模型可部署在机器人本体或边缘设备中,支持操作控制、目标追踪、导航决策等任务,减少对云端连接的依赖。从能够在设备上对话到能够在本地完成任务,端侧AI正在完成能力跃迁。
三、全国产算力训练,部署门槛大幅降低星火X2.5-4B和1.7B均基于全国产算力平台完成全流程训练,使用约20万亿Token多样化数据进行预训练,并通过高质量监督微调和强化学习持续提升模型表现。部署层面支持英伟达、华为、海光及后摩等硬件平台,兼容vLLM、SGLang、llama.cpp等主流推理框架,可通过Ollama、LM Studio等工具快速部署,并支持使用LLaMA-Factory开展增量训练。
两款模型已在Hugging Face、GitHub等平台开放模型权重、代码仓库和部署文档,API已上线讯飞星辰MaaS平台限时免费。此外,科大讯飞宣布将于9月7日正式发布全新一代旗舰通用大模型星火X2.5,进一步升级代码和智能体等核心能力。有分析指出,这标志着国产端侧AI在自主可控路线上迈出了关键一步。
综合科技日报、中国经营报、快科技报道 | 2026-09-02