🎯 科技 · AI大模型
🔥 端侧AI迎来小巨人:百万上下文让本地模型真正能干活
9月1日,科大讯飞全资子公司词元星火正式开源星火X2.5-4B和星火X2.5-1.7B两款端侧通用大模型。作为端侧模型中首个原生支持最长100万Token上下文的模型,星火X2.5把百万级信息处理能力首次带到了本地设备。过去,端侧模型处理长文档需要切成段落分段问,容易忘记前情、遗漏信息。现在,一份几十页的产品手册、一套完整代码仓库,模型可以一次性读完并给出综合判断。
长上下文解决的是信息能不能看全,智能体和工具调用能力解决的是看完之后能不能动手。在个人办公场景,模型可覆盖数据处理、文档生成和翻译;在代码开发场景,星火X2.5-4B在算法实现、代码补全等任务中可对标参数规模大2至3倍的云端模型;在智能家居场景,控制指令端到端执行正确率达90.3%,平均响应时间仅0.85秒。端侧AI已从能对话进化到能干活。
星火X2.5-4B和1.7B基于全国产算力平台完成全流程训练,使用约20万亿Token多样化数据进行预训练。模型支持英伟达、华为、海光及后摩等硬件平台,兼容vLLM、SGLang、llama.cpp等主流推理框架,开发者可通过Ollama、LM Studio等工具快速部署。技术自主加生态开放,正是星火X2.5的战略意图。
综合科技日报、经济日报、中国日报报道 | 2026年9月2日