🎯 科技 · AI硬件
一、百万Token上下文首次登陆端侧,本地AI迎来"记忆革命"🔥 核心观点一句话概述
9月1日,科大讯飞全资子公司词元星火正式推出并开源星火X2.5-4B和星火X2.5-1.7B两款端侧通用大模型,这是端侧模型中首个原生支持最长100万Token上下文的产品。两款模型采用混合注意力架构,围绕智能体、代码、数学和指令遵循等核心能力进行优化,综合实测相关能力领先业界同尺寸一流开源模型。
过去,端侧模型处理长内容往往需要把文档切成几段分别处理,容易导致遗忘前情、遗漏信息、已读乱回。星火X2.5原生支持100万Token上下文窗口,使用覆盖长篇文档、技术资料等场景的千亿Token级高质量数据开展训练,可以在一次任务中接收和理解更大规模的信息。
二、从"能对话"到"能干活",端侧AI迈入执行新阶段百万级上下文并非单纯为了"塞下更多字",而是让模型基于完整信息持续理解复杂问题。以产品售后为例,用户可将完整售后手册导入模型,当被问及"购买10天后设备故障且使用过第三方耗材是否符合换货要求"时,模型能够关联退换货、故障处理和例外条件等跨章节规定,给出综合判断。
在办公场景中,星火X2.5-4B可覆盖数据处理、文档生成和文档翻译等环节。用户上传销售明细表并提出分析需求后,模型可编写脚本完成数据汇总、关键指标提取和趋势分析,生成约3000字中文报告并自动生成英文版。代码开发场景中,其算法实现、代码补全与生成能力可对标参数规模大2至3倍的云端模型。
三、全国产算力训练,生态适配降低部署门槛星火X2.5-4B和1.7B均基于全国产算力平台完成全流程训练,使用约20万亿Token多样化数据进行预训练,在推理、代码、智能体和指令遵循等任务上持续提升表现。部署层面支持英伟达、华为、海光及后摩等硬件平台,兼容vLLM、SGLang、llama.cpp等主流推理框架,可通过Ollama、LM Studio等工具快速部署。
在智能家居测试中,星火X2.5-1.7B控制指令端到端执行正确率达90.3%,平均响应时间仅0.85秒。两款模型权重已在Hugging Face、GitHub等平台开放,API已上线讯飞星辰MaaS平台限时免费。9月7日,科大讯飞还将正式发布旗舰通用大模型星火X2.5-293B,进一步升级代码和智能体核心能力。
综合科技日报、中国经营报、上游新闻、快科技报道 | 2026年9月2日