🎯 科技 · AI大模型

🔥 端侧大模型迎来质变,百万Token上下文让本地设备也能"读完一整本书"

一、星火X2.5开源 端侧AI能力再升级

9月1日,科大讯飞全资子公司词元星火正式推出并开源星火X2.5-4B和星火X2.5-1.7B两款端侧通用大模型。这两款模型最亮眼的数据是:它们是全球首款原生支持最长100万Token上下文的端侧模型。100万Token意味着什么?大约可以一次性处理20万汉字,相当于一部长篇科幻小说的全部内容。用户无需联网、无需依赖云端API,即可在本地设备完成超长文档分析、长视频理解等复杂任务。

这一突破直接解决了端侧AI长期面临的"记忆力差"痛点。过去,手机、PC等终端设备运行大模型时,上下文窗口通常只有8K到32K Token,处理长文档需要反复切割分段,效率低下且容易丢失上下文关联。星火X2.5将这一限制提升至100万Token,让端侧设备真正具备了"读完一本书"的能力。对于企业用户而言,这意味着可以在本地安全处理大量合同、财报、技术文档,无需担心数据外泄到云端。

二、端侧AI竞争格局正在改写

端侧AI是当下全球科技巨头角力的核心战场。苹果、高通、联发科等芯片厂商纷纷在移动端集成AI算力,但模型能力始终是短板。讯飞此次开源4B和1.7B两款模型,直接面向开发者生态开放,降低了端侧AI应用的开发门槛。开源4B参数量的端侧模型,在主流手机上即可流畅运行,同时保持百万Token上下文,这一组合在当前市场上几乎没有同级别竞争对手。

从行业趋势来看,端侧AI正从"能用"向"好用"快速演进。用户越来越在意隐私保护和响应速度,本地运行模型既能避免数据上传云端的安全风险,又能实现毫秒级推理响应。讯飞选择此时开源,既是对自家端侧AI战略的自信,也是在抢占开发者生态的先机。可以预见,接下来会有更多基于星火X2.5的端侧应用涌现,覆盖办公、教育、医疗等多个领域。

综合人民财讯、证券时报报道 | 2026年9月1日