9月1日,科大讯飞全资子公司词元星火正式开源星火X2.5-4B和星火X2.5-1.7B两款端侧通用AI大模型,成为端侧模型中首个原生支持最长100万Token上下文的模型。

两款模型采用混合注意力架构,围绕智能体、代码、数学和指令遵循等核心能力优化。实测中,智能家居控制端到端正确率达90.3%,平均响应时间0.85秒。模型基于全国产算力平台训练,预训练数据约20万亿Token,权重已在Hugging Face和GitHub开放,API在讯飞星辰MaaS平台限时免费。

业界分析指出,百万Token上下文进入4B模型意味着本地设备可以一次读完完整合同、代码仓库或产品手册,无需联网即可处理复杂长文档任务,端侧AI从"能聊天"迈向"能干活"的新阶段。