🎯 科技 · AI大模型
一、国产算力跑出2930亿参数大模型🔥 讯飞星火X2.5全国产算力训练完成,2930亿参数MoE架构剑指代码智能体,国产AI大模型再下一城
9月7日,科大讯飞正式发布星火X2.5大模型,这是国内少数完全基于全国产算力完成全流程训练及推理的千亿参数级大模型。该模型采用MoE混合专家架构,总参数量2930亿,每次推理仅激活300亿参数,在保持大模型性能的同时大幅降低推理成本。模型重点提升了代码生成和智能体能力,同时持续强化数学推理和通用理解水平,目前已上线讯飞开放平台。
星火X2.5的核心亮点在于"全国产"三个字。科大讯飞在昇腾910B集群上完成了从训练到推理的全链路适配,训练效率从最初仅为同规模A800集群的30%左右,逐步提升至84%到93%。这一爬坡过程背后,是国产GPU显存64GB对比H200的141GB、带宽1.6TB/s对比4.8TB/s的硬件代差,以及通信机制带来的数倍效率差距。刘庆峰和团队选择了一条最艰难的路——不依赖英伟达,在国产算力上硬啃大模型。
二、端侧百万Token上下文率先开源在云端大模型发布的同周,讯飞已于9月1日开源了星火X2.5-4B和星火X2.5-1.7B两款端侧通用大模型,这也是目前端侧模型中唯一原生支持最长100万Token上下文的模型系列。对于手机、PC、汽车座舱、智能家居和机器人等终端设备而言,百万级上下文意味着一次任务可以接收和理解更大规模的信息,不再需要将文档切割成几段分别提问。
以产品售后场景为例,用户可将完整的产品售后手册导入星火X2.5-4B,模型能够关联退换货、故障处理和例外条件等跨章节规定,给出综合判断。面对偏远地区、设备存有家庭地图等新增条件,模型还可保持前文情境,结合物流、数据清除、费用承担和处理时限等规则,提供后续建议。这种"读完整本书再回答"的能力,正是端侧模型从"断网能聊几句"走向"真正可用"的关键一步。
三、AI应用服务商培育迎政策东风就在星火X2.5发布之际,工信部8月31日发布了《关于开展人工智能应用服务商培育专项行动的通知》,明确以专项行动推动AI应用服务商规模化发展。科大讯飞旗下词元星火开源端侧模型、招采助手通过中国信通院AI招采能力评估达到4+级最高评级,正是这一政策导向下的先行实践。与此同时,讯飞与海光信息共建的"星光联合实验室"也在8月20日揭牌,围绕海光CPU、DCU计算平台开展联合技术攻关。
国产大模型的竞争已从参数规模转向落地能力。星火X2.5的定价策略也体现了这一思路——限时5折优惠,每百万Token输入仅1.6元、输出6元,远低于原版模型价格。在AI应用从"技术筑基"迈向"应用为王"的阶段,国产算力+国产模型+国产应用的完整闭环正在加速成型。科大讯飞选择了一条负重前行的路,但这条路恰恰是国内AI产业最需要的底色。
综合科技日报、快科技、证券时报报道 | 2026-09-08