🚀 人工智能 · 国产GPU
一、同日发布、同日适配,国产软硬件协同创纪录🔥 国产GPU赛道再添关键拼图:摩尔线程MTT S5000完成Kimi K3适配,2.8万亿参数大模型首次跑通国产算力。
7月28日,月之暗面正式开源2.8万亿参数大模型Kimi K3,同一天,摩尔线程宣布基于旗下AI训推一体智算卡MTT S5000及MUSA软件栈,完成Kimi K3的极速适配与稳定拉起。从模型发布到国产GPU跑通,间隔不到24小时,这在国产AI算力生态中尚属首次。
Kimi K3作为全球参数规模最大的开源大模型,采用混合专家架构,每token仅激活16个专家,算力效率极高。能在发布当天即被国产GPU成功拉起,说明摩尔线程的MUSA软件生态已具备与主流模型#摩尔线程完成Kimi K3适配#能力,国产算力栈正从"能用"向"好用"加速迈进。
二、突破英伟达依赖,K3天生"不挑卡"Kimi K3的技术报告释放了一个关键信号:其部署能力已不局限于英伟达生态。在GPU内核优化测试中,K3在24小时内独立完成了AttnRes、KDA等四种代表性内核优化,测试环境同时覆盖了NVIDIA H200与其他供应商的GPGPU,展现出极强的跨平台适应能力。
这是国产大模型+国产GPU这对"双国产"组合首次在万亿级参数层面形成闭环。此前AI训练推理几乎被英伟达CUDA生态垄断,Kimi K3的跨架构能力和摩尔线程的快速适配,等于给国产算力产业链注入一针强心剂。
三、生态合围,国产AI全栈自主进入冲刺期从Kimi K3开源72小时内美股AI板块蒸发4700亿美元,到中国开源模型下载量占全球总量的41%,再到摩尔线程、百度等国产芯片与模型厂商接连跑通万亿级参数适配,国产AI全栈自主已从单点突破进入生态合围的质变阶段。
当大模型不挑卡、国产卡能跑大模型,整个产业的"芯片枷锁"就开始松动。正如K3技术报告展示的那样——AI正在从算法到硬件实现全栈自主工程能力,而这扇门,摩尔线程已经推开了。
综合第一财经、人民财讯、证券时报报道 | 2026-07-31