🤖 AI大模型 · 开源生态
一、K3把家底儿亮出来了,但最值钱的没写在纸上🔥 Kimi K3把模型权重、技术报告全公开了,但支撑2.8万亿参数训练的底层Infra——从芯片调度到集群编排——才是别人抄不走的核心壁垒。
7月27日深夜,月之暗面一次性放出Kimi K3的完整模型权重、技术报告和三项底层Infra技术,全球开发者可以免费下载部署。2.8万亿参数、MoE混合专家架构(896个专家,每token仅激活16个)、100万token上下文窗口——这些数字足够炸裂。但真正让行业沉默的,是技术报告之外的东西:月之暗面在并不宽裕的算力条件下,靠自研的KDA混合线性注意力机制和注意力残差技术,把规模化效率提升了2.5倍,单位算力产出等于原来的2.5倍。这些底层架构创新,三五年才更新一次,月之暗面两年内全给它换了。
公开论文和权重是一回事,把整个训练管线跑起来是另一回事。MoonEP等Infra组件涉及芯片适配、集群调度、故障恢复、分布式通信,这不是读论文能复现的。就像给你法拉利的图纸和零件清单,没有那套装配线和调试环境,你自己攒出来的可能连夏利都跑不过。
二、算力48小时打满,开源反而引爆了需求K3上线不到48小时,现有集群就被用户请求量直接打满,月之暗面被迫暂停C端新用户订阅,全力保障已有用户。这打了那些说"开源模型会杀死算力需求"的人一记响亮的耳光。事实恰恰相反:开源降低了使用门槛,更多企业接入、更多场景部署,推理算力需求不降反升。银河证券研报明确指出,K3已实现与多家国产算力平台的Day 0极速适配,正在拉动国产超节点服务器、交换机、光模块、液冷等一整条产业链。
高盛在研报中给了一个震撼定性:"这标志着中国模型走向定价权的全新节点。"K3未缓存输入20元/百万Token,是DeepSeek V4 Pro的20倍,但仅为GPT-5.6的60%、Fable 5的30%。中国模型第一次在全球范围内有了定价话语权,靠的不是压价,是技术和性能的硬实力。
三、开源这张牌,打出了生态纵深K3开源后,Arena榜单上中国模型首次超越所有闭源对手登顶。黄仁勋转发133家机构联名信声援开源,马斯克在X上点赞K3"令人印象深刻"并喊话Grok 4.5要"超过Kimi"。从被制裁到被追赶,这翻篇速度比AI迭代还快。但热闹背后,真正决定胜负的是生态厚度。全球AI聚合平台OpenRouter数据显示,中国大模型周调用量已达33万亿词元,连续13周全球第一。安卓免费但靠应用商店和广告赚得盆满钵满——K3走的是一样的路:模型开源、生态吸量、商业服务变现。
月之暗面Kimi企业业务负责人黄震昕说得很直白:"行业里最基础的三个核心技术,八到十一年没被更新过,我们这两年都把它更新了。"论文可以读,代码可以抄,但要把这些底层创新真正跑进一套稳定、高效、可扩展的训练系统里,靠的是工程团队的肌肉记忆和踩坑经验——这是Infra最难抄的部分,也是月之暗面真正的护城河。
综合科技日报、人民日报、中国企业家、银河证券研报报道 | 2026-08-03