🤖 人工智能 · 大模型

🔥 中国开源大模型包揽Hugging Face全球热度榜前两名,Kimi K3一小时登顶刷新纪录,百度Unlimited OCR一月后仍霸榜,标志着中国AI从跟跑到领跑的转折点。

一、Kimi K3一小时封神

7月27日晚,月之暗面正式开源Kimi K3完整模型权重,这个总参数达2.8万亿的巨无霸仅用不到一小时就冲上Hugging Face趋势榜第一,刷新该平台历史纪录。Hugging Face CEO发文感叹,模型30分钟内获超4000个赞。更让人振奋的是,在大模型编码评估系统Frontend Code Arena榜单中,Kimi K3以1679分力压Claude Fable 5、GPT-5.6 Sol等顶尖闭源模型,成为首个在该榜单超越闭源模型的开源模型

这背后是三项底层架构创新:KDA混合线性注意力机制让超长文本计算成本从平方级降到接近线性,Attention Residuals解决了深层网络信息衰减难题,Stable LatentMoE框架将路由专家扩展到896个。月之暗面企业业务负责人黄震昕透露,团队自研的Moon Clip二阶优化器能让训练数据效率翻倍——原本需要40T数据才能达到的效果,现在20T就够了

二、百度OCR凭什么二次登顶

紧随Kimi K3之后的百度Unlimited OCR同样不容小觑。这个专业OCR模型首发即登顶Hugging Face、GitHub等四个榜单,更厉害的是,发布一个月后下载量已达265万次,二次冲上榜首。图灵奖得主杨立昆亲自转发推荐,足见其技术含金量。

Unlimited OCR的核心突破在于解决了一个行业老大难:长文档解析。过去面对书籍、论文,模型只能"逐页解析+结果拼接",随着输出变长,显存和计算成本直线飙升。百度提出的R-SWA滑动窗口注意力机制,模仿人类抄录长文档时只保留最近一段"工作记忆"的方式,让模型能在一次推理中连续解析数十页文档,计算成本和显存占用不再随输出长度持续增长。这不只让OCR更快更准,更给大模型长程推理和记忆管理提供了全新思路。

三、中国开源模型的黄金时代

榜单包揽前两名绝不是偶然。全球AI模型聚合平台OpenRouter数据显示,7月20日至26日中国大模型周调用量达33万亿词元,连续13周稳居全球首位。高盛集团判断,中国开源模型的智能水平正达到面向全球扩散的"临界点"。阿里、华为、摩尔线程等厂商在Kimi K3开源的Day 0就完成适配,美国AI创企Cognition也将其接入Devin桌面客户端。

从DeepSeek到Kimi K3再到Unlimited OCR,中国大模型企业正在用开源和原创底层技术改写全球AI竞争格局。人民日报评论一针见血:"我国大模型企业的竞争力,正从扩大参数规模延伸到基础架构和原创算法层面。"

综合科技日报、人民日报、21世纪经济报道、每日经济新闻报道 | 2026年7月29日