💻 AI算力 · 芯片生态

🔥 AI编程代理用一周末干掉了英伟达CUDA花了20年筑起的生态城墙,AI芯片游戏规则正在被重写。

一、一个周末,改写二十年

英伟达CUDA生态积累了近二十年的技术资产:600万开发者、超过400个加速库,以及从编译器到框架适配的完整软件栈。这套生态形成了一种深度锁定——AI公司训练的模型、积累的代码库、培养的工程师团队,全都附着在CUDA之上。迁移成本不仅涉及资金,更意味着几个季度甚至几年的工程时间

然而2026年7月23日,在AMD Advancing AI 2026大会上,Anthropic联合创始人Tom Brown披露了一枚深水炸弹:他们的工程团队仅凭Claude模型,在一个周末内自动完成了AMD Instinct MI355芯片与ROCm平台的全套适配与性能调优。原本预期是"一个大项目",结果一名工程师让Claude执行任务后,流程在周末自行运转,周一便拿到了持续攀升的实际性能曲线。有与会分析师当场评论:"我们已经过了CUDA护城河时代。"

二、从实验室到生产级,适配范式变了

其实今年4月就有第三方开发者用Claude Code将CUDA后端代码移植到ROCm平台,全程只花了30分钟。但那毕竟是实验室小规模验证。Anthropic这次做的是生产级适配,跑出的不是简单"能跑",而是持续优化的性能曲线。过去这类工作需要投入一个工程师团队逐季推进,如今被AI模型在一个周末搞定。

与此同时,AMD的ROCm生态也在加速追赶。PyTorch 2.x已官方稳定支持AMD GPU,ONNX Runtime获得官方支持,vLLM核心功能已在MI300X上跑通。2026年7月,AMD还推出了ROCm认证项目,从开发者供给端系统性解决生态瓶颈。更关键的是,AMD发布了ROCm.ai全域AI软件平台,被高管称为"自战略早期以来最大的软件飞跃",并与OpenAI、Anthropic展开深度合作。

三、硬件+客户双突破,AMD全栈出击

AMD不只想卖芯片。Helios整机架方案集成了72颗GPU、总计31TB HBM4内存,纵向扩展带宽达260 TB/s。苏姿丰透露,每投入1美元可产生的Token数量比竞品高出30%。Anthropic、OpenAI和Meta已确定部署Helios系统,AMD与Anthropic的合作更是签下2吉瓦算力部署大单,首个1吉瓦将于2027年上半年交付。AMD股价虽短期波动,Wedbush已将目标价上调至600美元。

综合钛媒体、智通财经、快科技报道 | 2026年7月31日