AMD重磅出手!把大模型"烧进"芯片,AI推理大战正式开打
就在马斯克高调宣布SpaceX/xAI独家采用NVIDIA GPU、让AMD股价单日重挫7%的当口,AMD反手打出一张让整个行业侧目的牌——正式签署协议收购AI推理芯片初创公司Taalas。这家2023年成立于加拿大的公司,干了一件极其"硬核"的事:不再让芯片去适应模型,而是反过来,把模型的权重直接烧录进芯片硬件,让推理数据流在物理层面固化。
结果就是惊人的性能跃迁。Taalas的首款芯片在跑Llama3.1-8B时,每秒输出token数超过16000枚,是同类竞品的数倍。这是一个什么概念?当别人还在用通用GPU"算"推理的时候,Taalas直接用硬件"念"出了答案。联合创始人Ljubisa Bajic说得直白:"围绕模型搭建硬件,从底层重新设计AI推理。"这不是优化,这是重构。
当然,这种"烧录"式方案的代价也很明显——芯片只支持单一模型,想换模型?对不起,重新流片。这种极致的专用化看似死板,却精准踩中了AI产业的一个关键转向:训练是过去式,推理才是未来。当大模型从"训练期"进入"规模化部署期",推理效率就是企业的生命线。谁能用更低的功耗、更快的速度把token吐出来,谁就掌握了AI落地的主动权。
AMD收购Taalas的野心,绝不只是拿到一块跑得快的芯片。将Taalas的专用推理引擎与自家Instinct GPU结合,打造系统级方案,这才是真正的杀招——既保留了GPU的通用性,又补上了推理性能的短板,直指NVIDIA的腹地。这不仅是技术反击,更是商业叙事的重塑:AI竞争的下半场,不再是堆算力,而是拼"把模型变成钱"的速度。
从更宏观的视角看,Taalas只是AI推理专用化浪潮中的一个缩影。当"通用"遇上"专用",当"训练"转向"推理",芯片行业的游戏规则正在被重写。AMD这一手,能否撼动NVIDIA的统治地位尚待观察,但有一点已经清晰:AI推理这片新战场,谁先押对技术路线,谁就能在下一轮洗牌中占得先机。
AI 生成 . DeepSeek | 搜索综合