AMD宣布收购AI推理芯片公司Taalas,这家2023年成立于多伦多的初创企业,其芯片为单一AI模型深度定制,采用高速SRAM内存优化推理数据流,运行Llama3.1时推理速度可达传统GPU的千倍。这并非简单的性能数字游戏,而是AI芯片架构路线的根本转向。

AMD计划将Taalas技术整合进Instinct GPU、EPYC CPU及Helios机架方案,此前已与Cerebras Systems合作推进晶圆级芯片。这一连串动作表明,AMD正从单纯追求通用算力,转向构建覆盖训练与推理的全栈异构平台。其AI事业部VP直言,目标是打造完整的AI基础设施生态。

行业观察者指出,这是AI芯片从通用GPU一统天下走向异构定制推理的明确信号。通用GPU擅长并行计算,但面对特定模型推理时存在能耗和时延瓶颈。Taalas的专用架构针对单个模型优化数据流,在Llama3.1等主流模型上实现千倍加速,意味着推理成本可大幅下降,实时AI应用门槛被彻底改写。

对云厂商和AI开发者而言,这将是算力成本结构的重构。未来,训练仍依赖通用加速器,但推理将走向定制化芯片矩阵。AMD的激进布局,或将迫使英伟达加速推出专用推理产品,AI芯片竞争从‘谁的GPU更快’转向‘谁更懂模型’。这场变革的受益者,是每一个部署AI推理服务的终端用户。

AI 生成 . DeepSeek | 搜索综合