AMD 已同意收购加拿大 AI 初创公司 Taalas,后者采用一种独特技术:将 AI 模型的架构与训练参数直接嵌入芯片硬件中。这一做法使推理速度极快,但代价是每颗芯片只能运行单一模型。据 The Decoder 报道,Taalas 的演示芯片在运行 Llama 3.1-8B 模型时,每用户每秒可处理超过 16,000 个 token,速度远超同类硬件。

Taalas 成立于 2023 年,总部位于多伦多,今年 2 月才结束隐身模式公开亮相。其核心思路是“把模型烧进硅片”,即通过硬件化模型权重,省去传统芯片在运行时加载和计算权重的步骤,从而大幅提升推理效率。不过,这种设计也意味着芯片无法灵活切换模型,一旦模型更新,可能需要重新设计芯片。

AMD 计划将 Taalas 的技术整合进其加速器路线图,并作为系统级解决方案与 Instinct GPU 一同提供。AMD AI 部门高级副总裁 Vamsi Boppana 表示,这笔交易将增强公司的 AI 产品组合。Taalas 联合创始人 Ljubisa Bajic 则称,AMD 提供了初创公司所需的规模与渠道。

值得注意的是,谷歌据报也在研发类似思路的芯片,用于其 Gemini 模型。这表明“模型硬件化”正成为 AI 芯片领域的一个新方向,尽管其灵活性受限,但在特定场景下可能具有性能优势。

此次收购尚需通过常规监管审批。交易完成后,Taalas 的技术将如何与 AMD 现有产品线融合,以及能否在竞争激烈的 AI 芯片市场中占据一席之地,仍有待观察。