当地时间周三,英伟达发布第二财季财报的同时,亚马逊与英伟达宣布扩大合作伙伴关系,以应对AI基础设施日益增长的需求。两家公司计划于2027年至2028年间,在亚马逊云科技(AWS)全球基础设施中额外部署200万块英伟达GPU,使总部署量达到300万块。
尽管英伟达财报显示营收与业绩指引均高于市场预期,但股价在盘后交易时段一度跳水。然而,在亚马逊宣布加购芯片以及英伟达首席财务官预计2028财年收入将增长约70%的乐观表态刺激下,盘后股价大幅拉升,截至发稿上涨4.71%。
亚马逊在声明中表示,此次扩大合作将对自家定制自研芯片形成补充,使AWS客户可以自主选择AI计算所用的硬件。亚马逊提供用于AI计算的Trainium芯片。此外,亚马逊将在其全球基础设施中部署多达300万块英伟达AI GPU,为智能体AI、自动化、物理AI及其他应用提供算力支持,其中10万块GPU将分配给专门为美国政府建造的“AI工厂”。
此次扩大合作是双方在3月GTC大会宣布合作的基础上进行的。3月份的合作涵盖了100万块英伟达AI GPU,而此次将再追加200万块。最新交易涉及的芯片包括英伟达的Blackwell Ultra、Rubin和Rubin Ultra显卡,这些产品单价预计至少为数万美元,但大客户可享受折扣。
同时,AWS还将扩大英伟达Blackwell的部署规模,包括为Amazon EC2 G7实例配备英伟达RTX PRO 4500 Blackwell服务器版GPU。AWS成为首家为用户提供搭载RTX PRO 4500计算实例的主要云服务提供商。
双方合作还扩展至AI工厂、CPU、网络、开放模型、数据处理及机器人技术等多个领域。AWS和英伟达计划将基于Vera CPU的基础设施引入AWS平台,Vera专为需要高性能CPU算力与加速基础设施协同运行的AI工作负载而设计。由于智能体AI计算的需求,CPU在AI基础设施建设中的作用日益凸显。
此外,亚马逊将与英伟达合作,利用后者的NVHBM技术,为其Trainium芯片提供能效更高的内存。英伟达周三早些时候发布了NVHBM,并声称其带宽比HBM4E内存提升30%,能效提升15%。
AWS首席执行官马特·加曼(Matt Garman)表示,客户希望自由选择最适合其AI工作负载的工具,同时确保所有系统无缝协同运作。英伟达创始人兼首席执行官黄仁勋表示,英伟达与AWS共同打造了AI时代最强劲的增长引擎之一,市场需求已超出所有预测。他提到,16年来双方携手在云端扩大英伟达的计算能力,如今合作扩展到全栈,涵盖GPU、CPU、网络、开源模型和软件,以史无前例的速度和规模让智能体AI和物理AI成为现实。
英伟达Nemotron系列开放模型现已在Amazon Bedrock和Amazon SageMaker上正式提供。AWS与英伟达还通过Amazon EC2 G7实例,在Amazon EMR上实现GPU加速数据处理。此外,亚马逊机器人部门正与英伟达合作,利用英伟达物理AI平台(包括Jetson平台、Omniverse库和Isaac开放机器人开发平台)开发下一代机器人。
此次合作扩大反映了AI基础设施需求的持续高涨,也凸显了英伟达在AI芯片市场的领先地位。对于亚马逊而言,此举既补充了其自研芯片,也为客户提供了更多硬件选择,有助于巩固AWS在云计算市场的竞争力。分析师认为,这一合作将进一步推动AI算力市场的增长,但同时也需关注芯片供应和成本压力。