英伟达于周二(7月21日)公布了其数据中心CPU“Vera”的更多技术细节,包括规格、性能测试结果与芯片架构。该公司表示,Vera芯片已于今年6月交付给包括OpenAI、Anthropic、SpaceX在内的客户。
Vera是英伟达首款从CPU核心开始自主设计的服务器处理器,而非采用Arm提供的现成核心设计。英伟达指出,Vera专门针对AI智能体运行过程中的性能瓶颈进行了优化,相较于采用x86架构(英特尔和AMD使用的架构)的CPU,在AI智能体任务上的性能提升约50%。Vera产品市场负责人Hannah Coutand表示,该芯片重点优化了单核速度、内存带宽以及延迟表现,旨在让AI智能体尽快将任务交还GPU,从而最大限度提升GPU这一AI工厂中最昂贵资产的利用率。
在AI浪潮兴起之前,CPU一直是服务器中最重要、最昂贵的组件。2022年ChatGPT发布时,第一代AI服务器通常采用“一颗CPU搭配最多八颗GPU”的架构,计算重心开始向英伟达GPU转移。但随着能够自主运行、仅需极少人工干预的Agentic AI(智能体AI)兴起,CPU的重要性再次提升,负责管理智能体运行并持续提供数据。英伟达超大规模计算业务副总裁Ian Buck表示,智能体让CPU变得“更加不可或缺”,尤其是CPU回答单个请求的速度变得越来越重要。
英伟达一直被视为信息技术行业的风向标,但在CPU领域仍处于挑战者位置,需要与两大成熟竞争对手——英特尔和AMD展开竞争。这两家公司长期深耕服务器CPU市场,并与超大规模云计算厂商建立了深厚合作关系。不过,未来一些云服务提供商可能会选择部署英伟达CPU,将成为新的战场。加码CPU也是英伟达垂直整合战略的又一体现,公司希望每年都能自主研发更多系统内部所需的芯片和技术,并最终向客户销售整柜(Rack)计算系统,而不仅仅是单独出售芯片。英伟达认为,这一策略能够进一步释放GPU性能,帮助其AI系统在面对AMD以及各类定制AI芯片竞争时,继续成为领先AI实验室的首选平台。
Vera既可作为独立CPU销售,也可搭配公司GPU使用。产品形态包括:单独销售的Vera CPU;由256颗Vera组成的液冷整柜系统;配备两颗Vera CPU的服务器配置;以及与英伟达GPU组成的Vera Rubin系统。Vera功耗范围约为250瓦至450瓦,支持最高1.5TB低功耗内存(LPDDR)。
市场观点方面,英伟达预计未来整个服务器CPU市场规模有望达到2000亿美元,而Bernstein今年稍早估计2025年成熟服务器CPU市场规模约为370亿美元。Wolfe Research今年5月预计,Vera芯片平均售价约为5000美元,英伟达今年出货量约130万颗,但英伟达拒绝评论产品定价。
部分分析师认为,英伟达实际上创造了一个AMD和英特尔尚未拥有对应产品的新CPU类别。Cambrian AI Research创始人Karl Freund表示,Vera不会用于网站托管等传统服务器任务,而将专门面向高强度AI计算。不过,要让大型云服务商全面采用这款CPU仍然面临挑战。Coutand表示,Vera目前仍处于市场导入初期,合作伙伴名单中除甲骨文外,尚未出现其他大型云服务商。但OpenAI计划从本季度开始大规模部署Vera芯片。Freund补充说,推出CPU本质上是为了让客户摆脱对英特尔和AMD CPU的依赖,同时把这部分收入也收入囊中,英伟达选择打造的是一种目前市场上其他厂商尚未提供的独特CPU。