輝達於週二(7月21日)公佈了其資料中心CPU“Vera”的更多技術細節,包括規格、效能測試結果與晶片架構。該公司表示,Vera晶片已於今年6月交付給包括OpenAI、Anthropic、SpaceX在內的客戶。
Vera是輝達首款從CPU核心開始自主設計的伺服器處理器,而非採用Arm提供的現成核心設計。輝達指出,Vera專門針對AI智慧體執行過程中的效能瓶頸進行了最佳化,相較於採用x86架構(英特爾和AMD使用的架構)的CPU,在AI智慧體任務上的效能提升約50%。Vera產品市場負責人Hannah Coutand表示,該晶片重點優化了單核速度、記憶體頻寬以及延遲表現,旨在讓AI智慧體儘快將任務交還GPU,從而最大限度提升GPU這一AI工廠中最昂貴資產的利用率。
在AI浪潮興起之前,CPU一直是伺服器中最重要、最昂貴的元件。2022年ChatGPT釋出時,第一代AI伺服器通常採用“一顆CPU搭配最多八顆GPU”的架構,計算重心開始向輝達GPU轉移。但隨著能夠自主執行、僅需極少人工干預的Agentic AI(智慧體AI)興起,CPU的重要性再次提升,負責管理智慧體執行並持續提供資料。輝達超大規模計算業務副總裁Ian Buck表示,智慧體讓CPU變得“更加不可或缺”,尤其是CPU回答單個請求的速度變得越來越重要。
輝達一直被視為資訊科技行業的風向標,但在CPU領域仍處於挑戰者位置,需要與兩大成熟競爭對手——英特爾和AMD展開競爭。這兩家公司長期深耕伺服器CPU市場,並與超大規模雲端計算廠商建立了深厚合作關係。不過,未來一些雲服務提供商可能會選擇部署輝達CPU,將成為新的戰場。加碼CPU也是輝達垂直整合戰略的又一體現,公司希望每年都能自主研發更多系統內部所需的晶片和技術,並最終向客戶銷售整櫃(Rack)計算系統,而不僅僅是單獨出售晶片。輝達認為,這一策略能夠進一步釋放GPU效能,幫助其AI系統在面對AMD以及各類定製AI晶片競爭時,繼續成為領先AI實驗室的首選平台。
Vera既可作為獨立CPU銷售,也可搭配公司GPU使用。產品形態包括:單獨銷售的Vera CPU;由256顆Vera組成的液冷整櫃系統;配備兩顆Vera CPU的伺服器配置;以及與輝達GPU組成的Vera Rubin系統。Vera功耗範圍約為250瓦至450瓦,支援最高1.5TB低功耗記憶體(LPDDR)。
市場觀點方面,輝達預計未來整個伺服器CPU市場規模有望達到2000億美元,而Bernstein今年稍早估計2025年成熟伺服器CPU市場規模約為370億美元。Wolfe Research今年5月預計,Vera晶片平均售價約為5000美元,輝達今年出貨量約130萬顆,但輝達拒絕評論產品定價。
部分分析師認為,輝達實際上創造了一個AMD和英特爾尚未擁有對應產品的新CPU類別。Cambrian AI Research創始人Karl Freund表示,Vera不會用於網站託管等傳統伺服器任務,而將專門面向高強度AI計算。不過,要讓大型雲服務商全面採用這款CPU仍然面臨挑戰。Coutand表示,Vera目前仍處於市場匯入初期,合作伙伴名單中除甲骨文外,尚未出現其他大型雲服務商。但OpenAI計劃從本季度開始大規模部署Vera晶片。Freund補充說,推出CPU本質上是為了讓客戶擺脫對英特爾和AMD CPU的依賴,同時把這部分收入也收入囊中,輝達選擇打造的是一種目前市場上其他廠商尚未提供的獨特CPU。