據科技媒體The Information援引內部訊息報道,谷歌正在開發一款代號為“Frozen v2”的新型伺服器晶片,其核心創新在於將Gemini AI模型的架構直接固化到矽片中。這一設計思路與谷歌現有的TPU(張量處理單元)截然不同——TPU是通用型AI加速器,可適配多種模型,而Frozen v2則專為Gemini架構定製,將部分模型結構永久“凍結”在硬體層面。
訊息人士稱,Frozen v2在AI推理效率上可能比當前TPU提升6至10倍。這種效率飛躍源於其獨特的設計:通過將模型架構硬編碼進晶片,減少了計算步驟,從而加快響應速度。該晶片預計於2028年開始部署,但產量將遠低於TPU系列,谷歌將其視為專用晶片的一次試驗性嘗試。
這一創意最初來自谷歌DeepMind首席科學家傑夫·迪恩(Jeff Dean)。他早先提出的“Frozen”第一代方案曾計劃將模型權重直接嵌入晶片——權重是決定AI模型如何響應查詢的具體引數。但該方案因晶片只能適配單一版本的Gemini、且會迅速過時而被放棄。Frozen v2則採取了更靈活的策略:它固化的是模型架構(即底層藍圖),而非權重;新的權重仍可後續載入到晶片上。不過,據The Information報道,具體有多少架構將被硬編碼尚未最終確定。
由於Frozen v2僅在與谷歌保持相同模型架構時才能工作,它很可能不會作為對外產品出售。相比之下,谷歌已向Meta出租TPU、向外部雲客戶提供TPU服務,並通過“TPU@Premises”專案將其定位為輝達的替代方案,內部目標是從輝達年收入中奪取10%的份額。Frozen v2則主要服務於谷歌內部AI計算資源的緊張需求。
若該晶片達到預期效率,它可能成為谷歌在AI領域的重大競爭優勢。在AI業務中,推理成本的最佳化正日益決定利潤率。谷歌可利用Frozen v2以更低價格執行強大模型,從而從OpenAI和Anthropic手中奪取市場份額。對於馬斯克旗下的SpaceXAI(原xAI)而言,這意味著其競爭對手谷歌在成本結構上可能獲得顯著優勢,進一步加劇AI大模型市場的價格戰。