根據《The Information》,Google 正在開發 Frozen v2,這是一款新的 AI 伺服器晶片,將 Gemini 的底層架構直接內嵌到矽片中,以讓推論效率最高提升 10 倍。與 GPU 這類通用型晶片,以及 Google 自家的 TPU 不同,Frozen v2 為了更高的推論效率與更低的耗能,犧牲了通用性,並將模型架構以硬編方式寫入硬體本身。
該專案源於 Google 嚴重的 AI 計算能力短缺,已使內部的 GPU 與 TPU 資源承受壓力,並影響了部分 Google Cloud 客戶。Google 已同意每月約支付 SpaceX 約 10 億美元,作為由 xAI 提供的 AI 計算能力,以填補基礎設施缺口。