Google 計畫推出凍結 v2 AI 晶片以嵌入 Gemini 架構,可能在 2028 年前將推論效率提升 6-10 倍

根據 Beating,Google 正在開發 Frozen v2 AI 推論晶片。該晶片將 Gemini 的部分架構直接嵌入硬體,以在模型執行期間降低計算與資料移動的額外負擔。預期該晶片在每瓦效能方面的可處理 token 數量,將比 Google 最新一代 TPU 高出 6 到 10 倍;部署計畫最早可望在 2028 年進行。

此舉旨在解決 Google 日益惡化的晶片短缺問題,該問題已迫使 Google Cloud 取消外部客戶訂單。Frozen v2 將與 TPU 同步運作;雖然 TPU 支援多種模型,但 Frozen v2 更重視效率而非彈性。

免責聲明:本頁面資訊可能來自第三方來源,僅供參考,不代表 Gate 的立場或觀點,亦不構成任何財務、投資或法律建議。虛擬資產交易具有高風險,請勿僅依賴本頁資訊作出決策。詳情請參閱 免責聲明
回覆
0/400
暫無回覆