据 Beating 称,Google 正在开发 Frozen v2 AI 推理芯片。该芯片将把 Gemini 的部分架构直接嵌入硬件中,以在模型执行期间降低计算与数据传输开销。该芯片预计“每瓦特”处理的 token 数将比 Google 最新的 TPU 高 6 到 10 倍,并计划最早于 2028 年部署。
该举措旨在应对 Google 日益加剧的芯片短缺问题;短缺已迫使 Google Cloud 拒绝外部客户订单。Frozen v2 将与 TPU 并行运行。尽管 TPU 支持多种模型,Frozen v2 更强调效率而非灵活性。