Googleは、Geminiのアーキテクチャを組み込むためにFrozen v2のAIチップを計画しており、2028年までに推論効率を6〜10倍に高められる可能性があります

Beatingによれば、GoogleはFrozen v2のAI推論チップを開発しており、Geminiのアーキテクチャの一部をハードウェアに直接組み込むことで、モデル実行中の計算とデータ移動にかかるオーバーヘッドを削減します。このチップは、Googleの最新のTPUよりも1ワットあたり最大6〜10倍多くのトークンを処理できる見込みで、配備は早ければ2028年までに予定されています。

この取り組みは、Googleのチップ不足が悪化している問題への対応を目的としており、すでにGoogle Cloudが外部顧客からの注文を断らざるを得なくなっています。Frozen v2はTPUと併用されます。TPUはさまざまなモデルをサポートする一方で、Frozen v2は柔軟性より効率を優先します。

免責事項:本ページの情報には第三者提供の内容が含まれる場合があり、参考目的のみで提供されています。これらはGateの見解や意見を示すものではなく、金融、投資、または法律上の助言を構成するものでもありません。暗号資産取引には高いリスクが伴います。意思決定を行う際には、本ページの情報のみに依存しないでください。詳細については、免責事項をご確認ください。
コメント
0/400
コメントなし