Google Berencana Membuat Chip AI v2 yang Dibekukan untuk Mengintegrasikan Arsitektur Gemini, sehingga dapat meningkatkan efisiensi inferensi 6–10x pada 2028
Menurut Beating, Google sedang mengembangkan chip inferensi AI Frozen v2 yang akan menanamkan sebagian arsitektur Gemini langsung ke dalam perangkat keras untuk mengurangi overhead komputasi dan perpindahan data selama eksekusi model. Chip ini diperkirakan mampu memproses hingga 6 sampai 10 kali lebih banyak token per watt dibanding TPU terbaru Google, dengan rencana implementasi sedini 2028.
Inisiatif ini bertujuan untuk mengatasi kekurangan chip Google yang semakin memburuk, yang bahkan telah memaksa Google Cloud menolak pesanan pelanggan eksternal. Frozen v2 akan beroperasi secara paralel dengan TPU; sementara TPU mendukung beragam model, Frozen v2 mengutamakan efisiensi dibanding fleksibilitas.
Penafian: Informasi di halaman ini mungkin berasal dari sumber pihak ketiga dan hanya untuk referensi. Ini tidak mewakili pandangan atau pendapat Gate dan bukan merupakan nasihat keuangan, investasi, atau hukum. Perdagangan aset virtual melibatkan risiko tinggi. Mohon jangan hanya mengandalkan informasi di halaman ini saat membuat keputusan. Untuk detailnya, lihat Penafian.