Google планирует выпустить замороженный чип v2 для ИИ на базе Gemini, чтобы встроить архитектуру Gemini; это может повысить эффективность инференса в 6–10 раз к 2028 году

Согласно Beating, Google разрабатывает чип для ИИ-инференса Frozen v2, который встраивает часть архитектуры Gemini прямо в аппаратное обеспечение, чтобы снизить вычислительные и накладные расходы на перемещение данных во время выполнения модели. Ожидается, что чип сможет обрабатывать до 6–10 раз больше токенов на ватт, чем новейший TPU от Google, а развертывание планируется как можно раньше — в 2028 году.

Инициатива направлена на решение ухудшающегося дефицита чипов у Google, из‑за которого Google Cloud уже был вынужден отклонять внешние заказы клиентов. Frozen v2 будет работать параллельно с TPU: тогда как TPU поддерживает различные модели, Frozen v2 делает приоритетом эффективность над гибкостью.

Дисклеймер: Информация на этой странице может быть получена из источников третьих сторон и предоставляется только для ознакомления. Она не отражает взгляды или мнения Gate и не является финансовой, инвестиционной или юридической рекомендацией. Торговля виртуальными активами связана с высоким риском. Пожалуйста, не основывайте свои решения исключительно на данных этой страницы. Подробнее смотрите в Дисклеймере.
комментарий
0/400
Нет комментариев