Согласно Beating, Google разрабатывает чип для ИИ-инференса Frozen v2, который встраивает часть архитектуры Gemini прямо в аппаратное обеспечение, чтобы снизить вычислительные и накладные расходы на перемещение данных во время выполнения модели. Ожидается, что чип сможет обрабатывать до 6–10 раз больше токенов на ватт, чем новейший TPU от Google, а развертывание планируется как можно раньше — в 2028 году.
Инициатива направлена на решение ухудшающегося дефицита чипов у Google, из‑за которого Google Cloud уже был вынужден отклонять внешние заказы клиентов. Frozen v2 будет работать параллельно с TPU: тогда как TPU поддерживает различные модели, Frozen v2 делает приоритетом эффективность над гибкостью.