Google готовит специализированный серверный ИИ-чип с внутренним названием Frozen v2i, в котором часть архитектуры модели Gemini будет аппаратно закреплена в кремнии, а не выполняться как обычная программа. По данным The Information, это должно дать в 6–10 раз больше обработанных токенов на единицу энергии по сравнению с нынешними TPUi и снизить дефицит вычислительных мощностей у Google. Первое развёртывание ожидается не раньше 2028 года.
Плата за эффективность — потеря гибкости: если ключевые элементы модели зафиксированы в кремнии, будущие версии Gemini должны сохранять совместимую архитектуру, а крупные изменения модели потребуют разработки нового чипа. Это ещё теснее свяжет модели Google и его инфраструктуру, и без того менее зависимую от Nvidia благодаря TPU.
ВыводЧип предназначен прежде всего для инференса — генерации ответов уже обученной моделью, а не для её тренировки.