Google разрабатывает ИИ-чип Frozen v2, который «зашьет» архитектуру Gemini непосредственно в кремний
Google работает над новым серверным ИИ-чипом под внутренним названием Frozen v2, который должен существенно повысить эффективность выполнения моделей Gemini. По данным The Information, компания планирует реализовать часть архитектуры модели непосредственно на аппаратном уровне, что позволит сократить энергопотребление и увеличить производительность инференса. Проект пока находится на ранней стадии и официально не анонсирован.
Frozen v2 разрабатывается как специализированный ускоритель для обслуживания моделей Gemini. В отличие от традиционных ИИ-чипов, которые остаются универсальными и могут выполнять различные архитектуры нейросетей, новый процессор будет оптимизирован под конкретную модель Google. Предполагается, что часть вычислений и структуры Gemini будет реализована непосредственно в кремнии, что сократит объем вычислений во время инференса.
Ожидается, что такой подход позволит добиться шестикратного–десятикратного роста энергоэффективности по сравнению с актуальными TPU Google. При том же энергопотреблении чип сможет обрабатывать значительно больше токенов, что особенно важно на фоне стремительного роста затрат на обслуживание генеративных моделей. По данным Reuters, нехватка вычислительных мощностей уже вынуждала подразделение Google Cloud отказываться от некоторых контрактов с корпоративными клиентами.
Frozen v2 не должен заменить существующие TPU, а станет их дополнением. Если текущие TPU рассчитаны на широкий спектр задач обучения и инференса, то новый процессор будет максимально оптимизирован именно для моделей Gemini. Предполагаемый срок появления первых систем на базе Frozen v2 — не ранее 2028 года.
Но! Поскольку ключевые элементы архитектуры модели окажутся зафиксированы на аппаратном уровне, будущие версии
Читать на habr.com

