Google создаёт чип Frozen v2, встраивающий архитектуру Gemini прямо в кремний

Google внутри компании разрабатывает новый серверный чип под названием «Frozen v2», в который прямо в кремний встроена архитектура модели Gemini. По данным источников издания The Information, такой чип может оказаться в 6, 10 раз эффективнее нынешних чипов TPU при обработке ответов ИИ. Google планирует начать развёртывание Frozen v2 с 2028 года и рассматривает его как пробный проект для специализированных чипов, объёмы производства будут заметно меньше, чем у линейки TPU.
В отличие от TPU, которые работают с самыми разными моделями, Frozen v2 содержит часть структуры именно Gemini, встроенную непосредственно в аппаратную часть. Название отсылает к практике «заморозки» параметров модели, когда значения фиксируют и они перестают меняться: во Frozen v2 часть модели навсегда «заморожена» прямо в чипе, что сокращает число вычислительных шагов и ускоряет ответы.
Первоначальную идею предложил Джефф Дин, главный научный сотрудник Google DeepMind. Его первый вариант чипа под названием Frozen предполагал встраивание в кремний самих весов модели, конкретных настроенных параметров, определяющих, как модель отвечает на запросы. От этого подхода Google отказался: такой чип работал бы только с одной-единственной версией Gemini и слишком быстро устарел бы.
Frozen v2 выбирает более гибкий путь: в кремний встраивается архитектура, то есть общая схема модели, а не сами настроенные параметры. Новые веса на такой чип по-прежнему можно загружать. Какая именно доля архитектуры будет зашита аппаратно, пока не решено, об этом также сообщает The Information.
Поскольку чип работает только до тех пор, пока Google использует ту же архитектуру модели, продуктом для внешних клиентов он, скорее всего, не станет. Google уже сдаёт TPU в аренду Meta, предлагает их внешним облачным клиентам и продвигает через программу «TPU@Premises» как альтернативу чипам Nvidia, с внутренней целью занять десять процентов годовой выручки Nvidia. Frozen v2, в отличие от этого, призван снять внутренний дефицит вычислительных мощностей для ИИ у самой Google.
Если чип оправдает ожидания, он может стать серьёзным конкурентным преимуществом: в ИИ-бизнесе маржа всё сильнее зависит от того, насколько хорошо компания оптимизирует издержки на инференс. С помощью Frozen v2 Google сможет предлагать мощные модели по более низким ценам и отвоёвывать долю рынка у OpenAI и Anthropic.
Ключевые факты
- Google внутренне разрабатывает серверный чип «Frozen v2», встраивающий архитектуру модели Gemini прямо в кремний
- По данным источников The Information, чип может быть в 6, 10 раз эффективнее нынешних TPU при обслуживании ИИ-ответов; развёртывание планируется с 2028 года
- Идею предложил Джефф Дин из Google DeepMind: первая версия чипа замораживала веса модели, но так чип устаревал бы слишком быстро, Frozen v2 замораживает архитектуру, а веса остаются загружаемыми
- Чип рассматривается как внутренний инструмент против дефицита вычислительных мощностей, а не как продукт для внешних клиентов, в отличие от TPU, которые Google сдаёт в аренду Meta и другим
- Цель, снизить издержки на инференс и получить конкурентное преимущество перед OpenAI и Anthropic
Почему это важно
Издержки на инференс, то есть на обработку каждого запроса к уже обученной модели, становятся ключевым фактором прибыльности ИИ-бизнеса. Frozen v2 показывает, что Google готова жертвовать гибкостью чипа (он привязан к архитектуре Gemini) ради выигрыша в скорости и стоимости обработки запросов в 6, 10 раз. Это шаг к узкоспециализированному «железу» под конкретную модель, направление, которое может задать тренд для всей отрасли.
Кому это важно
В первую очередь, самой Google и её облачному бизнесу: чип должен снять внутренний дефицит вычислительных мощностей под растущую нагрузку от Gemini. Косвенно это касается конкурентов, OpenAI и Anthropic, поскольку более дешёвый инференс у Google может ударить по их ценовым позициям. Внешних клиентов TPU (например, Meta) новость не затрагивает напрямую, Frozen v2 не планируется как коммерческий продукт.
Как это применить
Разработчикам и компаниям, использующим Gemini через API Google, изменения будут заметны лишь косвенно, как потенциальное снижение цен или рост доступности мощностей после 2028 года, когда чип должен быть развёрнут. Прямого доступа к Frozen v2 или его аналогам у внешних пользователей не будет: чип остаётся внутренней инфраструктурой Google.
Можно ли доверять
Материал основан на данных источников издания The Information, а не на официальном заявлении Google, компания подробности не подтверждала. Не решено даже то, какая доля архитектуры Gemini в итоге будет зашита в кремний. Это ранняя стадия инженерного проекта с прицелом на 2028 год, и детали могут измениться.
Риски и подводные камни
Главный риск уже проявился на предыдущей итерации: первый вариант чипа, замораживавший веса модели, оказался бы привязан к одной версии Gemini и быстро устарел, поэтому Google от него отказалась. Тот же риск морального устаревания сохраняется и для архитектуры: если Google обновит структуру Gemini, чип, заточенный под старую версию, может потерять смысл. Плюс, объём производства Frozen v2 изначально закладывается меньшим, чем у линейки TPU, то есть это скорее эксперимент, чем гарантированно масштабируемое решение.
Компания Meta Platforms признана экстремистской организацией, её деятельность на территории РФ запрещена.