Google встраивает Gemini в чип Frozen v2: производительность ИИ вырастет до 10 раз

Google разрабатывает специализированный серверный процессор Frozen v2, в котором модель Gemini станет частью самого чипа, а не будет загружаться в память. Как сообщает The Information, такой подход может увеличить энергоэффективность в 6–10 раз по сравнению с текущими ускорителями Google.
В современных ИИ-ускорителях модель хранится в памяти, и процессор постоянно обменивается с ней данными. В случае Frozen v2 структура нейронной сети Gemini будет «зашита в кремний» — обновлять можно будет только веса модели, а архитектура останется неизменной. Насколько глубокая интеграция запланирована, пока уточняется.
Главная цель — резкое снижение энергопотребления и стоимости обслуживания. Новый чип сможет обрабатывать в 6–10 раз больше токенов на ватт, чем нынешние TPU. Это критично для Google, так как нехватка вычислительных мощностей уже вынудила Google Cloud отказывать некоторым внешним клиентам.
Frozen v2 рассматривается как отдельная линейка процессоров, которая дополнит существующие TPU, а не заменит их. Похожий подход уже продвигает стартап Taalas, создающий чипы с «запечатанной» архитектурой и весами модели.
У концепции есть и недостаток: ИИ развивается быстро, и аппаратное решение, ориентированное на текущую версию Gemini, к моменту выхода может устареть. Google официально проект не подтвердил, но отмечает, что экспериментирует с высокоэффективными вычислительными решениями.
По данным The Information, возможное появление Frozen v2 ожидается не раньше 2028 года. Компания пока не раскрывает детали архитектуры и точные сроки.







