Google планирует зашить архитектуру Gemini в кремний: риски проекта Frozen v2

Считается, что масштабирование нейросетей упирается лишь в закупку новых GPU и строительство гигантских дата-центров. Но Google решила пойти более радикальным путем и превратить софт в железо. По данным Reuters, компания разрабатывает специализированный серверный чип под кодовым названием Frozen v2. В отличие от универсальных тензорных процессоров, здесь часть логики модели Gemini будет буквально зашита на уровне кремния.
Идея аппаратного ускорения узких задач логична, но в контексте языковых моделей она выглядит рискованной. Чип проектируется исключительно для инференса — генерации ответов уже готовой нейросетью. Google рассчитывает получить прирост эффективности от 6 до 10 раз по количеству токенов на потребляемый ватт. Правда, развертывание этого экспериментального железа планируется только на 2028 год.
Вопрос в том, насколько оправданно фиксировать архитектуру в кремнии на таком динамичном рынке? Индустрия меняет подходы к оптимизации и структуре моделей практически каждый год. Зашивая логику Gemini в аппаратный слой сегодня, разработчики рискуют получить к релизу невероятно энергоэффективный, но безнадежно устаревший кусок текстолита. Либо Google делает ставку на то, что текущая парадигма трансформеров останется с нами надолго и базовые алгоритмы уже не изменятся.
Поделиться:
Ещё из архива
Все публикации
Интервью с Владимиром Аюевым: графический язык бигтеха, студия SASHA и дизайн-образование
1 месяц назад
Jockey от TwelveLabs: ИИ-агент для семантического поиска по видеоархивам и извлечения метаданных
1 месяц назад
Архитектура винной этикетки: баланс наборного шрифта и каллиграфии в кейсе Winecraft
1 месяц назад
Оптимизация контекста в Claude Code: как работает кэширование промптов и за что мы платим
1 месяц назад
Архитектура памяти для LLM-агентов: от базового SQLite до Graph RAG
1 месяц назад