Считается, что масштабирование нейросетей упирается лишь в закупку новых GPU и строительство гигантских дата-центров. Но Google решила пойти более радикальным путем и превратить софт в железо. По данным Reuters, компания разрабатывает специализированный серверный чип под кодовым названием Frozen v2. В отличие от универсальных тензорных процессоров, здесь часть логики модели Gemini будет буквально зашита на уровне кремния.
Идея аппаратного ускорения узких задач логична, но в контексте языковых моделей она выглядит рискованной. Чип проектируется исключительно для инференса — генерации ответов уже готовой нейросетью. Google рассчитывает получить прирост эффективности от 6 до 10 раз по количеству токенов на потребляемый ватт. Правда, развертывание этого экспериментального железа планируется только на 2028 год.
Вопрос в том, насколько оправданно фиксировать архитектуру в кремнии на таком динамичном рынке? Индустрия меняет подходы к оптимизации и структуре моделей практически каждый год. Зашивая логику Gemini в аппаратный слой сегодня, разработчики рискуют получить к релизу невероятно энергоэффективный, но безнадежно устаревший кусок текстолита. Либо Google делает ставку на то, что текущая парадигма трансформеров останется с нами надолго и базовые алгоритмы уже не изменятся.
Поделиться:
Как Claude Fable 5 опровергла гипотезу Якобиана и почему это не делает ИИ математиком
Нил Бломкамп выпустил 13-минутный научно-фантастический фильм NIGHTBORNE, полностью сгенерированный в нейросети Seedance 2.0