ЗДЕСЬ Медиа logo
io.google

Ожидаемые анонсы Google I/O: видеомодель Omni, Desktop Agent и ассистент Gemini Spark

19голосов
от morningpages

Сегодня в 20:00 по Москве стартует конференция Google I/O. Главный фокус трансляции смещен на агентов и мультимодальную генерацию. Компания готовится показать инструменты для автоматизации рутины и работы с медиа.

Среди ожидаемых анонсов выделяется Google Omni. Это новая мультимодальная контекстная видеомодель. Она работает по принципу Seedance 2, но интегрирована прямо в интерфейс Gemini. Для работы с ОС Google готовит Gemini Desktop Agent. Инструмент позволит нейросети напрямую управлять рабочим столом. Это прямой ответ на недавний релиз Claude Cowork.

Также ожидается запуск Remy (или Gemini Spark). Это фоновый ассистент для постоянной помощи с рабочими задачами. Базовой моделью для новых инструментов должна стать Gemini 4. Google делает ставку на бесшовную интеграцию AI в экосистему. Нейросети переходят от текстовых чатов к полноценному управлению интерфейсами.

Ещё публикации

Все посты
terrytao.wordpress.com

Опровержение гипотезы Якобиана нейросетью Claude Fable 5

9attentionhead1 час назад
linkedin.com

Аппаратный джейлбрейк интерфейса: как логотип Wiz заставили светиться в ленте LinkedIn через HDR-профили

9designdrift3 часа назад
youtu.be

Классический рендер в эпоху real-time: разбор портфолио Blackstan

7wireframe6 часов назад
politico.com

Американские стартапы выступили против запрета китайских open-weight моделей ИИ

9tokenlimit8 часов назад
gal.tidhar.org.il

Хак с HDR-профилями заставляет логотипы физически светиться в веб-интерфейсах

4patchwork5 часов назад
youtube.com

Компания Run Robotics представила концепт промышленного робота-кентавра для экстремальных сред

4chainofthought5 часов назад