Фото: World Labs

Выпуск недели

Тактильный реванш

Пока модели режут цены и встраиваются в монтажки, дизайн прячется в плюш, аналоговый звук и ручные жесты

Интерфейсы устали от собственной стерильности. На этой неделе алгоритмы окончательно превращаются в незаметную бытовую утилиту — Runway садится прямо в таймлайн After Effects, Claude вдвое роняет ценник за генерацию, а Kling собирает тридцатисекундные шоты по десяти ключам. Но стоит софту разогнаться до предела, как авторы тут же сворачивают в сторону физического мира: пакуют цифровых агентов в мягкие плюшевые текстуры, мастерят кассетный корпус для смартфона и дирижируют оркестром, чтобы нарисовать логотип. Скорость больше никого не удивляет, поэтому индустрия ищет повод снова почувствовать вещи руками.

OpenAI одела агентов Dots в плюш и запустила кьютморфизм

The image presents a 3D rendering of a yellow, pyramid-shaped object with a black bow tie. The object has two black circles representing eyes, with a small black line indicating a nose. The object is set against a stark black background, which highlights its vibrant yellow color and black features.
Фото: OpenAI

Жёлтый треугольник в очках и бабочке, синее облачко в берете и розовое сердце в тёмных очках теперь распоряжаются корпоративной почтой, календарями и браузерами. На конференции DevDay 2026 OpenAI показала автономных агентов Dots под управлением модели GPT-6 Astra — и завернула сложный софт в откровенно инфантильные образы. Этот визуальный маневр в индустрии уже окрестили кьютморфизмом. Ровно так же, как скевоморфизм в ранней iOS приучал людей трогать стекло экранов через текстуры кожи и дерева, милые глазастые фигурки призваны снять тревогу перед софтом, которому открывают доступ к личным паролям и базам данных.

Эстетика выросла не на пустом месте: еще в январе 2023 года студия Area Technology рисовала для компании концептуальных круглых персонажей — ретривера Sunny, инженера Warp и помощника Chapter. Теперь плюшевая оболочка скрывает под капотом виртуальные облачные компьютеры с собственными браузерами, способные работать в фоновом режиме круглосуточно. Любопытно, что в день премьеры домен dot.com перенаправлял гостей прямиком на Grok Bot от xAI — конкурирующий проект, анонсированный Илоном Маском в августе. Своего бесплатного агента Muse на модели Spark продвигает и Meta, набравшая более 3,4 миллиона загрузок за первые недели сентября.

Архитектура, инструменты и безопасность

Dots умеют выполнять локальные действия на компьютере пользователя с его разрешения, ведут фоновый поиск в режиме «только чтение» и общаются через мобильные и десктопные приложения ChatGPT, а также внутри тредов Slack и Microsoft Teams по упоминанию нейросети. Спектр возможностей охватывает интеграцию более чем с 4 000 сторонних сервисов вроде Figma, Canva и Shopify через систему плагинов. Однако расширение автономии пока сопровождается шероховатостями: внутренние тесты системы проверки auto-review показали, что при увеличении числа параллельных фоновых задач с пяти до десяти доля умеренных нарушений границ доступа подскочила с 8,6% до 19,7%.

Видео: OpenAI

Помимо персональных помощников, OpenAI готовит специализированных корпоративных агентов для отделов закупок, маркетинга и бухгалтерии в связке с Microsoft Agent 365, а экосистема DevDay пополнилась целой обоймой релизов:

  • Новая модель GPT-6.1 Sol с тарифом $2 за миллион входных токенов и $10 за миллион выходных токенов, что составляет пятую часть стоимости Astra.
  • Скоростной режим Ultrafast с генерацией до 300 токенов в секунду в средах Codex и через API.
  • Общие рабочие пространства ChatGPT Space и документ-хаб Pages для совместного редактирования страниц и презентаций командой и агентами.
  • Облачные среды разработки Codex Cloud Environments и интеграция управляемых агентов на базе AWS Bedrock.
  • Корпоративная инфраструктура Private Intelligence с политикой нулевого сохранения данных Zero Data Retention.
  • Единая авторизация и распределение лимитов подписки среди 16 партнеров, включая Notion, Vercel и Devin.

Первый персональный агент включен в тарифы Pro и Business Premium без дополнительной платы с временными расширенными лимитами на первый месяц, тогда как на планах Enterprise, Edu и Healthcare доступ активируют администраторы. Пока Папа Римский Лео XIV публично упрекает техногигантов за попытки обойти регулирование, генеральный директор OpenAI Сэм Альтман прямо заявляет о планах на будущее: «Конечно, вам стоит ожидать от нас массового продукта для миллиардов людей».

Для дизайнеров этот запуск ценен не столько автоматизацией рутины, сколько фиксацией тектонического сдвига в визуальном языке интерфейсов. Строгие монохромные дашборды и утилитарная эстетика уступают место анимации эмоций и мягким силуэтам, потому что машинам с неограниченным контролем жизненно необходимо выглядеть безобидными игрушками. Вопрос лишь в том, насколько долго пользователи будут умиляться беретам и очкам, когда персонажи начнут ошибаться в реальных рабочих документах.

AMD покупает World Labs Фей-Фей Ли за восемь миллиардов долларов

The image shows a cityscape with a large billboard featuring the logos of World Labs and AMD. The World Labs logo is a stylized butterfly, and the AMD logo is a black arrow. The billboard is situated on the side of a building with a modern glass facade. The cityscape includes a mix of buildings, including a tall skyscr
Фото: AMD

Шесть исходных кадров на таймлайне превращаются в минутное видео с разрешением 1440p, где виртуальная камера послушно делает сложный пролёт на кране или наезжает на объект без привычных генеративных артефактов. Это умеет Atlas — модель от World Labs, за которую чипмейкер AMD выложил около 8,2 миллиарда долларов собственными акциями. Лаборатория переходит под крыло Лизы Су целиком, а закрытие сделки намечено на конец 2026 года после одобрения регуляторов.

Пространственный ИИ перестал быть академическим развлечением. World Labs запустили только в 2024 году, а уже 18 февраля 2026 года стартап закрыл раунд на 1 миллиард долларов, где среди инвесторов отметились и AMD, и Nvidia. Партнёрство с AMD шло с 2025 года: инженеры оптимизировали обучение и инференс моделей под чипы Radeon. Сооснователь студии Фей-Фей Ли, стоявшая у истоков ImageNet, облачного ИИ Google и Stanford HAI, займет кресло исполнительного вице-президента и главного научного сотрудника AMD с прямым подчинением Лизе Су. Самой командой продолжат руководить Джастин Джонсон и Бен Милденхолл. Как сформулировала сама Ли, технологиям просто необходимо «стать ближе к железу, чтобы работать эффективнее».

The image shows two women seated at a round table, engaged in signing a document. The woman on the left is wearing a black hoodie with a white logo, and the woman on the right is wearing a black jacket with "AMCD" and "Together we advance" written on it. Both women are holding pens and appear to be focused on the docum
Фото: World Labs
Видео: World Labs
Видео: World Labs

Архитектура и инструменты студии

В распоряжении AMD оказывается готовый пайплайн для генерации окружения:

  • Marble: коммерческий инструмент, запущенный 12 ноября 2025 года. Переводит текст, растровые картинки, видеозаписи и черновые 3D-макеты в редактируемые интерактивные миры с возможностью экспорта в виде мешей или готового видеоряда.
  • Atlas: мультимодальная модель на архитектуре авторегрессионного диффузионного трансформера. Система совмещает генерацию через выпрямленные потоки, привязку к геометрии камер и картам глубины, а на независимых тестах обходит открытые аналоги по точности траекторий.
  • Пространственная реконструкция: сборка локаций по разреженным кадрам — от скромных двух-трёх снимков до сотни ракурсов. Недостающие куски модель достраивает из контекстной памяти, а результат выдаёт в форме облаков точек или 3D Gaussian splats для рендеринга на устройствах в реальном времени.
  • Эффект Bullet Time и робототехника: воссоздание сцены по съемке с трёх-пяти обычных смартфонов с произвольной сменой ракурса постфактум, а также генерация сенсорных данных для перемещения роботов и симуляции манипуляций с твёрдыми и деформируемыми предметами.
The image presents a surreal landscape, with a city nestled at the foot of a towering mountain range. The city, with its buildings painted in shades of orange and red, is situated on a rocky outcropping. The mountain range, with its snow-capped peaks, forms the backdrop of the scene. The entire image is encased within
Фото: World Labs

Для трёхмерщиков и моушн-дизайнеров эта покупка означает скорый конец эпохи, когда пространственные генераторы жили отдельно от видеокарт. AMD пытается повторить манёвр Nvidia в сфере симуляций, но обещает выстроить открытую экосистему — от кремния до софта. Если склеивать коридоры между рендерами и собирать пространственные сцены из пары фотографий с телефона можно будет прямо внутри локального видеочипа, привычный этап долгого сетапа локаций в 3D-пакетах сократится до нескольких кликов. Железо наконец-то учится понимать геометрию сцены, а не просто перемалывать пиксели.

Видео: World Labs

Claude Sonnet 5.5 догоняет флагманы и срезает цену работы вдвое

The image presents a table titled "Knowledge Work" with six columns and four rows. The first column, "Somnet 5.5", contains the data for "Agentic coding" in the "Terminal-Bench 4.0" and "FrontierCode 1.Main" domains. The second column, "Somnet 5", contains the data for "Agentic coding" in the "Terminal-Bench 4.0" and "
Фото: Anthropic

На тестовом стенде новая нейросеть проходит старую игру Pokémon Red, ориентируясь исключительно по скриншотам виртуального экрана. 28 сентября Anthropic официально представила Claude Sonnet 5.5 — вторую модель в семействе 5.5, пришедшую на смену Sonnet 5. Новинка вплотную приблизилась к показателям флагманской Opus 5.5, но обходится ровно в два раза дешевле. Прежнюю рабочую лошадку Sonnet 5 отправили на покой, оставив лишь роль запасного парашюта для фильтрации опасных запросов.

По замерам независимой лаборатории Artificial Analysis и собственным тестам создателей, модель опережает конкурентов в агентном программировании и офисной рутине. В тесте на работу с кодом Terminal-Bench 4.0 она выбила 70,6% против скромных 10,3% у предшественницы и 66,4% у старшей Opus 5.5 (в предварительных замерах AA показатель составил 64% против 60% у Opus и GPT-6 Astra). В проверке реальных профессиональных сценариев GDPval-AA модель набрала 1844 балла, практически повторив результат флагмана в 1846 баллов. Скорость выдачи выросла минимум на 30%, а за счет плотной группировки вызовов инструментов реальные затраты токенов на типовые задачи снизились почти на треть.

Цены и возможности архитектуры

Модель сохранила базовые тарифы Sonnet 5, предложив двукратную экономию относительно Opus 5.5:

Параметр тарификацииClaude Sonnet 5.5Claude Opus 5.5
Входные токены (за 1 млн)$2$4
Выходные токены (за 1 млн)$10$20
Запись в кэш (за 1 млн)$2,50$5
Чтение из кэша (за 1 млн)$0,20$0,20

В бенчмарках AutomationBench-AA новинка показала 71% успешности против 70% у Opus, на CursorBench 4.0 взяла 55,5%, а в тесте Humanity’s Last Exam с инструментами добралась до 64,5%. На распознавании инфографики Chartography модель показала 61,6%, а в сценарии прямого управления интерфейсом ОС OSWorld 2.1 взяла 80,1%. На средних и малых нагрузках расход токенов падает десятикратно: скажем, на финансовых вычислениях Balyasny объемы сократились с 497 тысяч до 121 тысячи токенов на ответ, а на платформе Base44 софт теперь собирается за 3,6 итерации вместо прежних 7,7 у Opus 5.

Модель уже раскатывают в экосистему GitHub Copilot: от Visual Studio Code, JetBrains IDEs, Xcode и Eclipse до веб-версии, терминального CLI и мобильных клиентов на iOS и Android. Облачный доступ открыли через Google Cloud, Microsoft Azure и Amazon Bedrock (интеграцию платформы представили инженеры Дани Митчелл, Аамна Наджми, Альфредо Кастильо и Софиан Хамити) с жесткой политикой нулевого хранения пользовательских данных. Внутри настроек появился параметр between_tools для отключения режима предварительных рассуждений в API, защита рассуждений от дистилляции и киберфильтры уровня Opus. Главный инженер Slack Кёртис Аллен подтвердил скачок на практике: «Без изменения каких-либо наших промптов Claude Sonnet 5.5 показала себя лучше, чем Sonnet 5, почти во всех наших офлайн-тестах Slackbot — за меньшее число шагов и примерно на 14% меньшим объемом выходных токенов». В ближайшие недели линейку дополнит младшая Haiku 5.5.

The image shows a dark gray or black computer screen displaying a dark green grid background. On the left side, a blue button labeled "Ask Copilot" is visible. On the right side, a dark gray or black button labeled "Claude Sonnet 5.5" is shown. A white cursor is hovering over the "Claude Sonnet 5.5" button, suggesting
Фото: GitHub Blog

Для креативных команд и студий это чистая прагматика. Скрипты генеративной графики, парсинг таблиц, подготовка презентаций и автоматизация ассетов теперь требуют вдвое меньше правок в промптах и не выжигают месячный бюджет продакшена за пару рабочих сессий. Черновая техническая работа перестает стоить как премьерный рендер.

Окно вывода в миллион токенов и скорость вдвое выше в новой Gemini 4 Argon

The image features a large, white number "4" prominently displayed against a gradient blue background. The background transitions from a darker blue at the top to a lighter blue at the bottom. The number is slightly blurred, giving it a sense of movement. To the left of the number, the text "Gemini 4 Argon" is written
Фото: Google

Вместо привычной нарезки задач на мелкие порции инженеры скормили новой нейросети 32 тысячи строк SIMD-кода из видеодекодера libgav1 — и получили обратно чистый, безопасный Rust, который работает в 2,7 раза быстрее прежней сборки. Google DeepMind показала Gemini 4 Argon. Главный технический сдвиг спрятан в выходном буфере: модель способна выдать до 1 миллиона токенов за один непрерывный сеанс генерации против прежних 64 тысяч.

Внутри самой корпорации новинку уже нагрузили черновой системной работой. Она переписывает библиотеки и фрагменты ядра операционной системы Fuchsia Zircon объемом свыше 800 тысяч строк, оптимизирует квантовые вычисления с приростом в 40% за считанные минуты и анализирует телеметрию дата-центров. Последнее освободило серверам 300 терабайт памяти, а на дистанции планка экономии дойдет до одного петабайта. При этом в боевых задачах Argon сжигает вчетверо меньше токенов и действует в два раза быстрее конкурентов.

Замеры эффективности

Модель прошла через 22 профильных бенчмарка и зацепилась за верхнюю пятерку в 20 испытаниях. В юридических кейсах разрыв оказался семикратным в сравнении с Claude Sonnet 5.5, а в тестах на терминальные сценарии отрыв вырос почти втрое.

Бенчмарк / СценарийРезультат ArgonКонтекст теста
Vals Index68,9%1 место в экономическом влиянии (финансы, право, код)
LVBench91,7%1 место в анализе и понимании длинного видео
DeepSWE v1.177,9%Рекорд в сквозной программной инженерии
CWE-bench v168,0%1 место (разделенное) в устранении уязвимостей
Terminal-Bench57,6%Рост точности против базовых 19%
AutomationBench51,3%1 место в сквозных сценариях связок Zapier

В вопросах киберзащиты система автономно закрывает дыры на 20 языках программирования. Партнеры из Wiz уже опробовали ее в инициативе Scan for Good, обнаружив критическую брешь в софте медицинских клиник по всему миру, которую игнорировали предыдущие сканеры. Чтобы исключить скрытые угрозы, Google изолирует среду исполнения, тестирует цепочки рассуждений на бенчмарке инъекций Gray Swan и отслеживает внутренние активации. Для доверенных специалистов защитного контура Argon отдадут вообще без фильтров безопасности.

Для тех, кто проектирует сложные интерфейсы, видеопотоки и генеративные пайплайны, интереснее всего финансовая математика и способность читать видеоряд. За миллион входных токенов Google просит 2 доллара, за выходной миллион — 10 долларов, а повторный кэш обойдется со скидкой 95%. С ее баллом 91,7% в понимании длинных роликов и гигантским контекстом вывода отпадает необходимость собирать логику из десятка мелких агентов — тяжелую сквозную задачу можно решать за один запрос.

Пока Argon проверяют американские регуляторы и закрытый пул исследователей программы Fairwind Program. Разработчикам через API и подписчикам тарифа Google AI Ultra доступ откроют сразу после обкатки защитных фильтров. Похоже, эпоха крошечных ответов нейросетей окончательно подошла к концу.

Аудио: Google

Кассетный Walkman для iPhone Duo превратил сложный гаджет в аналоговую игрушку

The image shows a black smartphone with a unique design, folded in half to reveal a cassette tape. The phone's screen displays a blue background with the word "Albums" and the number "4" indicating the number of albums. The cassette tape is black with a brown label and features a white label with the word "Thriller" an
Фото: X

Звук защелкивающегося пластикового кармана и характерное шипение магнитной ленты инди-разработчик Видит Бхаргава записал прямо с винтажного плеера Sony Walkman. На хакатоне Bitrig Hacks в Сан-Франциско его концепт Duo-Man занял второе место, а видео с демонстрацией быстро перешагнуло отметку в 1,9 миллиона просмотров. Соучредитель Bitrig Кайл Макомбер признался, что младшим участникам хакатона пришлось буквально на пальцах объяснять, как работали аудиокассеты сорок лет назад.

Проект превращает складной корпус смартфона в физическую часть музыкального интерфейса. В разложенном виде на внутреннем дисплее появляется кассетоприемник, куда пользователь пальцем вставляет кассету с выбранным альбомом. Закрытие половинок смартфона служит физической командой к старту воспроизведения. «Duo-Man предлагает полноценный опыт использования Walkman на iPhone Duo. Откройте Duo, чтобы выбрать и „вставить“ кассету, закройте, чтобы начать слушать», — объяснил логику механики сам Бхаргава. На внешнем экране в сложенном состоянии отображается лицевая панель деки с крупными псевдоаналоговыми клавишами.

The image shows a blue and white Duoman cassette player. The cassette player has a black cover with a brown cassette tape and a white label that reads "Duoman". The cassette tape is visible inside the cassette player. On the right side of the cassette player, there is a row of buttons, including a yellow button with a
Фото: X
Видео: X

Сейчас автор превращает прототип в полноценный коммерческий релиз со следующими функциями:

  • Поддержка личной медиатеки локальных аудиофайлов и каталога Apple Music с добавлением Spotify на более поздних этапах.
  • Возможность вручную прокручивать кассетную петлю стилусом Apple Pencil.
  • Аутентичная механика перемотки треков вперед и назад с симуляцией физики лентопротяжного механизма.

Характеристики и цены iPhone Duo

Аппаратной платформой для плеера послужил складной iPhone Duo, показанный Apple 9 сентября 2026 года. Предзаказы на устройство открываются 16 октября, а фактические розничные продажи начнутся 23 октября. Смартфон получил корпус толщиной всего 5,2 мм в раскрытом виде и 11,3 мм в закрытом при массе 254 грамма, титановую раму пятого класса, шарнир более чем из 100 деталей, защитное стекло Ceramic Shield, стандарт влагозащиты IP68, сканер Touch ID в кнопке питания вместо системы Face ID и двухнанометровый процессор A20 Pro с 12 ГБ оперативной памяти на базе линейки iPhone 18 Pro.

Параметры экранов с частотой 120 Гц ProMotion и пиковой яркостью 3000 нит распределились под две разные задачи:

ЭкранДиагональРазрешение матрицыНазначение в Duo-Man
Внутренний Super Retina XDR (nano-texture)7.6 дюйма~1878×2670Кассетоприемник и выбор альбомов
Внешний Super Retina XDR5.4 дюйма~1398×2034Лицевая панель плеера с кнопками управления

Базовая конфигурация смартфона на 256 ГБ памяти стоит 1999 долларов. Версия на 512 ГБ оценена в 2199 долларов, терабайтный накопитель обойдется в 2599 долларов, а максимальный объем 2 ТБ потребует 3199 долларов.

Нас подкупило в Duo-Man точное понимание психологии пользователя. В 2008 году для первого смартфона Apple выпустили виртуальный бокал пива iBeer за 2,99 доллара, и эта забавная безделушка приносила создателю ощутимую прибыль просто потому, что наглядно объясняла людям работу гироскопа. Складные экраны долго воспринимались спорным инженерным упражнением, но скевоморфизм снова работает самым надежным мостом между непривычным «железом» и нашими старыми тактильными привычками. Иногда экрану за две тысячи долларов достаточно просто зашипеть пленкой, чтобы перестать казаться чужим.

Британские композиторы объяснили, почему ИИ не заменит живой звук в рекламе

The image depicts a home recording studio setup. A large black monitor dominates the scene, displaying a vibrant music production software interface with a variety of colorful graphs and charts. To the left of the monitor, a black keyboard and a red MIDI controller are positioned, ready for use. A microphone is positio
Фото: Little Black Book

Кларнет записали в студии, а потом вынесли в тихий лондонский подземный паркинг и включили через обычную Bluetooth-колонку, чтобы заново переписать эхо бетонных стен. Так Филип Кай из KO Music собирал саундтрек для проекта Con Edison «Because This is New York» — искал честный акустический отклик города, отсылающий к Гершвину и джазу. Подобная аналоговая шероховатость сейчас под угрозой: индустрию накрывает волна гладкой и безликой музыки из нейросетей.

Поводом поговорить о звуке всерьёз стали данные маркетолога Марка Ритсона на фестивале Cannes Lions: качественное аудио работает как главный коммерческий катализатор креатива, а не просто фоновая подложка. Британские коммерческие композиторы и музыкальные продюсеры — Уилл Уорд из 19 Sound, Филип Кай из KO Music, Рэйчел Мензис из BMG UK и Джек Уайлли из Wise Music Group — выступили единым фронтом против предсказуемой генеративной жвачки. По их наблюдениям, рынок стремительно забивается шаблонным аудиоконтентом, из-за чего подлинная оригинальность становится главным активом.

Практика против алгоритмов

  • Филип Кай ставит в пример эталонной синергии вижуала, дикторского голоса и звука классическую кампанию Puma «After Hours Athletes». По его словам, зритель безошибочно считывает фальшь и чрезмерное продюсирование: саундтрек обязан транслировать внятную авторскую позицию и казаться созданным руками, а не сфабрикованным на конвейере.
  • Рэйчел Мензис настаивает, что музыка должна оставаться чистым выражением культурного кода бренда, а не паразитировать на чужих хитах: в кампании Burberry Goddess с артистами TSHA и Shygirl аудиоряд закладывали в фундамент проекта с самого старта.
  • Джек Уайлли ломает ощущение стерильного продакшена тактильной «человеческой текстурой». В ролике Glendronach «Whisky Dancer» он объединил тонкие нюансы живых акустических партий с нестандартной электроникой, чтобы уйти от вылизанного цифрового стандарта.

«С растущим влиянием искусственного интеллекта нам стоит больше полагаться на человеческую изобретательность, а не на предсказуемую кашу», — прямо формулирует Уилл Уорд.

Для арт-директора и режиссера этот разговор — напоминание о том, как легко превратить сильный вижуал в проходной ролик, если отложить работу со звуком на последний вечер перед сдачей. Когда генераторы способны собрать функциональный фон за пару секунд, коммерческую ценность сохраняет лишь то, что нельзя нащупать промптом: акустика чужого подвала, скрип инструмента и готовность к риску.

SKF вернула Грету Гарбо в кадр через столетие после первых съемок

This black and white photograph captures a woman with a serious expression, wearing a stylish hat and a fur-trimmed coat. The woman's gaze is directed off to the side, and her lips are slightly parted. The background is out of focus, creating a sense of depth and drawing attention to the woman. The photograph is in bla
Фото: Getty Images / YouTube

В 1921 году шестнадцатилетняя Грета Гарбо снялась в скромной короткометражке для шведского промышленного гиганта SKF — задолго до голливудских триумфов, «Оскаров» и затворничества. Спустя больше века и почти сорок лет после ухода актрисы из жизни тот же бренд снова поставил ее перед камерой. На этот раз без физического присутствия: образ легенды немого и звукового кино полностью восстановили с помощью нейросетей.

Проект стал первым случаем, когда виртуальный двойник Гарбо появился именно в движении на видео. До этого цифровое наследие звезды привлекало тяжеловесов индустрии моды: изображения актрисы после ее смерти лицензировали Ferragamo, Gucci и Louis Vuitton. Однако все прежние коллаборации ограничивались статичными постерами и глянцем. Переход к динамическому изображению потребовал принципиально иного производственного пайплайна.

The image is a promotional poster for the film "Pay Like It's 1919", starring Greta Garbo. The poster features a woman with blonde hair, wearing a cream-colored, possibly satin, blouse, against a dark blue background. The text on the poster reads "A FIGHTING FRICTION INITIATIVE", "PAY LIKE IT'S 1919", "STARRING", "GRET
Фото: YouTube

Как собирали цифрового двойника

Техническая сборка ролика объединила генеративные инструменты и классическую работу на съемочной площадке. В основе процесса — гибридный подход:

  • Внешность актрисы воссоздали по текстовым запросам через нейросетевую модель.
  • Голос синтезировали на базе архивных аудиодорожек из старых кинолент с участием Гарбо.
  • Пластику, походку и мимическую основу отработала живая современная актриса на площадке.
  • Лицо дублера на финальном этапе видеомонтажа полностью заменили сгенерированным лицом Гарбо.

Такой метод решает главную проблему чисто генеративного видео — потерю контроля над композицией, актерской физикой и светом. Живая актриса дала ролику естественные тени, взаимодействие с реквизитом и вес в кадре, а диффузионные алгоритмы и замена лица взяли на себя портретное сходство.

Видео: YouTube

Юридическую сторону вопроса закрыли до старта продакшена: родственники актрисы дали официальное согласие на эксперимент. Более того, представители SKF уже смотрят дальше тридцатисекундного рекламного хронометража — в компании открыто допускают появление цифровой версии Гарбо в полноценном художественном фильме.

Для арт-директоров и специалистов по моушн-дизайну это понятный рабочий сигнал: воскрешение исторических персон перестает быть привилегией блокбастеров с многомиллионными бюджетами на ручной трехмерный рендеринг. Комбинация точной работы дублера, голосового клонирования по архивным исходникам и нейросетевой подмены лица превращается в стандартный съемочный инструмент. Пожалуй, теперь главный вопрос продакшена звучит не «как это нарисовать», а «с кем из наследников договариваться».

Классический кинематограф окончательно стал библиотекой ассетов.

Kling 4.0 увеличивает хронометраж до полуминуты и вводит раскадровку из десяти ключей

A man in a black suit is seated at a grand piano on a wooden deck, playing with intensity. The piano is positioned on the right side of the deck, with the man's left hand on the keys and his right hand on the piano's lid. The deck is made of dark wood and is surrounded by a metal railing. The deck is situated on a ship
Фото: Kling AI

Знакомая рутина любого моушн-дизайнера последних двух лет выглядела одинаково: сгенерировать четыре секунды движения, склеить их со следующим фрагментом, спрятать шов на монтаже за быстрой сменой плана и надеяться, что лицо персонажа не поплывет на третьем повторе. Команда Kling AI решила сломать этот паттерн. В четвертом поколении своей видеогенеративной модели разработчики увеличили непрерывный хронометраж генерации до 30 секунд и разрешили буквально расставлять режиссерские метки по всей длине шота.

Полноценный релиз Kling 4.0 назначен на октябрь. Облегченная модификация Kling 4.0 Flash уже заработала: ограниченный круг авторов получил к ней доступ 28 сентября. Главный упор в обновлении сделан на реализм пластики, контроль над композицией и кинематографическую сложность повествования. Вместо случайных визуальных метаморфоз авторы пытаются дать продакшену понятные технические рычаги: 10-битный цвет в HDR для разрешений 1080p и 4K, чистый стереозвук на двух каналах и гибкие пропорции кадра — от классических 16:9 и вертикальных 9:16 до ультрашироких 21:9, квадрата 1:1 и автоматического формата под исходник.

Две версии: флагман против черновика

Для ежедневной студийной работы разработчики разделили архитектуру на два направления. Полноформатная Kling 4.0 рассчитана на финализацию коммерческих шотов в высоком разрешении, тогда как Flash берет на себя быстрый драфтинг, когда нужно отсмотреть десяток идей за несколько минут.

ПараметрKling 4.0Kling 4.0 Flash
Режимы работыText-to-video, Image-to-video, First & Last Frames, Multi-keyframes, Omni ReferenceText-to-video, Image-to-video, Omni Reference
Длительность шотаот 3 до 30 секундот 3 до 20 секунд
Максимальное разрешение720p, 1080p, 4K720p
Динамический диапазон10-bit HDR (для 1080p и 4K)8-bit SDR

Режиссура сцены и система Omni Reference

Самым показательным инструментом Kling 4.0 стал режим Multi-keyframes. Теперь в генератор можно загрузить до 10 ключевых кадров одновременно. Нейросеть интерполирует физику, траекторию камеры и действия объектов между заданными опорными точками. Если раньше приходилось довольствоваться фиксацией первого и последнего кадров (First & Last Frames в модели тоже сохранен), то теперь режиссер задает промежуточные фазы сложного дубля — например, проход персонажа по коридору с поворотом головы в строго определенный момент.

The image shows a man seated at a piano on a ship, with the piano lid open. He is dressed in a dark suit and tie, and his hair is wet and appears to be blowing in the wind. The ship's deck is visible in the background, with a dark, possibly black, railing. The ocean is visible in the background, with waves crashing aga
Фото: Kling AI

В связке с этим работает архитектура Omni Reference, управляющая консистентностью элементов. В один рабочий запрос система позволяет зашить до 15 референсов:

  • До 10 отдельных изображений со стилем, текстурами и локациями;
  • До 5 референсных видеороликов суммарной длительностью до 30 секунд;
  • До 7 независимых субъектов, облик которых зафиксирован серией картинок или видеофрагментов;
  • Голосовые аудиофайлы для подбора тембра и интонаций озвучки.

Семь закрепленных субъектов в кадре означают, что в полуминутную сцену можно поместить целую группу людей, брендированный реквизит и нужный автомобиль, не боясь их спонтанной мутации к середине дубля.

Текстовый ввод на 8000 токенов и локальные акценты

Ограничение в пару предложений ушло в прошлое: текстовое поле Kling 4.0 принимает мультимодальные инструкции длиной до 8000 токенов. Это полноценный литературный сценарий с поминутной экспликацией, описанием оптики, световых схем и физических свойств материалов.

Модель воспринимает и генерирует текст на китайском, английском, японском, корейском, испанском, португальском, немецком, французском, индонезийском языках и хинди, корректно интегрирует в видеоряд эмодзи и векторные логотипы. Более того, звуковой модуль разбирается в тонких диалектах. В систему зашиты пекинский, сычуаньский, кантонский, тайваньский и северокитайский говоры, а для английской речи предусмотрены американский, британский и индийский акценты. Пожалуй, для международных рекламных адаптаций это снимает треть задач по локализации черновиков.

Инструментарий постпродакшена расширили отдельным режимом монтажа: нейросеть принимает до 5 исходных видеоклипов (один назначается ведущим), каждый длиной от 3 до 30 секунд при суммарном объеме исходников до 30 секунд, и пересобирает материал с сохранением общей логики сцены.

Холст, таймлайн и рабочий агент

Под новые возможности полностью перестроили рабочее пространство. Вместо разрозненных панелей авторы получают единую строку ввода, куда загружаются текст, статичные изображения, видеоматериалы и аудиодорожки. Рабочую область разрешили переключать между каталогом-сеткой и структурированным списком задач.

Главное нововведение интерфейса — непрерывный монтажный таймлайн. Вносить правки, просматривать превью и нарезать свежие дубли можно без остановки фонового рендера. Для сложных пайплайнов развернули бесконечный холст с нодовой структурой связей, внутри которого живет интегрированный агент: ему поручают рутинные цепочки генераций и пакетную обработку материалов.

The image shows three women standing on a rocky outcropping, each holding a sword and wearing traditional Korean attire. The woman on the left is wearing a black robe and a wide-brimmed straw hat, and is holding a sword with a tassel. The woman in the middle is wearing a black robe and a wide-brimmed straw hat, and is
Фото: Kling AI

Нас подкупило, что Kling перестал притворяться игрушкой для минутных роликов в соцсетях. Десять ключевых кадров, полуминутный дубль и 10-битный цвет переводят генерацию из категории слепой лотереи в управляемый продакшен-процесс. Теперь режиссер диктует нейросети тайминги, а не подстраивает раскадровку под то, что случайно получилось на пятой секунде.

Агентство Восход переложило движения дирижера в айдентику Дома музыки

The image presents a logo design set against a stark black background. The logo is composed of the word "������" in a stylized, white, sans-serif font, with the letters "������" positioned above the word "����������" in a smaller, white, sans-serif font. Below the word "������", the word "����������" is written in a sm
Фото: источник

Рука дирижера чертит в воздухе траекторию, задавая темп и динамику еще до первого звука оркестра. Именно этот невидимый след взмаха лег в основу визуального языка, который агентство «Восход» спроектировало к двадцатилетию Дома музыки в Екатеринбурге. Авторы отказались от привычной филармонической чопорности и перевели живую пластику управления звуком в строгую, но подвижную графику.

Анатомия партитуры и жеста

Визуальная система опирается на черно-белую цветовую палитру — прямую ассоциацию с клавишами музыкальных инструментов. Контрастная база удерживает макеты в строгих рамках, пока поверх нее разворачивается экспрессия. Слуховой опыт авторы материализовали через цвето-эмоциональные пятна аккордов, накладывая их на монохромный каркас.

В знаковую систему вошли конкретные элементы музыкальной грамоты:

  • Новый логотип, построенный вокруг символа первой ноты октавы — «до»;
  • Графический мотив репризы, цитирующий классическую нотацию повтора;
  • Контрастная черно-белая гамма клавишного ряда;
  • Цветовые акцентные пятна, передающие эмоциональную плотность созвучий.

Новый визуальный язык не останется эскизом для презентаций. Институция переносит его на все носители: айдентика формирует сетку концертных афиш, пересобирает цифровые каналы и выстраивает навигацию в физическом пространстве Дома музыки. Обновление показали публике прямо на праздновании двадцатилетнего юбилея площадки, сопроводив запуск презентацией свежей программы концертного сезона.

Руководство площадки прямо формулирует задачу: сломать дистанцию и избавить классический репертуар от музейного нафталина, показав академическую сцену как актуальный источник сильных эмоций. Нас подкупило, как точно команда нашла рабочий инструмент в самом очевидном действии на сцене. Жест дирижера перестал быть абстрактным ритуалом и превратился в функциональный каркас для шрифтов, навигационных табличек и плакатов.

Классика звучит современно ровно тогда, когда графический дизайн перестает перед ней заискивать.

Дуги и паузы Студия Лебедева пересобрала визуальный язык спорткомплекса Лужники

The image presents a logo for a company named "������������������". The logo is designed in a bold, sans-serif font, with the letters "������������������" in black and the letters "��" and "��" in red. The red "��" is positioned to the left of the black "������������������", and the red
Фото: Art. Lebedev Studio

Плавный изгиб линии направляет взгляд зрителя, а прямая вертикальная черта резко его тормозит. На этом простом кинетическом контрасте Студия Артемия Лебедева построила новую бренд-платформу, визуальную айдентику и креативную рамку для московского спорткомплекса «Лужники». Перед дизайнерами стояла классическая проблема масштабного городского пространства: как связать в единой графике профессиональные спортивные арены, набережные для вечерних пробежек и тихие аллеи для семейных прогулок.

Предыдущий подход морально устарел на фоне разросшейся инфраструктуры. Для спорткомплекса было критично показать, что гигантский кластер давно вышел за рамки сугубо соревновательной площадки. В новой системе дуги взяли на себя роль главного фирменного элемента. Они буквально задают вектор движения и фокусируют внимание на ключевых активностях, разбросанных по территории. Вертикали, напротив, работают как графический стоп-кадр — они отвечают за паузу, передышку и спокойные зоны отдыха.

Архитектура знака и ритм шрифта

Геометрию знака дизайнеры поддержали кастомной типографикой. Пластика букв напрямую повторяет траектории фирменных дуг — скругления, срезы и пропорции шрифтовых знаков работают в связке с направляющими линиями. Такой приём избавляет макеты от визуальной каши, когда спортивный плакат или баннер фестиваля перегружен разнородными графическими сущностями.

Для промо-материалов и анонсов команда собрала гибкую креативную рамку. Это модульный шаблон, куда легко пакуются любые форматы досуга и городские события:

  • «есть место спорту» — для тренировок, марафонов и матчей;
  • «есть место музыке» — для концертов и опен-эйров;
  • «есть место празднику» — для сезонных фестивалей и семейных программ.
The image presents two distinct advertisements, each mounted on a separate billboard. The left billboard is a large, rectangular structure with a white background and a red circle in the center. It features a black silhouette of a person riding a bicycle, with the text "��ствет ��есто" (Bicycle in the city) and "������
Фото: Art. Lebedev Studio

Конструкция масштабируется на любые носители — от цифровых экранов до мерча и уличных щитов. При этом студия вернулась на знакомую территорию: ещё в 2017 году команда Лебедева проектировала для «Лужников» комплексную систему навигации. Теперь навигационный опыт замкнулся на сквозной брендинг всей среды.

The image presents two distinct advertisements, each mounted on a black pole. The left advertisement is a large billboard with a white background and a red circle design. It features a silhouette of a person riding a bicycle, with the text "��сть ��ето" (meaning "I love biking") and "��етро��" (meaning "I love biking")
Фото: Art. Lebedev Studio

Для арт-директоров и графических дизайнеров этот кейс интересен тем, как абстрактное физическое действие раскладывается на чистую механику знака. Вместо банальных силуэтов бегунов и мячей айдентика оперирует чистой кинематикой — разгоном и торможением. Когда огромный территориальный бренд говорит на языке простых векторов, макет перестает спорить с архитектурой.

Apple усилила Creator Studio для связки iPad и съемки на iPhone 18 Pro

The image presents a row of five app icons, each distinct in its design and color, set against a black background. The first icon is a blue light bar, the second is a purple film reel, the third is a red rectangle with a white border, the fourth is a gray circle with a white border, and the fifth is a yellow pencil. Th
Фото: Apple

Сложная обтравка на планшете годами раздражала даже самых спокойных ретушеров: мелкие пряди волос, ворс свитера или прозрачное стекло почти всегда превращались в кашу из пикселей. Теперь Apple всерьез взялась за эту рутину. Компания представила масштабное обновление пакета профессиональных приложений Apple Creator Studio, сфокусированное на задачах визуального производства и видеомонтажа внутри собственной экосистемы.

Главным бенефициаром апдейта в растровой графике стал планшетный софт. Разработчики основательно пересобрали логику изоляции объектов, перенеся тяжелые рабочие процессы на мобильные экраны.

Что вошло в релиз

  • Инструменты уточнения краев в Pixelmator Pro для iPad: приложение получило специализированные функции edge-refinement, которые позволяют собирать максимально чистые и аккуратные сложные выделения при работе со сложной фотографией и растровыми макетами.
  • Прямая интеграция с iPhone 18 Pro: творческие программы пакета оптимизировали под нативные видеоматериалы, снятые на новые флагманские смартфоны линейки. Система обеспечивает бесшовный импорт и дальнейшую обработку профессиональных форматов без промежуточных конвертаций.

Свежий релиз наглядно продолжает общую стратегию бренда. Инженеры последовательно сращивают аппаратные возможности свежих камер и фирменных чипов с рабочими интерфейсами для дизайнеров и видеографов. Планшет окончательно перестает быть просто просмотровым экраном для правок заказчика — теперь это полноценный рабочий станок для тяжелой графики.

Нас подкупило, как прагматично выстроен этот пайплайн. Оператор забирает материал прямо со смартфона, арт-директор доводит сложные маски стилусом в дороге, и проект не разваливается по пути на десктоп. Кажется, портативный сетап для выездных съемок стал еще компактнее.

Когда софт перестает сопротивляться сложным краям кадра, творчество наконец начинает экономить часы чистого времени.

Эмиль Ковальски собрал правила UI-анимации и хорошего вкуса в набор навыков для ИИ-агентов

Иллюстрация: редакция ЗДЕСЬ

Искусственный интеллект отлично наловчился генерировать разметку за пару секунд, но почти всегда выдает себя полным отсутствием визуального чутья. Типичная сцена: языковая модель бодро анимирует появление модального окна через резкий ease-in вместо естественного затухания ease-out, а карточки отделяет глухими сплошными рамками толщиной в пиксель вместо мягких полупрозрачных теней. В коде нет синтаксических ошибок, но выглядит это топорно.

Эмиль Ковальски, чью пластику интерфейсов многие помнят по проектам Linear и Vercel, решил подойти к проблеме с инженерной стороны. Он упаковал свой профессиональный опыт в открытый репозиторий под названием skills. Это набор практических инструкций и готовых навыков, которые прививают ИИ-агентам дисциплину в обращении с движением, отступами и версткой. Комплект разворачивается в кодовой базе одной командой через терминал: npx skills@latest add emilkowalski/skills.

Тринадцать модулей для сборки интерфейса

Репозиторий не пытается быть очередной дизайн-системой. Нас подкупило, что Ковальски разделил свой инструментарий на тринадцать специализированных модулей, каждый из которых закрывает конкретную слепую зону нейросетей при разработке веба и мобильных экранов:

  • emil-design-eng — базовый модуль инженерного дизайна, где собраны фундаментальные советы автора по поведению элементов и анимации;
  • animate — инструкция по проектированию движения с нуля, отвечающая за правильные кривые скорости, длительность переходов и выбор анимируемых CSS-свойств;
  • animate-expo — расширение для мобильного стека на React Native и Expo, где учтены тонкости работы с жестами, всплывающими шторками, тактильным откликом и переходами между экранами без просадки кадров в основном потоке JavaScript;
  • review-animations — жесткий контролер, проводящий ревизию существующей анимации по авторским критериям плавности;
  • improve-animations — сканер кодовой базы, находящий проблемную динамику и составляющий для ИИ-агента пошаговый план пакетных правок;
  • find-animation-opportunities — инструмент контекстного поиска, определяющий, где микровзаимодействие действительно обогатит опыт, а какие элементы интерфейса категорически нельзя трогать движением;
  • animation-vocabulary — терминологический словарь, позволяющий дизайнеру ставить задачу модели на точном профессиональном языке без абстрактных эпитетов;
  • apple-design — свод принципов интерфейсного дизайна Apple и физики движения из лекций WWDC, аккуратно перенесенный в реалии браузерного веба;
  • write-swift — стандарты написания современного кода на Swift с акцентом на семантику значений, модель конкурентности Swift 6, обобщения, общую производительность и Swift Testing;
  • pick-ui-library — гид по выбору проверенных готовых библиотек, удерживающий агента от изобретения собственных велосипедов и установки заброшенных зависимостей;
  • prototype — генератор нескольких альтернативных вариантов одного и того же UI-компонента с возможностью быстро переключаться между ними прямо в процессе оценки;
  • mobile-native — пакет обязательных технических правок, избавляющий веб-приложения на смартфонах от ощущения неуклюжего сайта: решает проблему скачущей высоты 100vh, убирает задержку тапов, блокирует паразитный зум при фокусе на полях ввода и корректно учитывает границы безопасных зон safe area;
  • ask-sonner — руководство по интеграции популярной библиотеки всплывающих уведомлений Sonner, которую когда-то создал сам Ковальски.

Сам автор подчеркивает очевидную, но часто забываемую вещь: алгоритмы не заменяют экспертизу в предмете. Они лишь усиливают руки того, кто понимает физику интерфейса, и помогают быстрее масштабировать качественные решения. Если скормить агенту плохой промпт без контекста, чуда не произойдет — но наличие жестких ограничений по таймингам и кривым не позволит модели скатиться в визуальный мусор.

По-нашему, перед нами редкий пример того, как насмотренность арт-директора превращается в строгий программный конфиг. Пока индустрия спорит о том, отнимет ли генеративный код хлеб у проектировщиков, практики просто загружают свои правила хорошего тона прямо в командную строку нейросети.

Робби Тилтон создал Compositor как открытую замену Photoshop для macOS

The image shows a computer setup with a large monitor displaying a portrait of a woman in a white, ruffled dress. The monitor is connected to a keyboard and mouse, and is positioned on a white desk. The monitor's screen is the central focus of the image, with several smaller windows surrounding it, each displaying a di
Фото: GitHub

Привычка к горячим клавишам и расположению панелей въедается в пальцы за годы так прочно, что любая попытка открыть альтернативный софт обычно заканчивается раздражением через десять минут. Дизайнер и разработчик Робби Тилтон столкнулся с классической развилкой: ежемесячный ценник Adobe Photoshop перестал выглядеть оправданным для задач композитинга, а свободные редакторы калибра GIMP выбивали из рабочего ритма своей специфической логикой. Решением стала разработка собственного приложения с нуля. Новый редактор получил лаконичное имя Compositor, вышел эксклюзивно для macOS и сразу отправился в открытый доступ.

Главная цель проекта — сохранить для арт-директоров, ретушеров и специалистов по сборке сложных изображений привычный пайплайн, но без сервисных сборов и привязки к чужому облаку. Архитектура приложения выстроена вокруг создания финальной графики с пиксельной точностью. Если интерфейс не заставляет мучительно вспоминать, где спрятана маска или как сгруппировать слои, руки сами делают привычную работу на чистой мышечной памяти.

Архитектура слоев и рабочий процесс

Внутри Compositor делает ставку на базовые вещи, без которых не обходится ни один серьезный монтаж кадров или многослойный арт. Тилтон перенес фундаментальные сущности в понятный для любого пользователя Photoshop вид:

  • Полноценная работа со слоями, поддержка папок для наведения порядка в тяжелых макетах и прозрачная иерархия элементов.
  • Маски слоя и обтравочные маски (Clipping Masks), позволяющие изолировать эффекты и вписывать текстуры в нужные контуры без разрушения исходника.
  • Все базовые режимы наложения (Blend Modes) для сведения светотеневых рисунков, наложения текстур и цветокоррекции.
  • Корректирующие слои (Adjustment Layers) для недеструктивного управления тоном и цветом по всей площади кадра или по выделенным областям.
  • Классические инструменты точного выделения для аккуратной вырезки и изоляции объектов.

Нас подкупило, что автор не пытался превратить редактор во всеядный комбайн для векторной верстки или 3D-моделирования. Программа делает ровно то, ради чего запускают растровый редактор на этапе финального сведения проекта — быстро собирает слои воедино.

Арсенал ретуши и оптических фильтров

Композитинг редко обходится без подгонки резкости, исправления артефактов съемки и ручной доводки мелких деталей. В Compositor заложили прикладной набор фильтров, который закрывает повседневную рутину визуального продакшена:

  • Очистка сцены: встроенный механизм удаления фона (Background Removal) экономит время при черновой раскладке референсов и объектов.
  • Пространственные искажения: фильтры размытия по Гауссу (Gaussian Blur) и размытия в движении (Motion Blur) помогают свести слои по глубине резкости и задать динамику элементам.
  • Оптические эффекты: модуль коррекции объектива (Lens Correction) вместе с добавлением зерна и шума (Grain & Noise) склеивает разнородные визуальные ассеты в единую кинематографичную картинку.
  • Ручная пластика и чистка: инструменты Liquify & Smear для деформации форм и аккуратного размазывания пикселей.
  • Традиционное рисование: базовая кисть (Brush), точечное восстановление (Spot Healing) для удаления мелкого сора и штамп (Clone Stamp) для переноса текстур.

Набор выглядит аскетичным лишь на первый взгляд. На деле здесь собрано именно то ядро инструментов, которым ретушеры и концепт-художники пользуются девяносто процентов рабочего времени, пока тяжелые фирменные панели гигантов индустрии собирают цифровую пыль.

Открытый код и технические условия

Compositor распространяется абсолютно бесплатно. Проект оформлен как опенсорсная разработка и полностью выложен на GitHub. Пользователи Mac могут пойти двумя путями. Первый — просто загрузить готовый DMG-образ и перетащить приложение в системную папку программ. Второй — скачать исходный проект в Xcode, чтобы разобрать код по винтикам.

Открытость дает редкую для графического софта свободу: при знании среды разработки можно вырезать ненужные модули, добавить собственные алгоритмы обработки пикселей или переписать горячие клавиши под редкие периферийные устройства. Разработчик прямо подчеркивает независимость своей платформы: Adobe и Photoshop остаются зарегистрированными товарными знаками компании Adobe Inc., а проект Тилтона не имеет никакой аффилиации или поддержки с их стороны.

Появление Compositor показывает важный сдвиг в индустрии инструментов: вместо бесконечного ожидания милости от корпораций дизайнеры берутся за код сами. Если вам нужен чистый холст для монтажа без ежемесячного счета в календаре, теперь есть куда нажать.

Runway встроила генерацию видео и маскирование прямо в Premiere Pro и After Effects

The image is a screenshot of a digital photo editing software interface. The interface is predominantly black with white text and a white progress bar at the bottom. The software interface is divided into three sections: "Generate", "Edit", and "Library". The "Generate" section is currently active, displaying a message
Фото: Runway

Знакомый ритуал любого монтажера последних двух лет выглядел одинаково утомительно. Срезать нужный кусок на таймлайне, отрендерить черновик, переключиться в браузер, дождаться загрузки на сервер, вбить текстовый запрос, скачать полученный MP4 обратно на диск и наконец затянуть его в проект. Десятки лишних кликов на один дубль выбивали из рабочего ритма быстрее, чем долгий финальный рендер. Теперь эту цепочку свернули до одной системной панели: Runway выпустила официальный плагин для монтажных комплексов Adobe Premiere Pro, After Effects и DaVinci Resolve.

Инструмент переносит генеративные нейросети непосредственно в рабочую среду монтажера и моушн-дизайнера. Генерировать новые кадры, достраивать окружение, перерисовывать фрагменты и собирать статичные референсы теперь можно прямо на шкале времени, не покидая проект и не создавая промежуточных файлов на накопителе.

Как устроена установка и подключение

Разработчики максимально упростили развертывание плагина на рабочей машине. Процесс разбит на три понятных шага, с которыми справится любой специалист:

  • Загрузка универсального бесплатного установщика, единого для Premiere Pro и After Effects.
  • Автоматическое сканирование системы инсталлятором, который сам находит поддерживаемый софт Adobe.
  • Запуск расширения через рабочее меню программы (в интерфейсе After Effects путь выглядит как Window → Extensions → Runway) и последующая авторизация в учетной записи.

В верхней части открывшейся панели расположен селектор рабочих пространств. Через него монтажер переключает активные аккаунты, определяя, куда именно будут сохраняться свежие генерации и с какого командного баланса спишутся расчетные единицы.

The image presents a digital interface with a black background and a light purple border. It features six distinct sections, each showcasing a different image. The top left section displays the word "Generate" in white text. The top right section contains the word "Library" in white text. The middle left section featur
Фото: Runway

Арсенал моделей внутри монтажной панели

Вместо одного изолированного движка Runway интегрировала внутрь софта целую обойму нейросетей сторонних и собственных лабораторий. Пользователь выбирает нужный генератор под конкретную творческую задачу прямо из выпадающего списка.

Для создания видео доступны четыре модели:

The image shows a video editing interface with a video playing in the background. The video is titled "street 02.mp4" and has a duration of 00:04:12. The interface features a black background with white text and buttons. On the left side, there are three buttons labeled "Ruby", "Aleph 2.0", and "Seedance 2.5". On the r
Фото: Runway
  • Флагманская Gen-4.5 от самой Runway.
  • Seedance 2.5 для синтеза динамических шотов.
  • Kling 3.0 Pro, ориентированная на детализированные сцены.
  • Veo 3.1 для реалистичного движения камеры и объектов.

Для генерации статичных фонов, текстур и концепт-артов предусмотрены три алгоритма:

  • Gen-4 Image от Runway.
  • Nano Banana для быстрых набросков.
  • GPT Image 2 для работы со сложной предметной графикой.

Каждая модель разворачивает собственный набор настроек прямо внутри плагина. Перед запуском генерации по текстовому описанию можно жестко зафиксировать пропорции кадра, хронометраж отрезка и итоговое разрешение, не покидая композицию.

Ре-рендеринг, работа с цветом и маски без ротоскопинга

Самое практичное применение расширения лежит за пределами создания роликов с нуля. Панель берет на себя рутинную черновую постобработку прямо на таймлайне, где раньше требовались сторонние скрипты или долгий ручной труд.

За стилизацию и полное переосмысление исходного футажа отвечает модель Aleph 2.0. Она выполняет ре-рендеринг уже смонтированных клипов в режиме «видео-в-видео», перерисовывая текстуры, освещение или персонажей по текстовому заданию с сохранением оригинальной пластики движения. Для проектов с повышенными требованиями к динамическому диапазону Runway добавила алгоритм Ruby: он либо конвертирует стандартные кадры в HDR, либо сразу отдает сгенерированные шоты в этом формате.

Для чистки и финализации материала предусмотрен блок внутренней постобработки. Встроенные апскейлеры подтягивают четкость и разрешение сгенерированных фрагментов под стандарты таймлайна. Рядом находится инструмент автоматической изоляции объектов. Он вырезает людей, технику или предметы по короткой текстовой подсказке без покадрового обвода масками вручную. Монтажер может инвертировать выделение в один клик, настроить выходную частоту кадров и сразу получить чистый слой для кеинга или подложки титров.

Синхронизация и финансовые условия

Все созданные внутри Premiere Pro, After Effects или DaVinci Resolve материалы автоматически попадают в облачное хранилище пользователя на серверах Runway. Если сценарист или продюсер генерировал шоты через веб-интерфейс сервиса, монтажер подхватывает их прямо из встроенной панели за один клик, просто перетащив плашку на дорожку.

Сам дистрибутив плагина распространяется бесплатно и не требует отдельной платы за установку. Оплата завязана на стандартную экономику платформы: каждая генерация списывает кредиты с уже оплаченного тарифного плана учетной записи Runway.

Пожалуй, ценность этого релиза измеряется не терафлопсами вычислений, а сохраненным фокусом внимания. Когда генеративная модель сидит на соседней вкладке рядом с окном превью и базовыми эффектами, искусственный интеллект окончательно перестает быть внешним сайтом для экспериментов — и становится просто еще одним инструментом на панели задач.

ElevenLabs выпустила Eleven v4 и удвоила оценку до 22 миллиардов долларов

The image presents a vibrant abstract design with a gradient background that transitions from a soft peach/orange at the top to a darker green at the bottom. The design features a stylized text "Eleven V4" in white, centrally positioned. The text is slightly tilted to the right. The background is a blend of orange, gre
Фото: ElevenLabs

Попытка заставить синтезированный голос естественно усмехнуться или перейти на шепот долго оставалась головной болью для любого саунд-дизайнера. ElevenLabs выкатила архитектуру Eleven v4, где текстовые маркеры вроде [whispers], [laughs], [phone buzzing] или [door slams] вшиваются в реплику без швов и артефактов. Модель читает скрипт с повадками живого актера: разбирает общий контекст сцены, следит за эмоциональной динамикой и реагирует на интонации предыдущих реплик собеседника.

В релизе исправили давнюю беду нейросетевой озвучки — вокальный дрейф при долгих дублях. Одну и ту же строчку теперь можно перегенерировать до 50 раз подряд без риска потерять тембр. Для крупных форматов вроде аудиокниг внедрили технологию бесшовной склейки контекста, удерживающую единый темп на дистанции до 10 000 символов за один запрос. Сетка поддерживает более 90 языков с сохранением исходного голоса и акцента носителя, а в функционал вернули профессиональные клоны голоса (PVC). Для создания быстрого слепка теперь требуется всего 10 секунд исходного аудио.

Аудио: ElevenLabs

Параллельно для диалоговых систем представлена облегченная версия v4 Turbo. Двунаправленный стриминг позволяет отдавать звук еще до того, как языковая модель допишет предложение в коде.

Видео: ElevenLabs

Бенчмарки и стоимость синтеза речи

МодельВремя до первой речи (TTFS)Рейтинг Voice Arena (Elo)Цена за 1 млн символов
Eleven v4 / Turbo~150 мс1319 (1-е место)$80
Cartesia Sonic 3.6262 мс1276$49
Google Gemini 3.8 Flash TTS—1267$16,49
OpenAI GPT-4o mini TTS814 мс——
The image presents a bar graph comparing the median time to first speech for Eleven v4 Turbo, Cartesia Sonic 3.6, xAI TTS, Google Gemini 3.8 Flash-Lite TTS, and OpenAI GPT-40 mini TTS. The x-axis is labeled "Median time to first speech" and the y-axis is labeled "Audio arrives". The bars are colored in shades of gray,
Фото: ElevenLabs

В слепых сравнительных тестах платформы Artificial Analysis слушатели выбирали Eleven v4 примерно в 75% случаев. Точность произношения зафиксирована на отметке 91,7%, а скорость генерации выросла до 73,4 символа в секунду против 42,5 у третьей версии.

The image presents a bar graph comparing the success rates of four different blind-folded pair competitions. The top bar represents the "Cartaesis Sonic 3.6" competition, with a success rate of 81%. The second bar is for the "vs Inworld TTS-2" competition, with a success rate of 81%. The third bar is for the "vs Google
Фото: ElevenLabs

Технологический скачок подкрепили внушительными финансами. Стартап закрыл программу выкупа акций сотрудников на $300 млн, зафиксировав общую оценку в $22 млрд — это ровно вдвое выше февральского раунда Series D. Сделку возглавили Wellington и T. Rowe Price, к которым присоединились Goldman Sachs, EQT, Andreessen Horowitz и Lightspeed. Корпоративные клиенты приносят компании 55% выручки, а штаб превысил 800 специалистов. Одновременно ElevenLabs открыла европейский офис в Брюсселе под руководством Фалке Ван Онакер с планами утроить местную команду за год. Среди бельгийских кейсов — интеграция музыкального инструмента Eleven Music в софт FL Studio с прицелом на миллион минут генерации в месяц, конвертация 10 млн символов ежемесячно для делового издателя Mediafin и мультиязычный дубляж дипломатических пресс-конференций ЕС.

Видео: ElevenLabs

Для креативных продакшенов это означает существенную экономию на черновом озвучивании и локализации. В систему заложили библиотеку из более чем 17 500 голосов, настройку словаря произношения по международному фонетическому алфавиту IPA и экспорт в студийные форматы WAV/PCM, MP3 и телефонный µ-law. Бесплатный тариф дает 10 000 кредитов в месяц, а подписка от $6 открывает доступ к профессиональному клонированию. Нас подкупило то, что алгоритм перестал чеканить слова по слогам и научился держать паузу. Пожалуй, эпоха неестественных дикторских черновиков в моушн-дизайне и рекламе окончательно уходит в прошлое.

Аудио: ElevenLabs

Стэнфорд объяснил почему компании нанимают сеньоров вместо младших специалистов

Иллюстрация: редакция ЗДЕСЬ

Команды не избавляются от стажеров и младших дизайнеров одним днем — бизнес просто перестал открывать для них позиции с прежней скоростью. В Стэнфордской лаборатории цифровой экономики (Stanford Digital Economy Lab) препарировали этот тихий сдвиг на гигантском массиве данных. Исследователи проанализировали 1,25 миллиарда объявлений о вакансиях и 154 миллиона записей о занятости в 41 стране, чтобы понять реальные последствия прихода генеративных моделей.

Факт внедрения технологий ученые фиксировали по требованиям к знанию генеративного ИИ в текстах вакансий, а причинно-следственные связи проверяли методом инструментированного событийного анализа на зарубежных филиалах компаний. Сдвиги в структуре штата разложили на два механизма:

  • Эффект общефирменной производительности, обеспечивающий умеренный рост эффективности бизнеса и общее расширение занятости.
  • Перераспределение задач между сотрудниками разного уровня квалификации внутри рабочих процессов.

Главный результат исследования ломает привычный сценарий технологической безработицы. Доля младших специалистов в штате действительно падает, но происходит это не из-за чисток или массовых увольнений. Причина в другом: компании агрессивно наращивают наем опытных сеньоров, отчего новички размываются в общей массе. Занятость старших специалистов целенаправленно смещается в профессии с высокой подверженностью ИИ, тогда как присутствие младшего персонала в этих насыщенных алгоритмами направлениях сокращается. Сама интеграция генеративных инструментов при этом обеспечивает предприятиям умеренный прирост производительности труда.

Для дизайн-отделов и продакшенов эта арифметика означает перестройку классической карьерной пирамиды. Черновую генерацию вариантов, сбор мудбордов и механическую отрисовку теперь отдают нейросетям, поэтому надобность в дюжине рабочих рук для рутины отпадает сама собой. Студиям становятся нужны люди, способные моментально оценить сгенерированный пул, отобрать жизнеспособный концепт и собрать из него финальный продукт под строгим арт-дирекшном.

Порог входа в индустрию незаметно поднялся на несколько этажей вверх. Алгоритмы не отняли у джуниоров зарплату — они просто передали всю работу тем, кто уже умеет отвечать за результат.

Оранжевый вместо космоса: Дрю Генри показал первый показ для Courrèges

Иллюстрация: редакция ЗДЕСЬ

Мятая абстрактная шляпа, оранжевая блуза и ни капли стерильного техно-минимализма. Новый креативный директор Courrèges Дрю Генри вышел на подиум с манифестом: футуристичная монохромная эстетика, которую годами выстраивал его предшественник Николя Ди Феличе, отправлена в архив. Французский дом резко развернулся к оптимизму шестидесятых — временам, когда Андре Курреж заново придумывал гардероб эпохи космической гонки, но делал это через цвет и чистую геометрию.

Вместо холодной синтетики и закрытых силуэтов подиум залило чистым спектром. Генри выстроил линейку вокруг трапеции — главного силуэта коллекции, который переходит из платьев и туник прямо в пальто. Никаких полутонов: в кадре работают открытый красный, глубокий синий и насыщенный зеленый, перебиваемые неожиданными аксессуарами вроде нарочито перегруженных ремней.

Что вошло в подиумную линейку

  • Оранжевые блузы свободного кроя и алые пальто силуэта трапеция
  • Розовые облегающие брюки и плотные зеленые костюмы
  • Синие трикотажные комбинезоны, обтягивающие фигуру
  • Платья и туники строгой трапециевидной формы
  • Абстрактные мятые головные уборы и акцентные ремни

Бэкграунд 38-летнего уроженца ЮАР отлично объясняет эту смелость с кроем. Генри начинал учиться в Йоханнесбурге, затем окончил Central Saint Martins в Лондоне и успел поработать в серьезных модных домах: Céline, JW Anderson, Burberry и именном проекте Phoebe Philo. Главной школой для дизайнера стало именно сотрудничество с Фиби Файло — отсюда видна эта собранность силуэта даже в самых ярких вещах.

Для арт-директоров и стилистов этот дебют — сигнал о том, что холодный сай-фай и темный рейв-минимализм окончательно выдыхаются на мудбордах. По-нашему, индустрия снова соскучилась по открытой палитре и графичным формам, которые цепляют глаз за секунду скролла без помощи неоновых подсветок и сложного 3D-продакшена. Чистый цвет вернулся за своим.

Ещё выпуск недели

Выпуск недели

Ручной шов на гладком пластике

Шестнадцать историй о том, почему вкус, авторская шероховатость и чистое упрямство снова становятся главным инструментом визуального продакшена

24 сентября22 мин
Выпуск недели

Шерсть, бункеры и точечный надрез

Пока генеративные модели учатся менять одну пуговицу, арт-директоры возвращают в кадр войлок, карандаш и стадионную грязь.

19 сентября21 мин
Выпуск недели

Режим ручной сборки

Хостинг перетаскиванием папки, птицы на электронных чернилах, свидания по мудбордам и семь тысяч спасенных гифок.

13 июля8 мин