РазноебесплатноMeta

SAM 3D

Воссоздание 3D-объектов и анатомических моделей людей по одной фотографии за пару секунд

Фото: Meta AI

Обычная фотография интерьера или уличный кадр превращаются в объёмную сцену буквально за секунды. Семейство моделей SAM 3D от Meta берёт единичный плоский снимок и вытаскивает из него геометрию, текстуры и пространственное положение предметов, избавляя от рутинного начального моделирования. Релиз разделен на две специализированные ветки: SAM 3D Objects для предметного окружения и SAM 3D Body для точной оценки поз и формы человеческого тела.

Что умеет

  • Поднимать 3D-сцены по фото: генерирует текстурированные полигональные сетки отдельных предметов и определяет их положение в пространстве.
  • Работать в естественной среде: справляется со сложными ракурсами и частично перекрытыми объектами из реального мира, а не только со студийными рендерами на нейтральном фоне.
  • Точно моделировать анатомию: с помощью параметрической системы Meta Momentum Human Rig (MHR) раздельно восстанавливает скелетную структуру и мягкие ткани человека.
  • Подчиняться промптам: поддерживает интерактивное управление через маски сегментации и ключевые точки на двумерном изображении.
  • Отдавать результат за секунды: оптимизированные алгоритмы диффузии собирают готовую текстурированную геометрию почти в реальном времени.

Цены и доступ

Чекпоинты моделей и код для инференса опубликованы в открытом доступе на GitHub. Параметрическая модель тела MHR доступна под разрешительной коммерческой лицензией. Протестировать генерацию на собственных изображениях можно бесплатно в браузере через веб-песочницу Segment Anything Playground.

Моушн-дизайнерам, концепт-художникам и специалистам по визуальным эффектам инструмент экономит часы на блокинг сцен. Вместо сборки драфтов с нуля вы получаете осязаемую геометрию прямо из рабочего референса.

Сайт SAM 3D
Разноебесплатно

Muse Gadgets

Открытый софт для сборки собственных устройств и экранов с голосовым ассистентом Muse

Разноеплатно

MAI-Transcribe-2-Streaming

Потоковое распознавание речи на 60 языках с откликом от 100 мс для голосовых агентов и живых субтитров.

Разноеплатно

Mercury Voice

Диффузионная языковая модель для голосовых ассистентов с откликом от 320 миллисекунд