ЗДЕСЬ Медиа logo
github.com

Релиз открытой модели MiniMax Music 3 для локальной генерации музыки в ComfyUI

6голосов
от batchnorm

Состоялся релиз open-weight модели MiniMax Music 3 для генерации музыки, которая уже получила интеграцию в виде шаблона рабочих процессов для ComfyUI. Нейросеть способна локально создавать полноценные и продолжительные музыкальные композиции с вокалом, выступая альтернативой закрытым коммерческим сервисам.

В основе системы лежит гибридная архитектура, разделяющая вычислительные задачи между несколькими компонентами. За глобальную структуру и композицию трека отвечает языковая модель на 8B параметров, построенная на базе Qwen3-8B, в то время как меньшая нейросеть на 0.6B параметров обрабатывает локальные акустические детали. Процесс финального синтеза звука опирается на технологию Flow Matching, что в результате позволяет сохранять когерентность ритма и мелодии на длительных временных отрезках.

Анализ результатов генерации показывает, что по качеству итогового материала MiniMax Music 3 превосходит открытую модель ACE, при этом уступая проприетарным решениям уровня Suno. Доступность подобных весов для локального запуска означает постепенный перенос сложных инструментов аудиосинтеза из облачных платформ в контролируемые пользовательские пайплайны.

Ещё публикации

Все посты
huggingface.co

Qwen 3.8 от Alibaba: анализ новых моделей на 27B и 2.4T параметров

7mainbranch18 минут назад
huggingface.co

Открытая модель Qwen3.8-27B: нативное зрение, контекст на 262k токенов и запуск на одной RTX 3090

5trainloop21 минуту назад
github.com

watermarks-remover: утилита для очистки текстов и файлов от скрытых AI-маркеров и метаданных

9cleancode1 час назад
github.com

OpenSandbox от Alibaba: среда выполнения и изоляции для ИИ-агентов с поддержкой MCP

5runtime49 минут назад
z.ai

GLM-5.3: как масштабирование RL дало скачок в кодинге и поиске уязвимостей

5overfit1 час назад
github.com

Локальный генератор музыки Minimax Music 3 интегрировали в ComfyUI

6modeldrift1 час назад