MiniMax открыла музыкальную ИИ-модель с японским вокалом и локальным запуском

MiniMax открыла музыкальную ИИ-модель с японским вокалом и локальным запуском

Китайская ИИ-компания MiniMax бесплатно опубликовала MiniMax-Music3 — модель для генерации музыки по текстовому описанию. Она создает композиции продолжительностью до пяти минут, добавляет вокал и поддерживает песни на японском языке.

Пользователь может указать жанр, набор инструментов и фразы, которые должны прозвучать в тексте. В демонстрации для модели заказали рок-композицию с гитарой, басом и барабанами, а также японскими строками о жарком лете, риске теплового удара и необходимости пить воду.

Сам MiniMax-Music3 получает подготовленный запрос и превращает его в аудиофайл. Написание развернутого текста песни и сборка структурированного промпта выполняются отдельным инструментом. MiniMax также опубликовала ИИ-навык, который преобразует короткую идею пользователя в подходящие для модели инструкции и длинные тексты песен.

Веб-демо работает через бесплатную вычислительную платформу ZeroGPU от Hugging Face. У нее жесткие ограничения: во время теста лимит закончился уже после генерации одной минутной композиции. Экспорт песни в видео также относится к интерфейсу демо, а не к возможностям музыкальной модели.

MiniMax-Music3 уже можно запускать локально через ComfyUI — графический интерфейс для сборки процессов генеративного ИИ. В таком режиме количество генераций не ограничено.

Релиз дает разработчикам готовую модель для локальных музыкальных экспериментов с вокалом.

Александр Чернов
Александр Чернов

Журналист с техническим бэкграундом, пишущий о практических аспектах внедрения искусственного интеллекта. Бывший главред федерального издания. Любит сбалансированную подачу информации без хайпа.