MiniMax Music: нейросеть, которая поёт по-русски и делает каверыНейросети по названиям: какая модель что умеет и где её включить

MiniMax Music: нейросеть, которая поёт по-русски и делает каверы

MiniMax Music — модель генерации музыки, которую здесь держат ради двух вещей, недоступных больше нигде. Она поёт на языке вашего текста — то есть по-русски (у соседней Lyria русского вокала нет вовсе), и она делает кавер на ваш собственный трек: берёт запись, распознаёт слова и перепевает их в другом жанре.

Ниже — сама модель. Опишите песню, которая нужна: ответ придёт прямо на эту страницу, регистрация для первой попытки не нужна.

Загрузка…

Что вы сейчас пробуете

Это не демо-режим: запрос уходит в ту же модель, что и в основном чате. Генерация музыки медленнее, чем ответ текстом, — это нормально, страницу закрывать не нужно.

Русский вокал — то, ради чего её и включают

Язык пения следует за языком текста: пишете слова по-русски — получаете русскую песню. Звучит очевидно, но среди подключённых моделей так умеет только эта: Lyria поёт на восьми языках, и русского среди них нет.

Слова можно дать свои, а можно попросить написать. Отдельный инструмент сочиняет текст с названием и разметкой по секциям — и он не тратит генерацию: текст можно вычитать и поправить, пока трек ещё не оплачен.

Про произношение — честно

Качество произношения непостоянно. Иногда ударение уезжает, иногда слышен акцент — и предсказать заранее, на какой строчке это случится, нельзя. Выбора голоса в этой модели тоже нет: попросить «другого вокалиста» не получится, можно только перегенерировать и получить новый.

Практический вывод: короткие и простые по фонетике строки звучат надёжнее длинных и сложных. Если в тексте есть имя собственное, которое обязано прозвучать чисто, проверьте именно его в первом же дубле.

Каверы: сначала текст, потом деньги

Кавер здесь — не одна кнопка, а два шага, и это сделано ради вас.

  1. Разбор. Вы даёте исходную запись, модель распознаёт из неё слова и размечает по секциям. Генерация на этом шаге ещё не запускается, а результат разбора живёт сутки.
  2. Кавер. Вы правите распознанный текст — где ошиблось распознавание, где хочется поменять слова, — и только теперь модель перепевает его в нужном жанре.

Прочитайте расшифровку до генерации

Это единственное место в главе, где можно сэкономить по-настоящему. Распознавание слышит не всё: одна перепутанная строчка — и кавер спет с ошибкой, а исправить его можно только новой генерацией по полной цене. Кавер стоит ровно столько же, сколько песня с нуля.

Разбор при этом отдельной генерации не стоит, а его результат действителен сутки — вычитывать текст можно спокойно и не в один присест.

Разметка текста по секциям

Слова поются дословно, поэтому структуру задают тегами на отдельных строках: [Intro], [Verse], [Chorus], [Bridge], [Outro].

Ремарки в тексте будут спеты

Всё, что модель не распознала как тег секции, она считает словами песни и поёт. Пометка вроде «здесь тихо и мечтательно», оставленная посреди текста, окажется в вокале дословно. Указания по аранжировке — в описание трека, а не в слова.

Любой языкВокалСледует за языком текста, включая русский — в отличие от Lyria
3500Символов текстаДостаточно для полноценной песни с куплетами и припевами
24 часаЖивёт разбор кавераУспеть вычитать распознанные слова можно не спеша

MiniMax или Lyria — короткая развилка

ЗадачаКакая модель
Песня со словами по-русскиMiniMax
Кавер на свой трекMiniMax
Инструментал, фон под видеоLyria
Дешёвый перебор идейLyria Clip
По цене MiniMax заметно дороже: один трек здесь стоит примерно как четыре тридцатисекундных черновика Lyria. Поэтому идею стоит доводить словами, а не перегенерациями.

Чего MiniMax Music не сделает

  • Не даст выбрать голос. Ни по имени, ни по образцу — вокалист приходит какой придёт.
  • Не отредактирует готовый трек. Любое изменение — новая генерация по полной цене.
  • Не гарантирует произношение длинных и фонетически сложных строк.
  • Не сделает дёшево. Для перебора вариантов дешевле Lyria Clip, а MiniMax включать, когда текст и жанр уже понятны.

Частые вопросы

Может ли нейросеть спеть песню на русском языке?
Да — MiniMax Music поёт на языке текста, который вы дали, включая русский. Это единственная подключённая модель, которая так умеет: у Google Lyria вокал существует только на восьми языках, и русского среди них нет.
Как сделать кавер на свою песню?
В два шага. Сначала разбор: вы прикладываете запись, модель распознаёт слова и размечает их по секциям — генерация при этом не тратится, а результат живёт сутки. Потом вы правите распознанный текст и запускаете сам кавер. Читать расшифровку до генерации обязательно: ошибка распознавания иначе окажется спетой, а исправление стоит как новый трек.
Можно ли выбрать голос вокалиста?
Нет, выбора голоса в этой модели не существует. Единственный способ получить другой вокал — перегенерировать трек, и это будет новая работа по полной цене.
Почему в песне неправильное ударение или акцент?
Качество произношения у модели непостоянно, и заранее предсказать проблемную строчку нельзя. Надёжнее звучат короткие и простые по фонетике строки. Если в тексте есть имя, которое обязано прозвучать чисто, проверьте его в первом же дубле.
Можно ли дать модели свой текст песни?
Да, и он будет спет дословно — до 3500 символов, чего хватает на полноценную песню. Структуру задавайте тегами [Intro], [Verse], [Chorus], [Bridge], [Outro] на отдельных строках. Важно: всё, что не является тегом, считается словами и будет спето, поэтому ремарки об аранжировке пишите в описание трека, а не в текст.
Что дешевле — MiniMax или Lyria?
Lyria, заметно: один трек MiniMax стоит примерно как четыре тридцатисекундных черновика Lyria Clip и почти вдвое дороже трёхминутного Lyria Pro. Но за русский вокал и каверы платить больше не за что — у Lyria этого нет.
Нужно ли выбирать MiniMax в чате вручную?
Нет, списка моделей в интерфейсе нет — движок подбирается под задачу автоматически, и просьба написать песню со словами уйдёт именно сюда. Назвать модель явно можно при обращении по API, а попробовать — в окне выше на этой странице.

Примеры и цены — на странице генерации музыки. Что и когда мы подключали — в записи о подключении. Другие модели — в оглавлении книги; про музыку вообще — в книге про генерацию музыки.

Попробуйте сами

Всё из этого руководства работает в Twelver

Один чат для текста, картинок, видео, музыки и озвучки — без отдельных сервисов и подписок.

Открыть чат Twelver
Оцените свой опыт