База знаний
Звук и музыка

Как сделать трек с вокалом

8 мин чтения

Задача понятна каждому, кто искал музыку под ролик или подарок и упирался в чужие права: нужна песня — с голосом, куплетами и припевом, — а не просто фоновая подложка. В Synty за это отвечает модель Suno V5.5: вы описываете жанр и настроение или присылаете готовый текст, а на выходе получаете два варианта законченной композиции с аранжировкой и вокалом.

Результат подходит для роликов, подарков, джинглов, личных проектов и фоновой музыки для соцсетей — для большинства таких задач генерации хватает без доработки. Для релиза под артистическим именем со своим узнаваемым звучанием трек обычно дорабатывают: сводят, подчищают бас и верх.

Дальше — как задать запрос так, чтобы не тратить генерации впустую, и на что обратить внимание перед тем как показывать трек кому-то ещё.

Что понадобится

Модель — Suno V5.5. Одна генерация стоит 300 SC и отдаёт сразу два разных варианта трека на один и тот же запрос: это не два прогона по цене одного, а особенность режима — можно сравнить оба и выбрать более удачный.

Генерация занимает от десятков секунд до пары минут в зависимости от загрузки. Готовые треки скачиваются в виде аудиофайла и остаются доступны в истории генераций.

Ограничения — до того, как вы начнёте

  • Описание стиля и текст песни — два отдельных поля. Держите описание стиля коротким и предметным: длинное перечисление модель разбирает хуже, чем четыре внятных блока.
  • Описывайте звучание словами, а не через отсылку к конкретному артисту: модель опирается на жанр, инструменты и настроение, и такое описание даёт предсказуемый результат.
  • Если стиль совсем не описан, модель выберет его сама и результат может не совпасть с задумкой. Указывайте хотя бы жанр и настроение.
  • Русский текст модель поёт с заметным акцентом и иногда путает ударения. Английский звучит стабильнее. Если нужен именно русский вокал, короткие строки без сложных стечений согласных дают результат надёжнее, чем сложные обороты, и обычно берут меньше попыток на исправление.
  • Модель не гарантирует точное совпадение с референсом или структурой, которую вы задумали. Метатеги подсказывают структуру, а не диктуют её жёстко — об этом ниже.
  • Генерация может сорваться на стороне модели. В этом случае списанные SC возвращаются на баланс — платить за пустой результат не нужно.

Пошагово

  1. Откройте инструмент Suno V5.5 в разделе генерации аудио. Модель рассчитана именно на треки с вокалом и аранжировкой — если нужна музыка совсем без голоса, там же можно указать инструментальный вариант отдельным запросом.

  2. Решите, с чем работаете: с готовым текстом или с идеей без слов. Если текст песни уже есть — вставляете его целиком, вокал ляжет на ваши слова, а не на сгенерированные. Если текста нет — опишите идею словами, и модель сама придумает лирику под заданный жанр и настроение. Для написания текста песни можно предварительно обратиться к любой из текстовых моделей Synty, а затем перенести готовый результат в запрос Suno.

  3. Опишите жанр и настроение первым делом. Это самая весомая часть запроса: она задаёт общий характер звука, на который потом ложится всё остальное. Одной-двух фраз обычно достаточно — «меланхоличный синт-поп», «энергичный рок с живыми барабанами».

  4. Добавьте блок с тем, чего быть не должно. Перечислите два-четыре соседних стиля, в которые генерация не должна уходить. Это не формальность: без явного исключения модель регулярно смещается в похожий, но не тот жанр, и генерацию приходится повторять. По нашим наблюдениям, этот блок экономит больше попыток, чем детальное расписывание самого жанра.

  5. Опишите инструменты и характер вокала одной строкой. Тип голоса (мужской, женский, дуэт), плотность аранжировки, есть ли живые барабаны или бас на переднем плане. Модель учитывает эти детали, но не всегда буквально — относитесь к ним как к направлению, а не к точной команде.

  6. Разметьте текст структурными пометками, если вставляете свои слова. Вступление, куплет, припев, мостик, финал — если обозначить эти границы явно, модель строит структуру песни куда предсказуемее, чем если полагаться на переносы строк. Подробнее — в разделе ниже.

  7. Укажите темп и общее ощущение в конце запроса. BPM, если он для вас принципиален, и одно-два слова про настроение — необязательный, но полезный штрих: модель учитывает его не всегда.

  8. Запустите генерацию и прослушайте оба варианта. Один запрос отдаёт два разных трека — иногда удачнее оказывается не тот, что кажется более аккуратным по звучанию, а тот, где точнее легла эмоция. Стоит слушать оба до конца, а не судить по первым секундам.

Разбор запроса

Пример полного запроса для трека с собственным текстом:

ЖАНР. Меланхоличный синт-поп с женским вокалом, настроение — ночная
дорога, немного ностальгии.

ИСКЛЮЧИТЬ. Не уводить в EDM, тяжёлый рок, кантри, акустическое звучание.

ИНСТРУМЕНТЫ И ГОЛОС. Мягкие синт-пэды, плавный бас, электронные барабаны
без резких акцентов. Вокал — тёплый, не форсированный.

ТЕКСТ.
[Вступление]
Огни в стекле дрожат едва
Дорога тянется без слов

[Куплет]
Я еду прямо, еду в ночь
Слова растают, боль уйдет

[Припев]
Держи меня, держи меня
Пока горит последний свет

[Финал]
И снова тишина в пути

ТЕГИ. Темп 92 BPM, атмосферно, аккуратное сведение, чистый верх.

Построчный разбор:

  • ЖАНР — задаёт общий вектор звучания. Это первое, на что опирается модель, и убрать этот блок нельзя: без него генерация становится случайной, и стиль каждый раз будет разным.
  • ИСКЛЮЧИТЬ — страхует от соскальзывания в соседний жанр. Если убрать этот блок, риск получить «примерно то, но не то» заметно выше, особенно на жанрах, у которых много близких поджанров.
  • ИНСТРУМЕНТЫ И ГОЛОС — направляет аранжировку и характер вокала. Модель ориентируется на эти подсказки, но не исполняет их буквально как команду — трактуйте блок как пожелание, а не техническое задание.
  • ТЕКСТ с пометками [Вступление], [Куплет], [Припев], [Финал] — это единственная часть запроса, которая работает надёжно как структурная инструкция. Если убрать квадратные пометки и оставить только текст без разметки, модель будет угадывать границы секций по переносам строк, и результат станет менее предсказуемым от генерации к генерации.
  • ТЕГИ в конце — темп и общее настроение. Как и блок с инструментами, это подсказка, а не команда: модель учитывает её не всегда буквально.

Без готового текста просто опустите блок ТЕКСТ и опишите идею песни словами в блоке ЖАНР: модель сама придумает лирику на основе заданного стиля и настроения.

Типичные проблемы

СимптомПричинаЧто сделать
Трек получился совсем не в том жанре, что заказывалиНе было блока с исключениями, модель соскользнула в соседний стильДобавить два-четыре смежных стиля в блок «исключить» и повторить генерацию
Куплет и припев путаются местами или сливаютсяТекст не размечен структурными пометкамиЯвно обозначить границы секций: вступление, куплет, припев, мостик, финал
Русский текст звучит с акцентом или ударения не на своём местеОсобенность работы модели с русским языкомСократить строки, убрать сложные стечения согласных, проверить на паре вариантов
Указали настроение и инструменты, а в треке этого не слышноТеги настроения и инструментов модель учитывает не всегда буквальноПеренести важные детали в описание стиля (блок ЖАНР), а не полагаться только на теги
Генерация не вернула результат или оборвалась с ошибкойСбой на стороне моделиПовторить запрос — списанные SC за неудачную генерацию возвращаются на баланс
Результат не похож на задуманное, хотя жанр указанОписание через отсылку к артисту вместо характеристик звукаОписать словами: тембр вокала, набор инструментов, плотность аранжировки, темп

Чек-лист перед публикацией результата

  • Прослушали оба варианта из генерации целиком, а не только первые секунды.
  • Текст песни разборчив, слова не наезжают друг на друга.
  • Если текст на русском — проверили ударения и звучание вслух.
  • Структура трека логична: есть вступление, развитие, кульминация в припеве, финал.
  • Бас и верхние частоты не проваливаются на разных устройствах воспроизведения — телефон, колонки.
  • Если трек предназначен для публичного использования — убедились, что в запросе не было чужих имён и защищённых прав третьих лиц.
  • Файл сохранён отдельно, а не остаётся только в истории генераций.

Что дальше

Если нужна музыка без вокала — фон под видео, джингл, инструментальная подложка, — воспользуйтесь готовым каркасом «Инструментал под видео» из библиотеки промптов, там та же логика запроса, но без блока с текстом. Для смешения двух стилей в одном треке есть каркас «Стилевая связка двух жанров». А если у вас уже есть готовая композиция и нужно изменить её настроение или сделать кавер — смотрите каркас «Перепеть свой трек в другом настроении».