Гайды

Сведение и мастеринг: что реально нужно треку из нейросети

Нужно ли сводить и мастерить трек из нейросети: собственный замер громкости 14 треков, разбор 12 дорожек после разделения и практика пересведения с цифрами.

Редакция Music Labs20 мин чтения
Сведение и мастеринг: что реально нужно треку из нейросети — иллюстрация Music Labs
Содержание

Сведение — это баланс между инструментами и голосом внутри песни, мастеринг — финальная подготовка готового микса к публикации. Оба этапа придумали для записей, собранных из отдельных дорожек: там без них не обойтись. Но трек из нейросети приходит уже готовым файлом, и вопрос звучит иначе — что в нём вообще нужно доводить.

Мы ответили на него замером, а не рассуждением. Прогнали 14 треков сервиса через анализатор громкости, разложили один из них на дорожки, пересвели заново и посмотрели, что изменилось. Дальше — эти цифры и то, что из них следует для вашей песни.

Сделано в Music Labs

«Первый трек» — как его отдала нейросеть

Инди-поп, 105 секунд. Именно этот файл мы разбирали на дорожки и сводили заново

Что такое сведение и мастеринг

Представьте запись группы: барабаны, бас, гитара, клавиши и голос записаны в отдельные файлы. По отдельности каждый звучит нормально, вместе — каша: бас перекрывает бочку, гитара забивает вокал, тарелки режут ухо. Сведение и есть работа с этой кашей: громкость каждой дорожки, её место в панораме между левым и правым каналом, частотная чистка, чтобы инструменты не спорили за одно и то же место, эффекты вроде реверберации и задержки.

Мастеринг начинается там, где сведение закончилось. На вход поступает уже один готовый файл — стереомикс, и задача другая: довести его до состояния, в котором он одинаково звучит в наушниках, в машине и в телефонном динамике, встаёт по громкости в один ряд с другими песнями и не искажается при сжатии на стриминге. Мастеринг-инженер работает крупными мазками: общий тональный баланс, плотность, финальный потолок громкости.

Разница проще всего объясняется через ответственность. Сведение отвечает за то, как песня устроена внутри. Мастеринг — за то, как она встраивается снаружи: в плейлист, в чужую акустику, в правила площадки.

Ключевой момент, который меняет всё для нейросетевого трека: обе процедуры предполагают, что у вас есть отдельные дорожки и сырой микс. Нейросеть отдаёт не их, а конечный файл — уже сведённый и уже обработанный на выходе. Поэтому вопрос «как свести трек из нейросети» на практике превращается в два других: что там уже сделано за вас и что вы всё-таки хотите изменить.

Наш замер: с какой громкостью нейросеть отдаёт трек

Чтобы ответить на первый вопрос, мы взяли 14 треков, созданных в сервисе, — поп, рок, хип-хоп, R&B, электронику, лоуфай, фолк — и прогнали каждый через анализатор громкости по стандарту EBU R128. Он измеряет три вещи: интегральную громкость всего трека в LUFS (единицах, привязанных к восприятию), диапазон громкости LRA (насколько тихие места отличаются от громких) и истинный пик — максимальный уровень сигнала.

ПоказательЧто получилось на 14 треках
Интегральная громкостьот −15,1 до −13,2 LUFS, в среднем −14,0
Попали в коридор −15…−13 LUFS13 треков из 14
Диапазон громкости (LRA)от 2,0 до 8,1, в среднем 4,3
Истинный пику 13 треков от −3,6 до −1,2 dBFS
Формат файлаMP3, 48 кГц, стерео, около 180–196 кбит/с

Вывод из первой строки важнее всех остальных: нейросеть отдаёт трек уже на уровне громкости коммерческого релиза. −14 LUFS — это ровно та цифра, к которой сегодня приводят звук крупные площадки. Разброс между жанрами при этом крошечный: самый тихий трек отличается от самого громкого меньше чем на 2 дБ. Так выглядит не случайность, а сознательная нормализация на стороне генератора.

Вторая строка объясняет, почему «докрутить громкость» — плохая идея: место уже занято. Третья говорит о динамике: LRA около 4 — это плотный, сильно сжатый звук, типичный для современной поп-музыки. Тихих мест в таком треке почти нет, и попытка добавить компрессии сделает его только утомительнее.

А вот четвёртая строка — единственная, где нашлась настоящая проблема. У 13 треков остался запас до потолка, но один вышел на +0,1 dBFS, то есть формально за границу цифрового нуля. На слух это незаметно, но при перекодировании в другой формат такой сигнал может дать искажения. Один случай из четырнадцати — редкость, но именно его стоит ловить перед публикацией, и ниже я покажу, чем.

Громче не значит лучше: стриминги всё выравнивают

Главное, что нужно знать про громкость в 2026 году: соревнование за неё закончилось, и выиграли слушатели. Все крупные площадки приводят треки к своему целевому уровню при воспроизведении. Загрузили тише — вам поднимут, загрузили громче — прижмут.

ПлощадкаЦелевой уровень воспроизведения
Spotify−14 LUFS (режим «Loud» −11, «Quiet» −19)
YouTubeоколо −14 LUFS
Apple Musicоколо −16 LUFS
Яндекс Музыканормализация применяется, целевое значение публично не заявлено

Практический смысл этой таблицы такой. Если ваш трек громче цели, платформа просто уменьшит уровень — и вся плотность, которую вы выжали лимитером, обернётся потерянной динамикой при той же итоговой громкости. Наоборот, слишком тихий трек поднимут, но вместе с ним поднимется и шум.

Отдельно стоит требование к пикам. Spotify рекомендует держать истинный пик ниже −1 dBTP, а если мастер громче −14 LUFS — ниже −2 dB, потому что при сжатии в потоковый формат пики немного вырастают. Наш замер показывает, что треки сервиса в эту рекомендацию укладываются: у 13 из 14 запас от 1,2 до 3,6 дБ.

Отсюда вывод, ради которого и затевался замер: специально мастерить трек из нейросети под стриминг не нужно. Он уже приходит с нужной громкостью и нужным запасом по пику. Работа остаётся другая — не «сделать громче», а «поправить то, что не нравится».

Что ИИ-треку правда нужно, а что нет

Соберу в таблицу то, к чему сводится практика. Слева — классические этапы сведения и мастеринга, справа — нужны ли они, когда исходник пришёл из генератора.

ЭтапНужен ли ИИ-треку
Общая громкость под стримингНет — уже сделано на выходе
Финальный лимитер, «плотность»Нет, и попытка добавить только съест динамику
Баланс голоса и инструментовДа, если вокал тонет или, наоборот, торчит
Убрать или заменить инструментДа — но только через разделение на дорожки
Тональная правка: низы гудят, верхи резкиеДа, эквалайзером
Обрезка вступления и хвоста, плавный входДа, и это самая частая правка
Панорама, глубина, эффектыРедко — генератор расставляет это сам
Чистка щелчков, шумов, дыханияНет — в синтезированном звуке их не бывает

Три строки, отмеченные жирным, и есть весь реальный объём работы. Всё остальное либо уже сделано, либо не нужно. Дальше разберём эти три задачи по порядку — и начнём с той, без которой две другие невозможны.

Разделение на дорожки — вход в сведение

Свести можно только то, что разделено. Пока трек — один стереофайл, вы можете менять его целиком: громче, тише, эквалайзер на всю песню. Чтобы приглушить именно гитару или поднять именно голос, нужны отдельные дорожки — их называют стемами.

Раньше это было невозможно: разделить готовую запись на инструменты умели только в лабораториях. Сегодня это делает нейросеть, и в сервисе такая функция — разделение на стемы — работает в двух режимах.

РежимЧто получитеЦена
«Вокал + Инструментал»2 дорожки: голос и минусовка2 кредита
«Полное разделение»до 12 дорожек по инструментам (у каверов — до 6)16 кредитов

Мы прогнали оба режима на одном и том же треке — том самом инди-попе, который играет в начале статьи. Режим «Вокал + Инструментал» отработал за 77 секунд. Дорожки приходят той же длины, что оригинал, секунда в секунду, и в лучшем качестве, чем исходник: 320 кбит/с против 185 у самого трека.

Вот вокальная дорожка, отделённая от всего остального, — по ней слышно и качество разделения, и то, как на самом деле спета песня:

Сделано в Music Labs

Только вокал — дорожка после разделения

Тот же трек, из которого убрано всё, кроме голоса и бэков. Дорожка приходит в 320 кбит/с — качественнее исходного файла

Важное ограничение: разделять можно треки, созданные в самом сервисе. Загруженный извне чужой файл на дорожки не разложить. Если задача не в сведении, а именно в том, чтобы получить голос или минус, — про это отдельные разборы: как убрать вокал из песни и как сделать минусовку.

И сразу первая находка, которая пригодится на практике. Мы сложили вокал и минусовку обратно — по логике должен получиться исходный трек. Получилось иначе: сумма вышла −14,3 LUFS против −15,1 у оригинала, а пик подскочил до +0,3 dBFS, то есть за цифровой ноль. Дорожки отдаются подтянутыми по уровню, и наивное сложение даёт перегруз. Это первое, о чём стоит помнить, начиная что-либо пересводить.

Что реально лежит в двенадцати дорожках

Формулировка «до 12 дорожек» звучит внушительно, но за словом «до» прячется вся суть. Мы запустили «Полное разделение» на том же треке и замерили громкость каждой из полученных дорожек.

ДорожкаГромкостьЧто в ней
Вокал−19,3 LUFSосновной голос
Бэк-вокал−19,0 LUFSподпевки, дубли припева
Бас−22,9 LUFSбасовая линия
Гитара−25,0 LUFSгитарные партии
Ударные−25,9 LUFSбарабаны
Синтезатор−26,3 LUFSподкладка, пэды
Клавиши−70 LUFSтишина
Перкуссия−70 LUFSтишина
Струнные−70 LUFSтишина
Эффекты−70 LUFSтишина
Медные духовые−70 LUFSтишина
Деревянные духовые−70 LUFSтишина

Шесть дорожек из двенадцати оказались пустыми — с уровнем около −70 LUFS и максимумом в районе −54 dBFS, то есть технически это тишина. И это не сбой: в инди-поп-треке с гитарой, басом и барабанами просто нет ни струнных, ни медных духовых. Разделение честно отдаёт все возможные категории, а какие из них заполнятся — зависит от аранжировки.

Отсюда практический вывод про выбор режима. Платить 16 кредитов за полное разделение имеет смысл, когда в песне действительно много слоёв — оркестровка, духовые, несколько клавишных партий. Если в треке гитара, бас, барабаны и голос, вы получите шесть живых дорожек и шесть пустых, а для минусовки или замены вокала хватило бы режима за 2 кредита.

Вторая проверка — обратимость. Мы сложили шесть живых дорожек без всяких правок и получили −15,5 LUFS против −15,1 у оригинала: разница в 0,4 дБ, то есть разделение практически обратимо, сумма частей восстанавливает целое. Но истинный пик при этом поднялся с −2,4 до −0,4 dBFS — запас почти исчерпан, хотя ничего ещё даже не меняли.

Микшер: сведение прямо в браузере

Когда дорожки готовы, их надо где-то собирать. Классический путь — тащить файлы в DAW вроде Reaper или Ableton; про это подробно в разборе программ для создания музыки. Короткий путь — микшер, он открывается из вкладки «Стемы» библиотеки и работает прямо в браузере.

Что он умеет:

  • громкость каждой дорожки отдельно;
  • панорама — сдвиг дорожки влево или вправо;
  • «солировать» и «заглушить», чтобы слушать партии по одной;
  • сдвиг дорожки во времени перетаскиванием;
  • добавление своих файлов к набору дорожек;
  • сведение результата в MP3 или WAV и скачивание всех дорожек архивом.

Чего он не умеет — и об этом честнее сказать сразу: в микшере нет компрессора, лимитера и реверберации. Это пульт баланса, а не студия обработки. Кредиты он не тратит, но доступен на тарифах Max и «Попробовать все», и только на компьютере — на телефоне загрузка десятка дорожек была бы неподъёмной.

Отсутствие лимитера — не придирка, а то, с чем вы столкнётесь на первой же правке. Разберём именно этот случай.

Практика: вокал тонет — как поправить

Самая частая претензия к треку из генератора: голос звучит тише, чем хотелось бы, инструменты его накрывают. Логичное решение — поднять вокальную дорожку. Мы так и сделали: подняли вокал на 3 дБ, бэк-вокал на 1,5 и свели заново.

Что сделалиГромкостьИстинный пик
Оригинал из нейросети−15,1 LUFS−2,4 dBFS
Сложили дорожки как есть−15,5 LUFS−0,4 dBFS
Вокал +3 дБ−13,9 LUFS+1,1 dBFS — перегруз
Вокал +3 дБ и лимитер на −1 dBTP−13,9 LUFS−0,9 dBFS
Инструменты −3 дБ, вокал не тронут−16,3 LUFS−1,0 dBFS

Третья строка — это ровно то, что произойдёт у вас, если действовать «в лоб». Голос стал слышнее, но пик ушёл за ноль: +1,1 dBFS — это клиппинг, срезанные верхушки волны, слышимые как хрип на громких местах. При экспорте сигнал не ограничивается плавно, а жёстко обрезается по потолку — лимитера, который бы это подхватил, в браузерном микшере нет.

Четвёртая строка показывает, как эту проблему решают в студии: тем самым лимитером, который прижимает пики, не трогая общую громкость. Мы применили его отдельным инструментом — и пик вернулся к безопасным −0,9 dBFS.

А пятая строка — то, что стоит делать вам. Не поднимайте вокал — опустите всё остальное. Результат для слуха тот же самый: разница между голосом и инструментами выросла на те же 3 дБ. Но пик не только не вырос, а стал безопаснее, запас появился, ничего не перегружено. Трек в целом стал тише — и это совершенно неважно, потому что площадка всё равно приведёт его к своей цели при воспроизведении.

Вот как звучит результат этого подхода — тот же трек, где инструментальные дорожки опущены на 3 дБ:

Сделано в Music Labs

Пересведённый вариант — голос крупнее

Инструменты опущены на 3 дБ, вокал не тронут. Пик −1,0 dBFS: запас на месте, перегруза нет

Правило, которое стоит запомнить целиком: в сведении всегда убавляйте, а не прибавляйте. Любое усиление съедает запас по пику, любое ослабление — возвращает. Когда микс собран, общую громкость поднимет одна ручка на выходе — или, в нашем случае, сама площадка.

Эквалайзер и финальная доводка

Вторая частая задача — тональная. Низ гудит, верх режет ухо, голос звучит глухо. Это работа эквалайзера, и для неё разбирать трек на дорожки не обязательно: редактор музыки правит готовый файл целиком.

В нём десять полос — 60, 170, 310, 600, 1000, 3000, 6000, 12 000, 14 000 и 16 000 Гц — и девять готовых пресетов. Ориентиры простые:

  • 60–310 Гц — бас и тело бочки. Если трек гудит и «мылит» на колонках, убирайте здесь, а не добавляйте.
  • 600–1000 Гц — та самая «картонность». Небольшой минус здесь часто делает микс чище, чем любой плюс в другом месте.
  • 3000–6000 Гц — разборчивость голоса. Аккуратный плюс поднимает вокал в миксе без изменения его громкости; перебор даёт резкость и усталость от прослушивания.
  • 12 000–16 000 Гц — «воздух». Лёгкий подъём освежает звук, но на MP3 работает слабее, чем на исходнике без сжатия.

Там же — обрезка начала и конца, плавный вход и выход, изменение темпа и тона с сохранением высоты. Всё считается в браузере, экспорт — в MP3 или WAV. Для публикации берите WAV: он не добавляет второго сжатия поверх первого.

И общий принцип для эквалайзера ровно тот же, что для баланса: режьте лишнее, а не добавляйте нужное. Подъём полосы поднимает и пик, а с запасом в 1–2 дБ, который у трека остался, разбрасываться нечем.

Мастеринг: самому, автоматом или инженеру

Если после всех правок вы хотите именно мастеринг — вот честное сравнение трёх путей.

ПутьЧего стоитКогда имеет смысл
Ничего не делатьбесплатноТрек не пересводили — он уже готов к публикации
Свои правки в браузере2 или 16 кредитов за дорожки, микшер и редактор бесплатныМеняли баланс, обрезали, правили тон
Автоматический онлайн-мастерингподписка в валюте, есть бесплатные вариантыХочется другого тонального характера
Мастеринг-инженердесятки тысяч рублей за трекРелиз, где важна каждая деталь

Про первый путь всё сказано выше: наш замер показывает, что специально доводить громкость не нужно. Второй — то, чем занималась вся эта статья.

Про третий стоит сказать отдельно. Сервисы автоматического мастеринга — LANDR, eMastered, BandLab и другие — работают по подписке или дают базовый тариф бесплатно; цены и условия у них меняются, а оплата зарубежной подписки из России отдельная задача, поэтому конкретных сумм я не привожу. Важнее другое: прогонять через них трек из нейросети чаще всего бессмысленно. Такой сервис приведёт файл к своей цели по громкости — а он уже на ней. Реальный смысл появляется, если вам нужен именно другой тональный характер, а не другая громкость.

Четвёртый путь — живой инженер. По оценкам профильных изданий, сведение трека в России стоит десятки тысяч рублей, мастеринг — существенно дешевле, но тоже тысячи. Это разумные деньги для релиза, в который вложены студийная запись и живые музыканты. Для песни, сгенерированной за минуту, экономика очевидно другая: проще сделать десять вариантов генерации и выбрать лучший, чем платить за доводку одного.

Сколько это стоит

Считаем в кредитах — так же, как всё остальное в сервисе.

ЧтоЦена
Разделение «Вокал + Инструментал»2 кредита
«Полное разделение» на инструменты16 кредитов
Микшер (сведение дорожек, экспорт MP3/WAV)бесплатно
Редактор: обрезка, эквалайзер, темп, тонбесплатно
Повторное разделение того же трека в том же режимебесплатно, кредиты не списываются

Доступность по тарифам: режим «Вокал + Инструментал» есть на всех платных тарифах, «Полное разделение» — на Pro, Max и «Попробовать все», микшер — на Max и «Попробовать все», редактор — на Pro, Max и «Попробовать все». На Pro пакет в 500 кредитов стоит 1 490 ₽, то есть кредит обходится примерно в 3 ₽: базовое разделение — около 6 ₽, полное — около 48 ₽ за трек.

Дешёвый способ попробовать всю цепочку целиком — тариф «Попробовать все» за 99 ₽: в него входят и полное разделение, и микшер, и редактор. Кредиты на нём сгорают через сутки вместе с доступом, так что имеет смысл заранее решить, какой трек вы разбираете.

Чек-лист перед публикацией

Если вы что-то меняли в треке, перед отправкой на площадки пройдитесь по короткому списку.

  1. 1Проверьте пик. Самая частая поломка после пересведения — сигнал выше нуля. Если пересобирали дорожки, убедитесь, что запас есть; в нашем прогоне простое сложение вокала и минусовки уже дало +0,3 dBFS.
  2. 2Не гонитесь за громкостью. Площадка приведёт трек к своей цели. Смысл имеет запас, а не рекорд.
  3. 3Слушайте на трёх источниках. Наушники, телефонный динамик, машина или колонки. Проблемы низа слышны только там, где низ вообще есть.
  4. 4Сравните с оригиналом вслепую. Переключайтесь между исходником и своей версией, не глядя, какая играет. Часто выясняется, что правки ничего не улучшили.
  5. 5Экспортируйте в WAV. Второе сжатие поверх первого слышно на тарелках и «воздухе».
  6. 6Оставьте паузу. Вернитесь к треку на следующий день: усталость от прослушивания искажает решения сильнее любой техники.

Дальше остаётся сама публикация — как отправить готовый трек на стриминги, разобрано в инструкции о загрузке песни в Яндекс Музыку.

Частые ошибки

Поднимать вокал вместо того, чтобы опускать остальное. Разобрано выше на замерах: +3 дБ на голосе увели пик за ноль, а те же 3 дБ, снятые с инструментов, дали ту же разницу и безопасный уровень.

Мастерить то, что уже отмастерено. Прогон готового трека через ещё один лимитер съедает остатки динамики и не даёт ничего взамен: громкость всё равно выравняет площадка.

Платить 16 кредитов там, где хватит двух. Полное разделение оправдано на плотных аранжировках. На треке из четырёх инструментов половина дорожек придёт пустыми.

Судить о миксе по одним наушникам. Особенно по игровым или с усиленным басом: в них любой трек кажется гудящим, и вы начнёте резать низ, которого в реальности не хватает.

Сводить на большой громкости. Ухо на высокой громкости слышит низ и верх иначе, и через двадцать минут решения становятся случайными. Тихая громкость честнее.

Забыть, что дорожки — это MP3. Разделение отдаёт файлы в 320 кбит/с, но это всё же сжатый формат, а исходник тоже был сжат. Бесконечно пересобирать один и тот же материал не стоит: каждый круг добавляет артефактов.

FAQ

Нужно ли сводить трек, созданный нейросетью?

Как правило, нет. По нашему замеру 14 треков, генератор отдаёт файл со средней громкостью −14 LUFS и запасом по пику 1,2–3,6 дБ — то есть готовым к публикации. Сведение нужно, только если вас не устраивает баланс: голос тонет, инструмент мешает, вступление затянуто.

Чем сведение отличается от мастеринга простыми словами?

Сведение — это работа с отдельными дорожками внутри песни: громкость, панорама, частоты. Мастеринг — работа с уже готовым стереофайлом целиком, чтобы он одинаково звучал везде и вставал в один ряд с другими треками по громкости.

Как сделать так, чтобы вокал был громче?

Не поднимайте вокал, а опустите остальные дорожки. Разделите трек на стемы, откройте микшер и уберите 2–3 дБ у инструментальных дорожек. Слышимая разница будет той же, но перегруза не возникнет — в нашем замере подъём вокала на 3 дБ увёл пик до +1,1 dBFS, а снижение инструментов на те же 3 дБ дало безопасные −1,0.

До какой громкости нужно мастерить трек в LUFS?

Для музыки ориентир — около −14 LUFS с истинным пиком ниже −1 dBTP: к таким значениям приводят звук Spotify и YouTube, Apple Music чуть тише. Делать громче бессмысленно — площадка всё равно прижмёт уровень при воспроизведении.

Сколько дорожек получится при разделении?

В режиме «Вокал + Инструментал» — ровно две. В «Полном разделении» — до двенадцати, но реально заполненными будут те, что есть в аранжировке: на нашем инди-поп-треке из двенадцати дорожек звучали шесть, остальные пришли тишиной.

Сколько времени занимает разделение на дорожки?

В нашем прогоне режим «Вокал + Инструментал» отработал за 77 секунд. Полное разделение идёт дольше; в редких случаях процесс занимает до восьми минут.

Можно ли разделить на дорожки чужой трек или свою запись?

Нет, разделение работает только с треками, созданными в сервисе. Загруженный извне файл на дорожки не разложить.

Нужен ли мне LANDR или другой сервис онлайн-мастеринга?

Для трека из нейросети — обычно нет: он уже на целевой громкости, и автоматический мастеринг просто приведёт его туда, где он и так находится. Такие сервисы имеют смысл, когда нужен другой тональный характер или когда вы сводили песню сами из живых записей.

В каком формате сохранять готовый трек?

Если после правок трек идёт на площадки — в WAV: он не добавляет второго сжатия поверх исходного. Для отправки в мессенджер или на видео достаточно MP3.

Почему после сведения дорожек трек стал звучать хуже оригинала?

Скорее всего, дело в перегрузе. Сумма дорожек громче каждой из них по отдельности, и запас по пику быстро заканчивается: в нашем прогоне простое сложение вокала и минусовки дало +0,3 dBFS, то есть выход за цифровой ноль. Убавьте пару децибел на всех дорожках и сведите заново.

Попробуйте сами — это быстрее, чем дочитать статью

Регистрация даёт 10 приветственных кредитов — хватит, чтобы проверить всё описанное на собственном треке.

Разделить трек на стемы
Источники и данные статьи
  • Собственный замер громкости: 14 треков сервиса прогнаны через анализатор EBU R128 (ffmpeg ebur128), август 2026
  • Собственный прогон разделения на дорожки и пересведения: замеры времени, громкости и пиков каждой дорожки
  • Справка Spotify для артистов, раздел Loudness normalization — целевые значения и требования к пиковому уровню
  • Справка Music Labs: разделы о разделении на стемы, микшере и редакторе; цены сверены с каталогом моделей

Читайте дальше

ИП Гилязутдинов А. Р. · ИНН 165500004740 · ОГРНИП 304165735600579 · support@musiclabs.ru

ОфертаПолитика конфиденциальности