Сведение — это баланс между инструментами и голосом внутри песни, мастеринг — финальная подготовка готового микса к публикации. Оба этапа придумали для записей, собранных из отдельных дорожек: там без них не обойтись. Но трек из нейросети приходит уже готовым файлом, и вопрос звучит иначе — что в нём вообще нужно доводить.
Мы ответили на него замером, а не рассуждением. Прогнали 14 треков сервиса через анализатор громкости, разложили один из них на дорожки, пересвели заново и посмотрели, что изменилось. Дальше — эти цифры и то, что из них следует для вашей песни.
«Первый трек» — как его отдала нейросеть
Инди-поп, 105 секунд. Именно этот файл мы разбирали на дорожки и сводили заново
Что такое сведение и мастеринг
Представьте запись группы: барабаны, бас, гитара, клавиши и голос записаны в отдельные файлы. По отдельности каждый звучит нормально, вместе — каша: бас перекрывает бочку, гитара забивает вокал, тарелки режут ухо. Сведение и есть работа с этой кашей: громкость каждой дорожки, её место в панораме между левым и правым каналом, частотная чистка, чтобы инструменты не спорили за одно и то же место, эффекты вроде реверберации и задержки.
Мастеринг начинается там, где сведение закончилось. На вход поступает уже один готовый файл — стереомикс, и задача другая: довести его до состояния, в котором он одинаково звучит в наушниках, в машине и в телефонном динамике, встаёт по громкости в один ряд с другими песнями и не искажается при сжатии на стриминге. Мастеринг-инженер работает крупными мазками: общий тональный баланс, плотность, финальный потолок громкости.
Разница проще всего объясняется через ответственность. Сведение отвечает за то, как песня устроена внутри. Мастеринг — за то, как она встраивается снаружи: в плейлист, в чужую акустику, в правила площадки.
Ключевой момент, который меняет всё для нейросетевого трека: обе процедуры предполагают, что у вас есть отдельные дорожки и сырой микс. Нейросеть отдаёт не их, а конечный файл — уже сведённый и уже обработанный на выходе. Поэтому вопрос «как свести трек из нейросети» на практике превращается в два других: что там уже сделано за вас и что вы всё-таки хотите изменить.
Наш замер: с какой громкостью нейросеть отдаёт трек
Чтобы ответить на первый вопрос, мы взяли 14 треков, созданных в сервисе, — поп, рок, хип-хоп, R&B, электронику, лоуфай, фолк — и прогнали каждый через анализатор громкости по стандарту EBU R128. Он измеряет три вещи: интегральную громкость всего трека в LUFS (единицах, привязанных к восприятию), диапазон громкости LRA (насколько тихие места отличаются от громких) и истинный пик — максимальный уровень сигнала.
| Показатель | Что получилось на 14 треках |
|---|---|
| Интегральная громкость | от −15,1 до −13,2 LUFS, в среднем −14,0 |
| Попали в коридор −15…−13 LUFS | 13 треков из 14 |
| Диапазон громкости (LRA) | от 2,0 до 8,1, в среднем 4,3 |
| Истинный пик | у 13 треков от −3,6 до −1,2 dBFS |
| Формат файла | MP3, 48 кГц, стерео, около 180–196 кбит/с |
Вывод из первой строки важнее всех остальных: нейросеть отдаёт трек уже на уровне громкости коммерческого релиза. −14 LUFS — это ровно та цифра, к которой сегодня приводят звук крупные площадки. Разброс между жанрами при этом крошечный: самый тихий трек отличается от самого громкого меньше чем на 2 дБ. Так выглядит не случайность, а сознательная нормализация на стороне генератора.
Вторая строка объясняет, почему «докрутить громкость» — плохая идея: место уже занято. Третья говорит о динамике: LRA около 4 — это плотный, сильно сжатый звук, типичный для современной поп-музыки. Тихих мест в таком треке почти нет, и попытка добавить компрессии сделает его только утомительнее.
А вот четвёртая строка — единственная, где нашлась настоящая проблема. У 13 треков остался запас до потолка, но один вышел на +0,1 dBFS, то есть формально за границу цифрового нуля. На слух это незаметно, но при перекодировании в другой формат такой сигнал может дать искажения. Один случай из четырнадцати — редкость, но именно его стоит ловить перед публикацией, и ниже я покажу, чем.
Громче не значит лучше: стриминги всё выравнивают
Главное, что нужно знать про громкость в 2026 году: соревнование за неё закончилось, и выиграли слушатели. Все крупные площадки приводят треки к своему целевому уровню при воспроизведении. Загрузили тише — вам поднимут, загрузили громче — прижмут.
| Площадка | Целевой уровень воспроизведения |
|---|---|
| Spotify | −14 LUFS (режим «Loud» −11, «Quiet» −19) |
| YouTube | около −14 LUFS |
| Apple Music | около −16 LUFS |
| Яндекс Музыка | нормализация применяется, целевое значение публично не заявлено |
Практический смысл этой таблицы такой. Если ваш трек громче цели, платформа просто уменьшит уровень — и вся плотность, которую вы выжали лимитером, обернётся потерянной динамикой при той же итоговой громкости. Наоборот, слишком тихий трек поднимут, но вместе с ним поднимется и шум.
Отдельно стоит требование к пикам. Spotify рекомендует держать истинный пик ниже −1 dBTP, а если мастер громче −14 LUFS — ниже −2 dB, потому что при сжатии в потоковый формат пики немного вырастают. Наш замер показывает, что треки сервиса в эту рекомендацию укладываются: у 13 из 14 запас от 1,2 до 3,6 дБ.
Отсюда вывод, ради которого и затевался замер: специально мастерить трек из нейросети под стриминг не нужно. Он уже приходит с нужной громкостью и нужным запасом по пику. Работа остаётся другая — не «сделать громче», а «поправить то, что не нравится».
Что ИИ-треку правда нужно, а что нет
Соберу в таблицу то, к чему сводится практика. Слева — классические этапы сведения и мастеринга, справа — нужны ли они, когда исходник пришёл из генератора.
| Этап | Нужен ли ИИ-треку |
|---|---|
| Общая громкость под стриминг | Нет — уже сделано на выходе |
| Финальный лимитер, «плотность» | Нет, и попытка добавить только съест динамику |
| Баланс голоса и инструментов | Да, если вокал тонет или, наоборот, торчит |
| Убрать или заменить инструмент | Да — но только через разделение на дорожки |
| Тональная правка: низы гудят, верхи резкие | Да, эквалайзером |
| Обрезка вступления и хвоста, плавный вход | Да, и это самая частая правка |
| Панорама, глубина, эффекты | Редко — генератор расставляет это сам |
| Чистка щелчков, шумов, дыхания | Нет — в синтезированном звуке их не бывает |
Три строки, отмеченные жирным, и есть весь реальный объём работы. Всё остальное либо уже сделано, либо не нужно. Дальше разберём эти три задачи по порядку — и начнём с той, без которой две другие невозможны.
Разделение на дорожки — вход в сведение
Свести можно только то, что разделено. Пока трек — один стереофайл, вы можете менять его целиком: громче, тише, эквалайзер на всю песню. Чтобы приглушить именно гитару или поднять именно голос, нужны отдельные дорожки — их называют стемами.
Раньше это было невозможно: разделить готовую запись на инструменты умели только в лабораториях. Сегодня это делает нейросеть, и в сервисе такая функция — разделение на стемы — работает в двух режимах.
| Режим | Что получите | Цена |
|---|---|---|
| «Вокал + Инструментал» | 2 дорожки: голос и минусовка | 2 кредита |
| «Полное разделение» | до 12 дорожек по инструментам (у каверов — до 6) | 16 кредитов |
Мы прогнали оба режима на одном и том же треке — том самом инди-попе, который играет в начале статьи. Режим «Вокал + Инструментал» отработал за 77 секунд. Дорожки приходят той же длины, что оригинал, секунда в секунду, и в лучшем качестве, чем исходник: 320 кбит/с против 185 у самого трека.
Вот вокальная дорожка, отделённая от всего остального, — по ней слышно и качество разделения, и то, как на самом деле спета песня:
Только вокал — дорожка после разделения
Тот же трек, из которого убрано всё, кроме голоса и бэков. Дорожка приходит в 320 кбит/с — качественнее исходного файла
Важное ограничение: разделять можно треки, созданные в самом сервисе. Загруженный извне чужой файл на дорожки не разложить. Если задача не в сведении, а именно в том, чтобы получить голос или минус, — про это отдельные разборы: как убрать вокал из песни и как сделать минусовку.
И сразу первая находка, которая пригодится на практике. Мы сложили вокал и минусовку обратно — по логике должен получиться исходный трек. Получилось иначе: сумма вышла −14,3 LUFS против −15,1 у оригинала, а пик подскочил до +0,3 dBFS, то есть за цифровой ноль. Дорожки отдаются подтянутыми по уровню, и наивное сложение даёт перегруз. Это первое, о чём стоит помнить, начиная что-либо пересводить.
Что реально лежит в двенадцати дорожках
Формулировка «до 12 дорожек» звучит внушительно, но за словом «до» прячется вся суть. Мы запустили «Полное разделение» на том же треке и замерили громкость каждой из полученных дорожек.
| Дорожка | Громкость | Что в ней |
|---|---|---|
| Вокал | −19,3 LUFS | основной голос |
| Бэк-вокал | −19,0 LUFS | подпевки, дубли припева |
| Бас | −22,9 LUFS | басовая линия |
| Гитара | −25,0 LUFS | гитарные партии |
| Ударные | −25,9 LUFS | барабаны |
| Синтезатор | −26,3 LUFS | подкладка, пэды |
| Клавиши | −70 LUFS | тишина |
| Перкуссия | −70 LUFS | тишина |
| Струнные | −70 LUFS | тишина |
| Эффекты | −70 LUFS | тишина |
| Медные духовые | −70 LUFS | тишина |
| Деревянные духовые | −70 LUFS | тишина |
Шесть дорожек из двенадцати оказались пустыми — с уровнем около −70 LUFS и максимумом в районе −54 dBFS, то есть технически это тишина. И это не сбой: в инди-поп-треке с гитарой, басом и барабанами просто нет ни струнных, ни медных духовых. Разделение честно отдаёт все возможные категории, а какие из них заполнятся — зависит от аранжировки.
Отсюда практический вывод про выбор режима. Платить 16 кредитов за полное разделение имеет смысл, когда в песне действительно много слоёв — оркестровка, духовые, несколько клавишных партий. Если в треке гитара, бас, барабаны и голос, вы получите шесть живых дорожек и шесть пустых, а для минусовки или замены вокала хватило бы режима за 2 кредита.
Вторая проверка — обратимость. Мы сложили шесть живых дорожек без всяких правок и получили −15,5 LUFS против −15,1 у оригинала: разница в 0,4 дБ, то есть разделение практически обратимо, сумма частей восстанавливает целое. Но истинный пик при этом поднялся с −2,4 до −0,4 dBFS — запас почти исчерпан, хотя ничего ещё даже не меняли.
Микшер: сведение прямо в браузере
Когда дорожки готовы, их надо где-то собирать. Классический путь — тащить файлы в DAW вроде Reaper или Ableton; про это подробно в разборе программ для создания музыки. Короткий путь — микшер, он открывается из вкладки «Стемы» библиотеки и работает прямо в браузере.
Что он умеет:
- громкость каждой дорожки отдельно;
- панорама — сдвиг дорожки влево или вправо;
- «солировать» и «заглушить», чтобы слушать партии по одной;
- сдвиг дорожки во времени перетаскиванием;
- добавление своих файлов к набору дорожек;
- сведение результата в MP3 или WAV и скачивание всех дорожек архивом.
Чего он не умеет — и об этом честнее сказать сразу: в микшере нет компрессора, лимитера и реверберации. Это пульт баланса, а не студия обработки. Кредиты он не тратит, но доступен на тарифах Max и «Попробовать все», и только на компьютере — на телефоне загрузка десятка дорожек была бы неподъёмной.
Отсутствие лимитера — не придирка, а то, с чем вы столкнётесь на первой же правке. Разберём именно этот случай.
Практика: вокал тонет — как поправить
Самая частая претензия к треку из генератора: голос звучит тише, чем хотелось бы, инструменты его накрывают. Логичное решение — поднять вокальную дорожку. Мы так и сделали: подняли вокал на 3 дБ, бэк-вокал на 1,5 и свели заново.
| Что сделали | Громкость | Истинный пик |
|---|---|---|
| Оригинал из нейросети | −15,1 LUFS | −2,4 dBFS |
| Сложили дорожки как есть | −15,5 LUFS | −0,4 dBFS |
| Вокал +3 дБ | −13,9 LUFS | +1,1 dBFS — перегруз |
| Вокал +3 дБ и лимитер на −1 dBTP | −13,9 LUFS | −0,9 dBFS |
| Инструменты −3 дБ, вокал не тронут | −16,3 LUFS | −1,0 dBFS |
Третья строка — это ровно то, что произойдёт у вас, если действовать «в лоб». Голос стал слышнее, но пик ушёл за ноль: +1,1 dBFS — это клиппинг, срезанные верхушки волны, слышимые как хрип на громких местах. При экспорте сигнал не ограничивается плавно, а жёстко обрезается по потолку — лимитера, который бы это подхватил, в браузерном микшере нет.
Четвёртая строка показывает, как эту проблему решают в студии: тем самым лимитером, который прижимает пики, не трогая общую громкость. Мы применили его отдельным инструментом — и пик вернулся к безопасным −0,9 dBFS.
А пятая строка — то, что стоит делать вам. Не поднимайте вокал — опустите всё остальное. Результат для слуха тот же самый: разница между голосом и инструментами выросла на те же 3 дБ. Но пик не только не вырос, а стал безопаснее, запас появился, ничего не перегружено. Трек в целом стал тише — и это совершенно неважно, потому что площадка всё равно приведёт его к своей цели при воспроизведении.
Вот как звучит результат этого подхода — тот же трек, где инструментальные дорожки опущены на 3 дБ:
Пересведённый вариант — голос крупнее
Инструменты опущены на 3 дБ, вокал не тронут. Пик −1,0 dBFS: запас на месте, перегруза нет
Правило, которое стоит запомнить целиком: в сведении всегда убавляйте, а не прибавляйте. Любое усиление съедает запас по пику, любое ослабление — возвращает. Когда микс собран, общую громкость поднимет одна ручка на выходе — или, в нашем случае, сама площадка.
Эквалайзер и финальная доводка
Вторая частая задача — тональная. Низ гудит, верх режет ухо, голос звучит глухо. Это работа эквалайзера, и для неё разбирать трек на дорожки не обязательно: редактор музыки правит готовый файл целиком.
В нём десять полос — 60, 170, 310, 600, 1000, 3000, 6000, 12 000, 14 000 и 16 000 Гц — и девять готовых пресетов. Ориентиры простые:
- 60–310 Гц — бас и тело бочки. Если трек гудит и «мылит» на колонках, убирайте здесь, а не добавляйте.
- 600–1000 Гц — та самая «картонность». Небольшой минус здесь часто делает микс чище, чем любой плюс в другом месте.
- 3000–6000 Гц — разборчивость голоса. Аккуратный плюс поднимает вокал в миксе без изменения его громкости; перебор даёт резкость и усталость от прослушивания.
- 12 000–16 000 Гц — «воздух». Лёгкий подъём освежает звук, но на MP3 работает слабее, чем на исходнике без сжатия.
Там же — обрезка начала и конца, плавный вход и выход, изменение темпа и тона с сохранением высоты. Всё считается в браузере, экспорт — в MP3 или WAV. Для публикации берите WAV: он не добавляет второго сжатия поверх первого.
И общий принцип для эквалайзера ровно тот же, что для баланса: режьте лишнее, а не добавляйте нужное. Подъём полосы поднимает и пик, а с запасом в 1–2 дБ, который у трека остался, разбрасываться нечем.
Мастеринг: самому, автоматом или инженеру
Если после всех правок вы хотите именно мастеринг — вот честное сравнение трёх путей.
| Путь | Чего стоит | Когда имеет смысл |
|---|---|---|
| Ничего не делать | бесплатно | Трек не пересводили — он уже готов к публикации |
| Свои правки в браузере | 2 или 16 кредитов за дорожки, микшер и редактор бесплатны | Меняли баланс, обрезали, правили тон |
| Автоматический онлайн-мастеринг | подписка в валюте, есть бесплатные варианты | Хочется другого тонального характера |
| Мастеринг-инженер | десятки тысяч рублей за трек | Релиз, где важна каждая деталь |
Про первый путь всё сказано выше: наш замер показывает, что специально доводить громкость не нужно. Второй — то, чем занималась вся эта статья.
Про третий стоит сказать отдельно. Сервисы автоматического мастеринга — LANDR, eMastered, BandLab и другие — работают по подписке или дают базовый тариф бесплатно; цены и условия у них меняются, а оплата зарубежной подписки из России отдельная задача, поэтому конкретных сумм я не привожу. Важнее другое: прогонять через них трек из нейросети чаще всего бессмысленно. Такой сервис приведёт файл к своей цели по громкости — а он уже на ней. Реальный смысл появляется, если вам нужен именно другой тональный характер, а не другая громкость.
Четвёртый путь — живой инженер. По оценкам профильных изданий, сведение трека в России стоит десятки тысяч рублей, мастеринг — существенно дешевле, но тоже тысячи. Это разумные деньги для релиза, в который вложены студийная запись и живые музыканты. Для песни, сгенерированной за минуту, экономика очевидно другая: проще сделать десять вариантов генерации и выбрать лучший, чем платить за доводку одного.
Сколько это стоит
Считаем в кредитах — так же, как всё остальное в сервисе.
| Что | Цена |
|---|---|
| Разделение «Вокал + Инструментал» | 2 кредита |
| «Полное разделение» на инструменты | 16 кредитов |
| Микшер (сведение дорожек, экспорт MP3/WAV) | бесплатно |
| Редактор: обрезка, эквалайзер, темп, тон | бесплатно |
| Повторное разделение того же трека в том же режиме | бесплатно, кредиты не списываются |
Доступность по тарифам: режим «Вокал + Инструментал» есть на всех платных тарифах, «Полное разделение» — на Pro, Max и «Попробовать все», микшер — на Max и «Попробовать все», редактор — на Pro, Max и «Попробовать все». На Pro пакет в 500 кредитов стоит 1 490 ₽, то есть кредит обходится примерно в 3 ₽: базовое разделение — около 6 ₽, полное — около 48 ₽ за трек.
Дешёвый способ попробовать всю цепочку целиком — тариф «Попробовать все» за 99 ₽: в него входят и полное разделение, и микшер, и редактор. Кредиты на нём сгорают через сутки вместе с доступом, так что имеет смысл заранее решить, какой трек вы разбираете.
Чек-лист перед публикацией
Если вы что-то меняли в треке, перед отправкой на площадки пройдитесь по короткому списку.
- 1Проверьте пик. Самая частая поломка после пересведения — сигнал выше нуля. Если пересобирали дорожки, убедитесь, что запас есть; в нашем прогоне простое сложение вокала и минусовки уже дало +0,3 dBFS.
- 2Не гонитесь за громкостью. Площадка приведёт трек к своей цели. Смысл имеет запас, а не рекорд.
- 3Слушайте на трёх источниках. Наушники, телефонный динамик, машина или колонки. Проблемы низа слышны только там, где низ вообще есть.
- 4Сравните с оригиналом вслепую. Переключайтесь между исходником и своей версией, не глядя, какая играет. Часто выясняется, что правки ничего не улучшили.
- 5Экспортируйте в WAV. Второе сжатие поверх первого слышно на тарелках и «воздухе».
- 6Оставьте паузу. Вернитесь к треку на следующий день: усталость от прослушивания искажает решения сильнее любой техники.
Дальше остаётся сама публикация — как отправить готовый трек на стриминги, разобрано в инструкции о загрузке песни в Яндекс Музыку.
Частые ошибки
Поднимать вокал вместо того, чтобы опускать остальное. Разобрано выше на замерах: +3 дБ на голосе увели пик за ноль, а те же 3 дБ, снятые с инструментов, дали ту же разницу и безопасный уровень.
Мастерить то, что уже отмастерено. Прогон готового трека через ещё один лимитер съедает остатки динамики и не даёт ничего взамен: громкость всё равно выравняет площадка.
Платить 16 кредитов там, где хватит двух. Полное разделение оправдано на плотных аранжировках. На треке из четырёх инструментов половина дорожек придёт пустыми.
Судить о миксе по одним наушникам. Особенно по игровым или с усиленным басом: в них любой трек кажется гудящим, и вы начнёте резать низ, которого в реальности не хватает.
Сводить на большой громкости. Ухо на высокой громкости слышит низ и верх иначе, и через двадцать минут решения становятся случайными. Тихая громкость честнее.
Забыть, что дорожки — это MP3. Разделение отдаёт файлы в 320 кбит/с, но это всё же сжатый формат, а исходник тоже был сжат. Бесконечно пересобирать один и тот же материал не стоит: каждый круг добавляет артефактов.
FAQ
Нужно ли сводить трек, созданный нейросетью?
Как правило, нет. По нашему замеру 14 треков, генератор отдаёт файл со средней громкостью −14 LUFS и запасом по пику 1,2–3,6 дБ — то есть готовым к публикации. Сведение нужно, только если вас не устраивает баланс: голос тонет, инструмент мешает, вступление затянуто.
Чем сведение отличается от мастеринга простыми словами?
Сведение — это работа с отдельными дорожками внутри песни: громкость, панорама, частоты. Мастеринг — работа с уже готовым стереофайлом целиком, чтобы он одинаково звучал везде и вставал в один ряд с другими треками по громкости.
Как сделать так, чтобы вокал был громче?
Не поднимайте вокал, а опустите остальные дорожки. Разделите трек на стемы, откройте микшер и уберите 2–3 дБ у инструментальных дорожек. Слышимая разница будет той же, но перегруза не возникнет — в нашем замере подъём вокала на 3 дБ увёл пик до +1,1 dBFS, а снижение инструментов на те же 3 дБ дало безопасные −1,0.
До какой громкости нужно мастерить трек в LUFS?
Для музыки ориентир — около −14 LUFS с истинным пиком ниже −1 dBTP: к таким значениям приводят звук Spotify и YouTube, Apple Music чуть тише. Делать громче бессмысленно — площадка всё равно прижмёт уровень при воспроизведении.
Сколько дорожек получится при разделении?
В режиме «Вокал + Инструментал» — ровно две. В «Полном разделении» — до двенадцати, но реально заполненными будут те, что есть в аранжировке: на нашем инди-поп-треке из двенадцати дорожек звучали шесть, остальные пришли тишиной.
Сколько времени занимает разделение на дорожки?
В нашем прогоне режим «Вокал + Инструментал» отработал за 77 секунд. Полное разделение идёт дольше; в редких случаях процесс занимает до восьми минут.
Можно ли разделить на дорожки чужой трек или свою запись?
Нет, разделение работает только с треками, созданными в сервисе. Загруженный извне файл на дорожки не разложить.
Нужен ли мне LANDR или другой сервис онлайн-мастеринга?
Для трека из нейросети — обычно нет: он уже на целевой громкости, и автоматический мастеринг просто приведёт его туда, где он и так находится. Такие сервисы имеют смысл, когда нужен другой тональный характер или когда вы сводили песню сами из живых записей.
В каком формате сохранять готовый трек?
Если после правок трек идёт на площадки — в WAV: он не добавляет второго сжатия поверх исходного. Для отправки в мессенджер или на видео достаточно MP3.
Почему после сведения дорожек трек стал звучать хуже оригинала?
Скорее всего, дело в перегрузе. Сумма дорожек громче каждой из них по отдельности, и запас по пику быстро заканчивается: в нашем прогоне простое сложение вокала и минусовки дало +0,3 dBFS, то есть выход за цифровой ноль. Убавьте пару децибел на всех дорожках и сведите заново.





