Песня своим голосом — это трек, где вокал звучит вашим тембром, хотя вы не спели ни одной ноты. Работает это так: вы наговариваете в микрофон несколько секунд, нейросеть снимает с записи слепок голоса, а потом поёт им вашу песню — с мелодией, аранжировкой и припевом, которых в исходной записи не было.
Главное, что стоит знать заранее: петь вы не обязаны и голос ставить не нужно. Для проверки мы сделали два клона одного и того же голоса — из записи в 22 секунды и из первых 10 секунд той же записи — и обеими спели одну и ту же песню. Ниже все замеры, аудиопримеры, цены и то, что честно не получится.
Три разных желания за одной фразой
Формулировка «песня своим голосом» скрывает три разные задачи, и путаница между ними — самая частая причина разочарования.
Первое желание — спеть самому и получить аранжировку. Человек уже поёт, ему нужен минус и сведение. Нейросеть тут почти не нужна: нужен микрофон, минусовка и редактор. Об этом у нас есть отдельные разборы — как сделать минусовку и сведение и мастеринг.
Второе желание — чтобы песню спел ваш тембр, а петь вы не будете. Это и есть поющий клон: вы даёте образец речи, модель поёт им ваш текст. Именно об этом статья.
Третье желание — перепеть чужую песню своим голосом. Технически это кавер, и здесь важно понимать ограничение: в Music Labs свой голос применяется к новой песне, которую генерирует модель, а не к загруженному чужому треку. Как устроены каверы, разобрано в статье «Каверы нейросети».
Есть и четвёртая, соседняя история — озвучка своим голосом: клон читает текст, а не поёт. Это другая модель и другая цена; сравнение обоих клонов — в статье «Клонирование голоса нейросетью».
Как это звучит: образец и две песни
Мы записали образец, сделали из него два клона и спели одну и ту же песню каждым. Донором взят синтетический голос сервиса — клонировать живого человека без его согласия нельзя, и это правило распространяется в том числе на нас самих.
Сначала исходная запись. Это обычная спокойная речь, без пения и без выражения — ровно то, что получится, если наговорить пару предложений в телефон.
Образец голоса — 22 секунды
Обычная речь без пения: четыре предложения, записанные подряд
Теперь песня, спетая клоном, собранным по этому образцу целиком. Текст написан для статьи, стиль задан одной строкой: тёплый инди-поп, акустическая гитара, женский вокал.
«Мой обычный голос» — клон из 22 секунд
Suno V5.5 с голосом-персоной, 90 секунд. Куплет, припев, бридж и финальный припев
А это та же песня, спетая вторым клоном — он собран только из первых 10 секунд той же записи, то есть модели досталось вдвое меньше материала.
«Мой обычный голос» — клон из 10 секунд
Тот же текст, тот же стиль, тот же донор. Разница только в длине образца
Сравнивать тембр лучше на слух — поэтому оба трека здесь и лежат рядом. Всё остальное в этих прогонах мы измерили, и цифры ниже.
Каким должен быть образец
Мастер принимает запись от 10 секунд, а дальше вы сами отмечаете на волне фрагмент длиной от 10 до 30 секунд — именно он уходит в модель. Записать можно прямо в браузере с микрофона или загрузить готовый файл.
Что действительно влияет на результат:
- Тишина вокруг. Всё, что попало в запись, модель считает частью голоса: эхо пустой комнаты, гул холодильника, музыка из соседней комнаты. Ковёр, шторы и закрытая дверь дают больше, чем дорогой микрофон.
- Один голос. Реплики второго человека на фоне сбивают слепок.
- Ровный темп и обычная интонация. Не нужно декламировать: читайте так, как разговариваете.
- Микрофон на расстоянии ладони. Вплотную — призвуки дыхания и «пыхи» на согласных, слишком далеко — комната звучит громче вас.
Отдельный приём для поющего клона: если вы поёте и хотите максимальной похожести именно в пении — спойте фрагмент, а не наговорите. Речевой образец даёт рабочий результат (обе песни выше сделаны именно из речи), но совпадение манеры в пении получается точнее, когда в образце уже есть пение.
Микрофона телефона достаточно. Студийная запись заметного преимущества не даст: качество упирается не в оборудование, а в чистоту комнаты.
Как сделать песню своим голосом: шаг за шагом
Весь маршрут живёт в студии песен, в блоке «Свой голос (пение)».
- 1Откройте мастер. Нажмите «Создать» в блоке «Свой голос (пение)» — откроется окно из четырёх шагов.
- 2Дайте образец. Запишите голос с микрофона или загрузите файл, назовите голос (например, «Мой голос») и на дорожке-волне выделите фрагмент 10–30 секунд.
- 3Уточните параметры. Язык — русский или английский; уровень вокала — «Начинающий», «Уверенный» или «Профи». Уровень описывает не ваши амбиции, а манеру, которую модель будет воспроизводить.
- 4Прочитайте проверочную фразу. Сервис показывает случайную фразу и просит записать её вашим голосом — это защита от загрузки чужих записей. Фразы каждый раз новые и по-русски: в наших прогонах пришли «Прекрасное звучание несёт лёгкий голос мелодии внутри» и «Мелодия в сердце рождает чистый голос и свет».
- 5Дождитесь готовности. Голос появится в списке «Мои голоса» — обычно это занимает меньше минуты.
- 6Сгенерируйте песню. Выберите созданный голос, опишите идею песни или вставьте свой текст — и запускайте. Одна генерация сразу даёт два варианта трека.
Если клонирование не удалось, кредиты возвращаются полностью, а число попыток не ограничено.
Эксперимент: 10 секунд образца против 22
Вопрос, который возникает у всех: сколько записывать? Мы проверили нижнюю границу — сделали из одной записи два клона, различающихся только длиной фрагмента, и прогнали ими одинаковую песню с одинаковым стилем.
| Клон из 22 секунд | Клон из 10 секунд | |
|---|---|---|
| Фрагмент образца | вся запись целиком | только первые 10 секунд |
| Проверка образца пройдена | да | да |
| Клон собран за | 42 секунды | 41 секунду |
| Песня сгенерирована за | 1 минуту 48 секунд | 2 минуты 50 секунд |
| Длительность вариантов | 68 и 90 секунд | 78 и 76 секунд |
| Текст спет полностью | да | да |
Главный вывод: десяти секунд хватает, чтобы получить рабочий клон. Обе записи прошли проверку с первой попытки, оба клона спели весь текст — от первого куплета до финального припева, ничего не проглотив и не заменив отсебятиной.
Разница во времени генерации песни (1:48 против 2:50) — это разброс очереди, а не свойство короткого образца: у второго клона песня просто попала в более загруженный момент. Делать из одной пары замеров вывод «короткий образец генерируется дольше» было бы нечестно.
Что эксперимент не измеряет — похожесть тембра. Объективной шкалы для неё нет, а «на слух» — это ровно то, что вы можете сделать сами по двум трекам выше. Наша рекомендация остаётся практичной: пишите 20–30 секунд, если есть возможность. Не потому, что 10 не работает — работает, — а потому, что в длинной записи у вас больше шансов попасть в спокойную интонацию и не отдать модели единственные десять секунд, где вы запнулись.
Сколько времени занимает весь путь
От «ничего нет» до готового трека — считаные минуты. Замеры из тех же прогонов:
| Шаг | Сколько заняло |
|---|---|
| Проверка образца, ожидание проверочной фразы | 17 секунд |
| Сборка голоса после записи фразы | 20–21 секунда |
| Клон целиком, от отправки образца до готового голоса | 41–42 секунды |
| Генерация песни (сразу два варианта) | 1 минута 48 секунд — 2 минуты 50 секунд |
| Весь маршрут | около 3–4 минут |
Сюда не входит человеческое время: записать образец, прочитать фразу, придумать или отредактировать текст. На практике именно оно и составляет основную часть — модель работает быстрее, чем вы решаете, о чём должна быть песня.
Сколько это стоит
Цена собирается из двух операций: создание поющего клона и генерация песни.
| Операция | Кредитов | Что получаете |
|---|---|---|
| Поющий клон | 4 | голос, которым можно спеть сколько угодно песен |
| Генерация песни | 3 | два варианта трека за одну генерацию |
| Текст песни нейросетью (по желанию) | 1 | готовый текст под вашу идею |
| Первая песня своим голосом | 7 | клон + два варианта трека |
Клон создаётся один раз: все следующие песни этим голосом стоят по 3 кредита. За регистрацию мы дарим 10 кредитов — этого хватает и на клон, и на первую песню, и ещё останется на вторую генерацию.
Дальше кредиты берутся из тарифа или пакета. Что почём в рублях:
| Как покупать | Цена | Кредитов | Первая песня своим голосом обойдётся в |
|---|---|---|---|
| Велком-бонус за регистрацию | бесплатно | 10 | 0 ₽ |
| «Попробовать все», 24 часа | 99 ₽ | 50 | около 14 ₽ |
| Пакет кредитов | 650 ₽ | 100 | около 46 ₽ |
| Тариф Pro, 30 дней | 1 490 ₽ | 500 | около 21 ₽ |
Важная деталь про доступ: поющий клон не требует подписки — он доступен на любом аккаунте, были бы кредиты. А вот озвучка своим голосом (когда клон читает текст, а не поёт) — функция тарифов Pro, Max и «Попробовать все», и стоит она дороже: 65 кредитов. Так вышло не из вредности, а из себестоимости: это разные модели у разных провайдеров.
Почему с вашим голосом заказ уходит развёрнутым
Практическая деталь, которая иначе выглядит как ошибка интерфейса. В студии есть простой режим — вы пишете идею одной фразой, а всё остальное модель придумывает сама. Но как только вы выбираете свой голос, заказ автоматически уходит в развёрнутом виде: стиль, название и текст собираются заранее.
Причина техническая: Suno принимает голос-персону только в развёрнутом режиме. Если отправить простой запрос с выбранным клоном, голос будет молча проигнорирован — модель споёт своим стандартным вокалом, а вы потратите кредиты и решите, что клон не работает. Поэтому сервис переключает режим сам и предупреждает об этом в блоке предпросмотра заказа.
Отсюда практический совет: с включённым своим голосом имеет смысл сразу писать текст самому или сгенерировать его отдельно на вкладке текстов — так вы контролируете, что именно будет спето, а не узнаёте это постфактум.
Как проверить, что клон спел весь текст
Это урок из собственной приёмки, и он экономит нервы. Проверять готовый трек «на глазок» по транскрибации нельзя.
Мы прогнали все четыре трека через штатную транскрибацию — и она показала, что первые тридцать секунд каждой песни почти пустые: пара обрывков вместо первого куплета. Вывод напрашивался неприятный: модель проглотила куплет и начала с припева.
Проверили иначе — вырезали из тех же файлов фрагмент с восьмой по тридцатую секунду и распознали его отдельно. Куплет оказался на месте, полностью, строка в строку:
Я записала тридцать секунд обычных слов, Без микрофона за сто тысяч и чужих басов. Мне говорили: голос твой не для больших сцен, А он звучит — и в нём сегодня нет ни капли стен.
То есть пропажа была не в песне, а в распознавании: на длинном музыкальном материале Whisper теряет целые фразы, оставляя формально связный текст. Если вам покажется, что нейросеть «не спела» кусок, — прежде чем перегенерировать, вырежьте сомнительный отрезок и послушайте его отдельно. Подробнее о том, где распознавание врёт и насколько, — в разборе транскрибации аудио в текст.
Где это пригодится
Клон голоса — не самоцель, и большинство людей приходит за ним ради конкретного повода.
Поздравление, которое нельзя купить. Песня, где имя звучит в припеве, а поёт её ваш собственный голос, — подарок, который невозможно повторить. Родителям, второй половине, коллеге на проводах. Что писать в тексте и какие поводы работают лучше, разобрано в статье «Песня в подарок»; отдельно есть разборы для дня рождения и юбилея.
Свой текст, который давно лежит в заметках. У многих есть написанные строки, до которых не дошли руки: петь некому, студия дорога. Здесь маршрут прямой — вставить текст, выбрать свой голос, получить трек. Как оформлять текст, чтобы модель правильно разложила его на куплеты и припев, — в разборе «Песня по своему тексту».
Демо для собственной песни. Если вы автор и хотите услышать, как вещь звучит в аранжировке, до похода в студию, — это самый дешёвый способ проверить идею. Демо своим тембром убедительнее чужого вокала: сразу слышно, ложится ли мелодия на ваш диапазон.
Голос для серии треков. Клон создаётся один раз и живёт в «Моих голосах»: можно выпустить хоть десяток песен одним узнаваемым вокалом. Для тех, кто планирует выкладывать музыку на площадки, есть инструкция как выложить песню на Яндекс Музыку.
Корпоративные и семейные поводы. Гимн команды, песня к юбилею компании, музыкальная открытка на свадьбу — во всех этих случаях ценность в том, что поёт знакомый всем голос, а не безымянный вокалист.
Чего пока не получится
Честный список ограничений, чтобы не тратить кредиты на проверку заведомо невозможного.
- Перепеть готовый чужой трек своим голосом. Клон применяется к новой песне, которую генерирует модель, а не к загруженному файлу.
- Клонировать голос знаменитости. Проверочная фраза как раз для этого: сервис просит записать случайный текст тем же голосом, что и в образце.
- Получить точную копию своей манеры. Клон повторяет тембр, но фразировку и подачу диктует модель. Чем ближе стиль песни к тому, как вы реально звучите, тем убедительнее результат.
- Длинная песня без потерь. На тексте в два куплета с пре-припевами модель к финалу начинает разъезжаться — путать язык, зацикливать слово. Структура «куплет — припев — бридж — финальный припев» отрабатывает стабильно, и обе песни в этой статье собраны именно так.
- Спеть чистым речевым тембром. Пение — это всегда интерпретация: высота, вибрато, длительности. Ждать, что трек прозвучит как ваша разговорная речь под музыку, не стоит.
Чужой голос: что говорит закон
Отдельной статьи об охране голоса в Гражданском кодексе России нет. Законопроект, который добавил бы её (новая ст. 152.3), внесён в Думу осенью 2024 года, получил отрицательный отзыв Правительства в январе 2025-го и принят не был.
Это не значит, что клонировать чужой голос можно. Работают другие нормы: права исполнителя и изготовителя фонограммы в четвёртой части ГК, режим биометрических персональных данных в 152-ФЗ (обработка — только с письменного согласия), а в худшем сценарии — статья о мошенничестве, если голосом кого-то ввели в заблуждение ради денег.
Практический вывод простой: клонируйте свой голос или голос человека, который дал на это явное согласие. Правовая сторона ИИ-музыки в целом — в статье «Авторские права на ИИ-музыку».
Частые ошибки
- Записывать образец в ванной или на кухне. Кафель и гул техники въедаются в слепок голоса, и убрать их потом нельзя.
- Читать «дикторским» голосом. Модель скопирует именно эту неестественную манеру.
- Выбрать фрагмент, где вы запнулись. На волне видно паузы — выделяйте ровный кусок.
- Ждать пения от клона для озвучки. Говорящий клон не поёт: это принципиально другая модель, а не настройка.
- Перегенерировать трек, не проверив его толком. Сначала вырежьте сомнительный фрагмент и послушайте — часто «пропавший» куплет на месте.
- Отправлять огромный текст. Четыре компактные секции звучат лучше, чем шесть длинных.
FAQ
Нужно ли уметь петь, чтобы получить песню своим голосом?
Нет. Образец — это обычная речь; петь за вас будет модель. Оба примера в этой статье сделаны из речевой записи. Если вы поёте — образец с пением даст более точное совпадение манеры.
Сколько секунд записи нужно?
Формально — от 10, и в нашем эксперименте клон из десятисекундного фрагмента спел песню целиком. На практике удобнее записать 20–30 секунд и выбрать из них самый ровный кусок.
Сколько стоит песня своим голосом?
Семь кредитов за первый раз: 4 за создание клона и 3 за генерацию песни, которая сразу даёт два варианта. Следующие песни этим же голосом — по 3 кредита. Десяти велком-кредитов за регистрацию хватает на весь первый маршрут.
Нужна ли подписка?
Нет. Поющий клон доступен на любом аккаунте при наличии кредитов. Подписка нужна для озвучки своим голосом — это отдельная функция и другая модель.
Можно ли спеть своим голосом чужую песню?
Своим голосом поётся новая песня, сгенерированная моделью. Наложить ваш тембр на загруженный чужой трек нельзя — и по технике, и по правам на исходную запись.
Сколько времени занимает весь процесс?
Около трёх-четырёх минут машинного времени: примерно 40 секунд на клон и 2–3 минуты на песню. Человеческое время — запись образца и работа над текстом — обычно больше.
Что делать, если клон звучит непохоже?
Перезаписать образец в более тихом месте и выбрать фрагмент с ровной интонацией. Второй рычаг — стиль песни: чем ближе жанр и темп к вашей естественной манере, тем убедительнее результат. Попытки не ограничены, а неудачное клонирование возвращает кредиты.
Можно ли скачать готовый трек?
Да, MP3 и WAV — скачивание входит в любой платный тариф либо покупается разово для конкретного трека.
Как создан материал
Все цифры в статье — из собственных прогонов, сделанных для этой публикации в августе 2026 года: два поющих клона одного донорского голоса (фрагменты 22 и 10 секунд), четыре сгенерированные песни, приёмка каждой через транскрибацию с перепроверкой сомнительных мест вырезкой. Донором выступил синтетический голос сервиса — живого человека клонировать без согласия нельзя. Цены сверены с действующим каталогом моделей, состав тарифов — со страницей кредитов и тарифов.





