Гайды

Клонирование голоса нейросетью: как создать свой ИИ-голос

Клонирование голоса нейросетью онлайн: два вида клона — говорящий и поющий. Требования к образцу, шаги, цены в кредитах, срок хранения, закон и реальные примеры звучания.

Редакция Music Labs15 мин чтения
Клонирование голоса нейросетью: как создать свой ИИ-голос — иллюстрация Music Labs
Содержание

Клонирование голоса нейросетью — это создание цифровой копии тембра по короткой записи: вы даёте 12–30 секунд своей речи, а дальше сервис произносит вашим голосом любой текст, которого в записи не было. В Music Labs таких клона два и они решают разные задачи: говорящий — для озвучки (65 кредитов), поющий — чтобы вашим голосом была спета песня (4 кредита).

Разница между ними — главная причина, по которой у людей «не получается». Клон из студии озвучки читает текст ровно и разборчиво, но петь он не умеет в принципе: это разные модели и разные технологии. Ниже — как устроен каждый, каким должен быть образец, сколько всё стоит, что об этом говорит российское право и как звучит результат на живых примерах.

Что такое клонирование голоса и как оно работает

Нейросеть не режет вашу запись на кусочки и не склеивает из них новые фразы — так работали синтезаторы речи двадцать лет назад, и слышно это было сразу. Современная модель извлекает из образца компактное описание голоса: высоту, тембровую окраску, характерные призвуки, темп, манеру договаривать окончания. Это описание («слепок» голоса) хранится отдельно от текста, поэтому клон произносит слова, которых в записи никогда не было.

Отсюда два практических следствия. Первое: длинный образец не нужен — модели хватает считаных секунд, а дальше прирост качества быстро выходит на плато. Второе: качество клона определяется не длиной записи, а её чистотой. Тридцать секунд в тихой комнате дадут лучший результат, чем пять минут на улице: всё, что попало в образец, модель считает частью вашего голоса — и эхо пустой комнаты, и гул холодильника, и музыку из соседнего окна.

Сама операция быстрая. В нашем замере клон голоса для озвучки собрался за 11 секунд после отправки образца — дольше обычно идёт запись и прослушивание, чем работа модели.

Два клона: говорящий и поющий

Это тот самый момент, на котором путаются чаще всего: клон для озвучки не поёт, а поющий клон не читает тексты. В Music Labs они живут в разных разделах и стоят по-разному.

Говорящий клонПоющий клон
Что делаетЧитает любой текст вашим голосомПоёт вашим тембром в сгенерированной песне
Где включаетсяСтудия озвучки, кнопка «Создать голос»Студия песен, блок «Свой голос (пение)»
Образец12 секунд — 4 минуты речиОт 10 секунд, фрагмент 10–30 секунд
Проверка личностиДва согласия перед запускомСогласия + проверочная фраза голосом
Цена65 кредитов4 кредита
ТарифыPro, Max, «Попробовать все»Любой, включая стартовый
РезультатГолос в категории «Мои голоса», работает как обычный дикторГолос-персона, который подставляется в генерацию песни

Почему такая разница в цене: это принципиально разные модели у разных поставщиков. Говорящий клон делает полноценный синтез речи — им можно озвучить хоть целую аудиокнигу, и стоимость клонирования у поставщика соответствующая. Поющий клон устроен проще: он не синтезирует речь, а передаёт музыкальной модели описание тембра, который та использует при генерации вокала.

Ещё одно отличие, о котором стоит знать заранее: поющий клон работает только на модели Suno V5.5 и только в развёрнутом режиме заказа. Поэтому при выборе своего голоса в студии автоматически отключается тумблер «Инструментал» — голосу нужно что петь, — а заказ уходит в подробном виде: стиль, название и текст. Если отправить его коротким описанием, модель проигнорирует клон и споёт своим вокалом.

Как это звучит: один голос — три дорожки

Здесь важная оговорка, и она же — тема отдельного раздела ниже. Для примеров мы не брали голос живого человека: чужой голос без согласия клонировать нельзя, и это ровно то, чему учит статья. Донором стал синтетический голос из нашей же галереи озвучки — так что образец идеально чистый, без комнаты и микрофона. У домашней записи результат будет чуть мягче, но механика та же.

Сначала образец — полминуты ровной речи. Столько же сервис просит и у вас.

Сделано в Music Labs

Образец голоса — 31 секунда

Исходная запись: 407 знаков текста, ровный темп, ни музыки, ни второго голоса

Теперь тот же голос произносит текст, которого в образце не было. Это и есть проверка: клонирование запоминает не фразы, а голос.

Сделано в Music Labs

Клон читает новый текст — 17 секунд

Голос собран за 11 секунд, озвучено 220 знаков

А это песня, спетая поющим клоном того же голоса: тембр перенесён в вокал, музыку и аранжировку модель написала сама.

Сделано в Music Labs

«Мой голос» — песня, спетая клоном

Suno V5.5 с голосом-персоной; текст написан для статьи

Припев, который вы слышите:

Но это мой голос — он поёт,
Он вышел из молчания вперёд.
Полминуты записи — и он живой,
Слышишь, теперь он поёт со мной.

Честно о том, как это далось. Голос-персона собрался с первого раза и меньше чем за минуту, а вот песню пришлось генерировать трижды: во всех прогонах модель начинала не с первой строки куплета — растягивала её распевкой или сразу уходила в припев. Треки с клоном получались и короче обычных — от 53 до 111 секунд. Вывод для практики: текст для поющего клона давайте компактный и не рассчитывайте на пятиминутную балладу с первого захода.

Каким должен быть образец

Единственное, чем вы реально управляете в клонировании, — это запись. Модель одинаково старательно скопирует и бархатный баритон, и сип простуженного горла.

Что в записиКак это слышно в клоне
Тихая комната, микрофон в 20–30 смРовный узнаваемый тембр — эталонный случай
Эхо пустой комнаты, кафель, большой залКлон звучит «в бочке», гулкость никуда не девается
Музыка или телевизор на фонеПризвуки и шипение в паузах, тембр «плывёт»
Второй человек в кадреМодель мешает два голоса в один — самый частый брак
Слишком короткая записьТембр угадан приблизительно, интонации плоские
Шёпот, крик, простуженный голосКлон получится шепчущим, кричащим и простуженным

Практические ориентиры простые. Говорите обычным голосом, как рассказываете что-то знакомому, не читайте «дикторски» — модели важнее разборчивость, чем выразительность. Держите один темп и не глотайте окончания. Смартфон подойдёт: гарнитура или диктофон в тихой комнате дают более чем достаточное качество, а вот запись на улице или в машине лучше переделать.

Для поющего клона есть отдельный совет, который мы вывели из наших же прогонов: спойте фрагмент той песни, которую собираетесь получить. Не говорите — именно спойте, желательно первый куплет в нужном настроении. Если дать модели обычную речь, совпадение тембра в пении получается заметно слабее.

Шаг за шагом: клон для озвучки

  1. 1**Откройте студию озвучки** и нажмите «Создать голос» над галереей дикторов.
  2. 2Запишите образец прямо в браузере — большая кнопка микрофона — или загрузите готовый файл до 30 МБ. Записи короче 12 секунд сервис не примет, максимум — 4 минуты; оптимум около 30 секунд. Формат значения не имеет: браузерную запись мы сами перекодируем в подходящий.
  3. 3Дайте голосу имя — под ним он появится в категории «Мои голоса».
  4. 4Отметьте два согласия: что вы имеете право использовать этот голос и берёте ответственность на себя, и что клон хранится 5 дней с момента последнего использования.
  5. 5Дождитесь готовности — обычно это секунды. Дальше клон работает как любой другой диктор: пишете текст, ставите паузы и эмоции, платите за озвучку 3 кредита за 1000 знаков.

Ориентир по времени звучания: в нашем замере 220 знаков превратились в 17 секунд речи, 407 знаков — в 31 секунду. То есть около 1000 знаков на минуту с небольшим — по этому можно прикидывать длительность ролика ещё до генерации. Подробнее про теги пауз, эмоции и диалоги — в разборе нейросетей для озвучки текста.

Шаг за шагом: поющий клон

Мастер в студии песен состоит из четырёх шагов, и третий обычно вызывает вопросы.

  1. 1Запись или загрузка. Нужно от 10 секунд, файл — до 30 МБ. Здесь и стоит спеть кусок будущей песни.
  2. 2Выбор фрагмента. Запись рисуется звуковой волной, по ней двигаются два ползунка: берите 10–30 секунд, где голос звучит чище всего, без вдохов в микрофон и пауз.
  3. 3Проверочная фраза. Сервис показывает случайную фразу вроде «Пусть голос плывёт и звенит словно музыка сегодня» — её нужно произнести и записать. Это защита от чужих голосов: подставить скачанный из интернета файл не выйдет, потому что фразу генерируют заново под каждую попытку.
  4. 4Уровень вокала. Начинающий, средний, продвинутый или профессиональный — модель учитывает это, когда переносит тембр в пение.

Голос появляется в «Мои голоса» со значком загрузки. Дождитесь, пока она закончится, кликните по голосу — и только потом запускайте генерацию песни. Если клонирование не удалось, кредиты возвращаются полностью: это нормальная ситуация, попытки ничем не ограничены. Как устроена сама генерация вокала, разобрано в статье «Нейросеть поёт».

Сколько стоит клонирование

ОперацияЦена
Говорящий клон (создание)65 кредитов
Озвучка текста этим голосом3 кредита за 1000 знаков
Поющий клон (создание)4 кредита
Песня с поющим клоном3 кредита за генерацию, два варианта трека
Повторная попытка после ошибкиБесплатно — кредиты возвращаются

Считать удобно от задачи, а не от прайса. Пятиминутный ролик — это примерно 4500 знаков текста, то есть около 14 кредитов озвучки поверх разового клонирования. Песня своим голосом обойдётся в 7 кредитов за всё: 4 за голос и 3 за генерацию. Новым пользователям при регистрации начисляются 10 кредитов — на поющий клон с песней этого хватает, на говорящий нужно пополнение. Актуальные пакеты — на странице пополнения баланса.

Отдельно — про доступ. Клонирование в Music Labs работает из России напрямую: без VPN, без зарубежной карты и без иностранного номера для регистрации. У большинства известных западных сервисов клонирование живёт в платной подписке, которую из России сейчас не оплатить обычной картой, — и именно на этом чаще всего заканчиваются подборки «топ-15 нейросетей для клонирования голоса».

Сколько живёт клон и как его удалить

Говорящий клон хранится 5 дней с момента последнего использования. Каждая новая озвучка этим голосом продлевает срок — то есть пока вы работаете, голос никуда не денется; если забыли о нём на неделю, он удалится сам. Это не жадность сервиса, а гигиена: слепок голоса — чувствительные данные, и держать их вечно «на всякий случай» неправильно.

Что из этого следует практически: если вы озвучиваете курс или книгу неделями, делайте это подряд, а не набегами раз в месяц — иначе придётся клонировать заново и платить второй раз. И храните исходный образец у себя: с ним повторное клонирование займёт минуту.

Удалить клон раньше срока можно самому — карточка голоса в «Моих голосах» удаляется вместе со слепком. Если нужно убедиться, что записи не осталось совсем, напишите в поддержку: мы удалим и загруженный образец.

Можно ли клонировать чужой голос: что говорит закон

Короткий ответ: свой — можно всегда, чужой — только с его согласия, знаменитостей — нельзя. Теперь подробности, потому что вокруг них много путаницы.

Отдельной статьи об охране голоса в Гражданском кодексе России пока нет. Законопроект, который добавил бы в ГК статью 152.3 и защитил голос по аналогии с изображением — включая случаи, когда голос синтезирован нейросетью, — внесён в Госдуму в сентябре 2024 года. В январе 2025-го правительство дало на него отрицательный отзыв: по мнению кабмина, эти вопросы уже урегулированы действующим законодательством. Закон не принят до сих пор.

Из «уже урегулированного» на практике работают три вещи:

  1. 1Запись чужого голоса — это фонограмма. У неё есть изготовитель и исполнитель, у обоих — свои права по четвёртой части ГК. Скачать чужой подкаст и скормить его клонировщику — значит использовать чужую фонограмму без разрешения.
  2. 2Голос может быть биометрическими персональными данными. Если по записи устанавливают личность, действует закон о персональных данных со всеми его требованиями к согласию.
  3. 3Обман с чужим голосом — это уже уголовная плоскость. Схема «звонок родственника, попавшего в беду», собранный из кружочков в мессенджере, квалифицируется как мошенничество независимо от того, каким инструментом сделан голос.

Голоса артистов и дикторов — отдельный случай: там к перечисленному добавляются смежные права исполнителя, а узнаваемый голос по сути работает как средство индивидуализации. Поэтому легальные сервисы такую функцию просто не дают, а требование согласия зашивают в интерфейс: в Music Labs перед клонированием вы подтверждаете, что имеете право использовать этот голос. Как устроены права на то, что получилось на выходе, разобрано в статье про авторские права на ИИ-музыку.

Как защитить собственный голос

Технология доступна всем, и обратная сторона у неё ровно одна: ваш голос теперь можно подделать по короткой записи из соцсетей. Полностью убрать риск нельзя — можно снизить цену ошибки.

  • Договоритесь о кодовом слове с родителями и детьми. Один вопрос в разговоре надёжнее любой экспертизы на слух.
  • Перезванивайте сами на известный номер, если «родственник» просит денег. Ни одна срочность не отменяет тридцати секунд на проверку.
  • Не подтверждайте операции голосом там, где есть альтернатива. Голосовая биометрия удобна, но пароль и код из приложения проверяются машиной, а не ухом.
  • Помните, что признаки подделки исчезают. Год назад клон выдавали ровные паузы и отсутствие дыхания — сегодня модели их имитируют. Полагаться на «я узнаю подделку по звуку» уже нельзя.

Где клон реально экономит время

  • Курсы и обучающие видео. Записали десять модулей своим голосом — на одиннадцатом голос сел, а исправить нужно одну фразу в третьем. Клон переозвучивает эту фразу в том же тембре, и склейка не слышна.
  • Блог и соцсети на потоке. Сценарий пишется быстрее, чем расставляется свет и настраивается микрофон: клон позволяет выпускать ролики в дни, когда записывать себя некогда.
  • Аудиоверсии статей. Текстовый блог получает озвучку голосом автора — без студии и без чтеца.
  • Персональные поздравления. Песня, спетая вашим голосом, работает сильнее открытки: подробнее — в подборке форматов нейросетевых поздравлений.
  • Голос бренда. Один клон вместо диктора на аутсорсе: автоответчик, ролики, обновления инструкций звучат одинаково спустя год.

Чего клон не заменит: живой актёрской игры. Ирония, надлом в голосе, пауза «на подумать» в нужном месте — это по-прежнему территория человека. Клон отлично держит ровное чтение и узнаваемость, но не сыграет роль.

Частые ошибки

  1. 1Ждать пения от клона для озвучки. Он читает — и всё. Для песни нужен поющий клон в студии песен.
  2. 2Клонировать по записи из шумного места. Шум, эхо и второй голос попадают в слепок навсегда — переписать образец быстрее, чем бороться с результатом.
  3. 3Говорить, когда нужно петь. Поющий клон, снятый с обычной речи, звучит бледнее: спойте кусок будущей песни.
  4. 4Забыть про срок хранения. Клон для озвучки исчезнет через 5 дней простоя — держите под рукой исходный образец.
  5. 5Отправить заказ песни коротким описанием. С выбранным клоном заказ должен уходить в развёрнутом виде, иначе модель споёт своим голосом.
  6. 6Клонировать чужой голос «на пробу». Это нарушение и правил сервиса, и чужих прав — независимо от того, что вы собирались с ним делать.

FAQ

Сколько нужно записи, чтобы клонировать голос?

Для клона озвучки — минимум 12 секунд, максимум 4 минуты; практический оптимум — около 30 секунд чистой речи. Поющему клону хватает 10 секунд, но фрагмент для анализа выбирается в диапазоне 10–30 секунд. Дальше длина почти не влияет: важнее чистота записи.

Можно ли клонировать голос бесплатно?

Полностью бесплатного клонирования в Music Labs нет, но 10 кредитов при регистрации покрывают поющий клон (4 кредита) вместе с генерацией песни (3 кредита). Говорящий клон стоит 65 кредитов и доступен на тарифах Pro, Max и «Попробовать все». Сервисы, обещающие бесплатный клон без ограничений, обычно ограничивают длину озвучки или ставят водяной знак.

Клон будет говорить с моим акцентом и манерой?

Тембр и общая манера переносятся хорошо, темп — частично. Сильный региональный акцент модель обычно сглаживает: она опирается на нормативное произношение языка. Интонационный рисунок конкретной фразы задаёте вы — тегами пауз и эмоций в студии озвучки.

Почему клон звучит «не как я»?

Три типовые причины: в образце был шум или эхо, запись слишком короткая, или вы читали «дикторским» голосом, непохожим на обычную речь. Перезапишите образец в тихой комнате обычным тоном — разница слышна сразу.

Можно ли клонировать голос по видео?

Да, если у вас есть право на эту запись: достаточно извлечь звук и загрузить его файлом. Требования те же — чистая дорожка без музыки и посторонних голосов. Чужое видео из интернета брать нельзя.

Насколько похоже поёт поющий клон?

Совпадение тембра сильно зависит от образца. Если человек спел кусок будущей песни, сходство высокое; если наговорил текст обычной речью, ощутимо ниже. Наш совет по итогам замеров — записывать именно пение, в том же настроении и темпе, что и в будущей песне.

Что произойдёт с моим голосом после клонирования?

Слепок хранится 5 дней с последнего использования и затем удаляется автоматически. Голос доступен только в вашем аккаунте: другие пользователи не могут им озвучивать тексты и не видят его в галерее.

Нужен ли VPN и зарубежная карта?

Нет. Music Labs работает из России напрямую, оплата — картами российских банков, регистрация — по почте или через Яндекс и VK.

Попробуйте сами — это быстрее, чем дочитать статью

Регистрация даёт 10 приветственных кредитов — хватит, чтобы проверить всё описанное на собственном треке.

Озвучить текст
Источники и данные статьи
  • Справка Music Labs: /help/voiceover, /help/create-song, /help/credits (проверено 31 июля 2026)
  • Действующие цены сервиса в кредитах, сверены с каталогом моделей
  • Проект федерального закона № 718834-8 (новая ст. 152.3 ГК РФ «Охрана голоса гражданина»), внесён в сентябре 2024; отрицательный отзыв Правительства РФ — январь 2025
  • ГК РФ, часть четвёртая: ст. 1313 и 1317 (права исполнителя), ст. 1322–1324 (права изготовителя фонограммы); Федеральный закон № 152-ФЗ «О персональных данных», ст. 11 (биометрические персональные данные)

Читайте дальше

ИП Гилязутдинов А. Р. · ИНН 165500004740 · ОГРНИП 304165735600579 · support@musiclabs.ru

ОфертаПолитика конфиденциальности