Insaga

Озвучка видео нейросетью

Озвучка видео нейросетью: у каждого героя свой голос

Обычная озвучка текста нейросетью читает всё одним голосом. Истории этого мало: нужен рассказчик, девчонка, которая тараторит, старый капитан, который цедит слова, и робот, не похожий ни на того, ни на другого. Insaga делит сценарий на реплики, отдаёт каждую тому, кто её произносит, озвучивает каждую роль своим голосом из 6 000 с лишним и кладёт запись под картинку на таймлайне.

100 кредитов бесплатно · без карты

Кадр в стиле комикса: в лавке с банками и пучками трав женщина в капюшоне со свечой в руках говорит с темноволосой девочкой, которая стоит к нам спиной
Старая знахарка и девочка: два голоса
Чёрно-белый кадр: молодая женщина в костюме 1950-х и улыбающийся мужчина в тёмном костюме с галстуком стоят в пустом классе
Разговор после уроков
Пластилин: веснушчатый мальчик и седобородый мужчина с глазами-пуговицами стоят нос к носу на заставленной кухне
Нос к носу: мальчик и старик
Рисунок пером: один мужчина кричит и тычет пальцем в фигурку лошади у себя на ладони, другой смотрит на него в ужасе, позади толпа и лошади
Спор посреди толпы
Человечки-палочки: один скрестил руки, второй в синей шляпе, третий в повязке показывает пальцем на двоих других
Трое говорят — три голоса

Как текст превращается в озвучку по ролям

Вкладка озвучки берёт текст вашего проекта — тот самый, по которому рисовались кадры, — или любой, который вы вставите. Режимов два: «Один голос», когда всё читает один диктор, и «Голоса персонажей», когда текст расписывается по ролям, как радиоспектакль. Ниже — второй, по шагам.

  1. Разберите текст по говорящим

    Нажмите «Анализ персонажей в тексте». Insaga прочитает сценарий и разложит его на реплики: прямая речь уходит тому, кто её говорит, всё остальное — рассказчику. Герои, которых вы уже видели в кадрах, появляются в списке со своими портретами и числом реплик, так что голос подбирается знакомому лицу, а не строчке в таблице. Разбор кредитов не тратит.

  2. Поправьте, кто что говорит

    В окне «Реплики и роли» весь сценарий раскрашен по говорящим. Щёлкните реплику или протяните мышью по куску фразы и выберите, чей это текст. Пропущенного персонажа можно добавить по имени, соседние реплики — объединить, любую правку — отменить, а одной кнопкой вернуть разбор ИИ. В одном тексте помещается до 64 ролей.

  3. Сначала рассказчик, потом остальные

    Рассказчик — базовый голос: персонаж, которому вы не дали своего голоса, прозвучит голосом рассказчика, поэтому дыр в записи не бывает. Дальше откройте список голосов у каждого героя: мужские или женские, фильтр по языку, поиск по имени и кнопка прослушивания, чтобы услышать голос до выбора. Понравившиеся отметьте звёздочкой и подпишите — например, «капитан, 1-й сезон». Избранное и подписи хранятся в аккаунте.

    Чёрно-белый кадр: ночью женщина в плаще сидит у окна, по которому течёт дождь, со стаканом в руке и письмом на коленях
    Сцена без реплик принадлежит рассказчику: письмо, воспоминание, дождь.
  4. Озвучьте и правьте по одной реплике

    Каждый персонаж пишется на свою дорожку — даже тот, кто остался без голоса. Прослушайте целиком. Не подошла роль — щёлкните персонажа и перезапишите всё, что он говорит, другим голосом. Не получилась одна фраза — щёлкните этот фрагмент на дорожке и перегенерируйте только его, тем же голосом или другим, до пяти раз. Остальная запись не сдвинется ни на слово.

  5. Положите голос под картинку

    Вариантов озвучки можно сделать сколько угодно и отметить тот, что уходит в монтаж. В редакторе кнопка «Собрать» расшифровывает запись и раскладывает клипы сцен по таймлайну вдоль неё: сцена на экране, пока звучат её реплики. Субтитры строятся по той же расшифровке, слово в слово, в любом из 31 стиля. Готовую озвучку можно и скачать аудиофайлом, если монтируете в другом редакторе.

Четыре героя, которые не должны звучать похоже

Кадры ниже — из одной аниме-истории, сделанной в Insaga. Состав: девчонка, которая летает, робот, который летает с ней, капитан, повидавший слишком много бурь, и кит, живущий в облаках. На экране их не спутаешь. На слух нужен такой же внимательный подбор, поэтому до того, как открыть список, распишите каждому короткое задание на голос.

Герои и задание на голос

  • Портрет: улыбчивая девушка-пилот с очками, поднятыми на лоб, в оранжевой куртке с меховым воротникомЛётчица: юная, быстрая
  • Портрет: маленький медно-рыжий робот, единственная круглая линза светится синим под двухлопастным пропеллеромРобот: отрывисто, чудно
  • Портрет: суровый старый моряк в белой фуражке с якорем, седая борода, через плечо подзорная трубаКапитан: низко, неспешно
  • Портрет: пухлый бледно-голубой кит из облака с большими фиолетовыми глазами и сиреневыми пятнамиКит: без слов, за него говорит рассказчик

Сцены, где они говорят

Под висячим фонарём девушка-пилот, её робот и старый капитан склонились над бумажной картой, развёрнутой на деревянном сундуке
Трое над одной картой
На мокром деревянном причале девушка смеётся, робот машет обеими руками, а из облачного моря в фонтане брызг выныривает огромный кит, позади замок на парящем острове
Два голоса и всплеск
На закате пилот, робот, капитан и облачный кит стоят рядом на краю причала над морем облаков, вдали маяк на парящей скале
Вся команда, последнее слово — за рассказчиком

Простое правило: если двое делят сцену, пусть различаются хотя бы двумя признаками из трёх — возрастом, высотой голоса, темпом. Лётчица и капитан расходятся по всем трём. Двум сёстрам-ровесницам нужен хотя бы разный темп, иначе зритель перестаёт понимать, кто говорит, как только камера отворачивается.

Как подобрать голоса, чтобы они выдержали всё видео

Слушайте свою реплику, а не образец. Кнопка прослушивания в списке играет образец самого голоса, и голос, тёплый в образце, может оказаться плоским на злой реплике. Отметьте звёздочкой трёх кандидатов, озвучьте сцену и замените роль, которая не легла: перезапишется только она.

Рассказчику — самый ровный голос. Почти в любой истории основной текст у рассказчика, и слушать его будут минут десять подряд. Берите голос, с которым удобно, а не самый драматичный, а яркие голоса оставьте героям с короткими репликами.

Язык голоса — под язык текста. Голоса размечены языками, на которых говорят. Голос, выбранный за тембр, но не размеченный русским, может прочитать русский текст с чужим акцентом. Сначала фильтр «Язык», потом выбор на слух.

Пишите для уха. Цифры, сокращения и скобки трудно читать вслух. Если важно, как прозвучат «2026» или «т. е.», напишите это словами — так, как должно звучать.

Сериал должен звучать одинаково. Голоса выбираются в каждом проекте заново, и вернувшемуся герою нужен тот же голос. Подписи у избранных голосов превращают это в дело на десять секунд: на самом голосе написано, чей он.

Что ещё умеет вкладка озвучки

Больше 6 000 голосов
Мужские и женские, молодые и пожилые, на десятках языков, в том числе на русском. Поиск по имени, остальное — постранично.
Скорость и паузы
В настройках голоса темп меняется от половинного до двойного, а между фразами можно добавить паузы: триллер торопится, сказка на ночь дышит.
Своя запись
Начитали текст сами? Загрузите WAV, MP3, M4A или AAC до 50 МБ — редактор расшифрует запись и соберёт под неё сцены так же, как под голос нейросети.
Озвучку можно скачать
Готовая озвучка скачивается аудиофайлом, если видео монтируете в другом редакторе.
Подготовка без кредитов
Разбор текста по ролям и перевод сценария кредитов не тратят. Платится только сама озвучка.
Безлимит на Studio
Озвучка доступна на платных тарифах, а в Studio и Studio Max входит без ограничений — вместе с картинками, анимацией и экспортом.

Та же история на другом языке

Ещё до озвучки вкладка «Перевод» переводит сценарий сразу на три языка из 27 — среди них английский, испанский, португальский, немецкий, украинский и хинди. Перевод кредитов не тратит. У каждого языка своё окно: прочитайте, поправьте или вставьте свой вариант — озвучено будет ровно то, что в окне.

У каждой языковой дорожки свой голос. Список для дорожки сначала показывает голоса, размеченные её языком: испанский текст читает испанский голос, а не английский с акцентом. Дорожки озвучиваются отдельными заданиями, рядом с оригиналом.

Картинка от языка не зависит. Новая дорожка ложится под те же сцены, а субтитры, расшифрованные с неё, выходят уже на её языке. Так одна история кормит второй канал для другой страны, и ни одного нового кадра или ролика для этого не нужно.

Озвучка в Insaga и обычный синтез речи

InsagaОбычный синтез речи
Что вставляетеИсторию с рассказчиком и персонажамиКусок текста под один голос
ДиалогиРеплики делятся по говорящим сами, вы правите разборРежете текст на куски и озвучиваете по одному
Голосов в одной записиРассказчик и свой голос каждому персонажу, до 64 ролейОбычно один голос на генерацию
Одна неудачная фразаЩёлкнули фрагмент — перегенерировалась только онаЗаново весь файл или ножницы в аудиоредакторе
КартинкаСцены собираются под запись на таймлайнеАудиофайл, который ещё подгонять к видео
СубтитрыИз той же записи, 31 стильОтдельный шаг или отдельный сервис

Сравнение общее: сервисы синтеза речи разные, и у некоторых тоже есть проекты на несколько голосов. Insaga не заменяет аудиостудию — она сделана, чтобы озвучить историю, у которой уже есть картинка.

Истории, которым одного голоса мало

Сказки и истории на ночь. Рассказчик читает книжный текст, а у лисы, бабушки и волка свои голоса. Маленький слушатель узнаёт, кто говорит, даже не глядя на экран.

Ужасы, детективы, реальные истории. Один ровный рассказчик и короткие реплики свидетеля, голоса в телефонной трубке, кого-то за дверью. На этом контрасте и держится тишина.

Объяснялки на два голоса. Ведущий объясняет, скептик перебивает вопросом, который зритель вот-вот задаст сам. Два голоса не дают десятиминутному ролику превратиться в лекцию.

Веб-романы и фанфики. Главы почти из одних диалогов оживают, когда каждого героя озвучили один раз и он звучит одинаково от первой главы до последней — как в аудиоспектакле.

Вопросы об озвучке видео нейросетью

Можно ли озвучить видео нейросетью бесплатно?

На бесплатном старте — нет. Новый аккаунт один раз получает 100 кредитов без карты, и они идут на картинки: героев и кадры истории. Разбор текста по ролям и перевод сценария кредитов не тратят, а сама озвучка — на платных тарифах. На Studio и Studio Max она безлимитна.

Сколько разных голосов может быть в одном видео?

Рассказчик и столько персонажей, сколько в тексте говорящих, — до 64 ролей в одном тексте. На практике слушатель уверенно различает три–шесть голосов, поэтому второстепенных героев часто лучше отдать рассказчику.

Можно ли озвучить видео своим голосом?

Да, записью. Начитайте текст сами и загрузите WAV, MP3, M4A или AAC до 50 МБ. Редактор обработает её как любую озвучку: расшифрует, соберёт под неё сцены и сделает по ней субтитры.

Можно ли замедлить или ускорить голос?

Да. В настройках голоса темп меняется от половинного до двойного, а между фразами добавляются паузы. Но манеру речи задаёт сам голос, а не ползунок: для спокойной роли лучше сразу выбрать спокойный голос, чем замедлять взволнованный.

Что делать, если нейросеть неправильно прочитала одну фразу?

Щёлкните этот фрагмент на готовой дорожке и перегенерируйте только его, тем же голосом или другим. Каждый фрагмент можно переделать до пяти раз в течение 90 дней после записи, остальная озвучка не меняется. Если не подошла вся роль, щёлкните персонажа и перезапишите всё, что он говорит.

Можно ли озвучить видео на русском?

Да. Голоса размечены языками, и фильтр «Язык» оставляет те, что говорят по-русски. Если сценарий написан на другом языке, сначала переведите его во вкладке «Перевод»: 27 языков, до трёх за раз, сам перевод кредитов не тратит.

Будут ли к озвучке субтитры?

Их делает редактор из самой записи: она расшифровывается пословно, и титры идут вслед за голосом, в любом из 31 стиля. Раз субтитры сняты с аудио, они совпадают с тем, что звучит, — и для переведённой дорожки, и для вашей собственной записи.

Что ещё посмотреть

Вставьте сцену с диалогом и раздайте роли

Начните с истории и её героев: первые 100 кредитов бесплатно, карта не нужна. Голоса подключаются на платном тарифе, когда картинка готова.

Работает в браузере, ничего устанавливать не нужно.