AiSearchAiSearch

Озвучка текста голосом

Вставьте текст, выберите голос — получите готовую запись реалистичным голосом. ИИ озвучка подберёт интонацию под смысл, а не прочитает по слогам.

До 100 знаков. Длиннее — разделите на части.

Голос

Как это работает

Текст читает синтезатор речи, обученный на живых голосах. Он расставляет ударения, паузы на знаках препинания и меняет интонацию в вопросах — поэтому запись звучит как чтение, а не как перечисление слов. Готовый файл появляется сразу под формой: его можно послушать и скачать, ничего дополнительно устанавливать не нужно.

Какой голос можно выбрать

Голос собирается из признаков, а не выбирается из короткого списка. Пол: мужской или женский. Возраст: детский, молодой или пожилой. Тон: низкий или высокий. Подача: обычная или шёпот. Выговор: британский или американский. Любой признак можно оставить на «любой» — тогда его выберет сама модель. Сочетания дают сильно разное звучание: низкий мужской пожилой читается как диктор документального фильма, высокий женский молодой — как реклама.

Озвучка детским голосом

Детский голос — отдельный признак возраста, и звучит он именно по-детски, а не как ускоренная запись взрослого. Его берут для сказок, поздравлений от имени ребёнка, озвучки мультфильмов и учебных роликов. Совет по опыту: детскому голосу идут короткие предложения. Длинная фраза со сложным придаточным звучит неестественно — ребёнок так не говорит, и ухо это замечает раньше, чем успевает понять причину.

Насколько голоса реалистичные

Голоса реалистичные настолько, что на коротких фразах отличить от живого человека трудно. Машину выдаёт другое: ровный ритм на длинном тексте, отсутствие оговорок и одинаковая громкость от начала до конца. Живой диктор невольно выделяет важное и сбивается с темпа, синтез — нет. Есть и предсказуемые слабые места: редкие имена, аббревиатуры и числа читаются буквально. «ГОСТ 7.0.100-2018» превратится в перечисление цифр, а «Иакинф» получит ударение наугад.

Как поправить произношение

Самый надёжный приём — написать слово так, как оно звучит. Сложное имя передайте по слогам через дефис, аббревиатуру раскройте словами, число запишите прописью: не «в 1812 г.», а «в тысяча восемьсот двенадцатом году». Ударение задаётся заглавной буквой в спорном слоге: «зАмок» и «замОк» иначе читаются одинаково. Паузу добавляет точка или многоточие, а не пробелы — пробелы синтез не слышит вовсе.

Для видео, подкастов и рекламы

Чаще всего озвучку берут туда, где свой голос записывать негде или некогда: закадровый текст к ролику, рекламное объявление, аудиоверсия статьи, реплики для обучающего курса. Для видео удобно озвучивать репликами, а не целиком: так проще подогнать длину под картинку и переделать одну фразу, не трогая остальные. Для подкаста синтез годится на вставки и объявления, а разговорную часть лучше оставить живым голосам — слушатель приходит за человеком.

Языки и выговор

Доступно 69 языков, и по умолчанию язык определяется по самому тексту. Вмешаться стоит в одном случае: если текст записан латиницей, но по-русски. «Privet, kak dela» по буквам неотличимо от английского, и прочитано будет с английским выговором. Тогда язык выбирается вручную. Смешанный текст читается целиком на одном языке: английская цитата внутри русского абзаца прозвучит с русским акцентом, и это ожидаемо, а не сбой.

Сколько текста помещается

Без входа озвучивается до 100 знаков за раз — примерно одно длинное предложение. После входа предел вдвое больше. Длинный текст всё равно разумно делить на части: так проще переозвучить неудачный кусок и не ждать обработки целой главы ради одной поправки. Части потом соединяются в любом видеоредакторе, а паузы между ними ставятся там же.

Формат и права на запись

Запись отдаётся в WAV — несжатый формат без потерь, который принимают все видеоредакторы и программы монтажа звука. Для публикации в сети его обычно пережимают в MP3, и это делает сам редактор. Готовую запись можно использовать как угодно, включая коммерческое: в ролике, рекламе, курсе или подкасте. Отдельно разрешение не требуется, и отчислений за использование нет.

Чего озвучка не делает

Она не копирует голос конкретного человека: ни знакомого, ни известного. Для этого нужно согласие владельца голоса и другая технология, а подделка чужого голоса — это, в зависимости от применения, от нарушения прав до состава преступления. Не умеет она и петь: мелодия и ритм песни синтезу речи не подчиняются. И не заменяет диктора там, где нужен характер — в аудиокниге на десять часов ровный машинный голос утомляет уже на второй.

Частые вопросы

Нужна ли регистрация

Нет, первые записи делаются без входа и без карты. Гостю доступно до 100 знаков за раз, после входа — вдвое больше.

В каком формате скачивается запись

В WAV: несжатый звук без потерь, его принимают все видеоредакторы. Для публикации в сети его обычно пережимают в MP3 прямо в редакторе.

Можно ли использовать запись в коммерческих целях

Да, в рекламе, роликах, курсах и подкастах. Отдельного разрешения не нужно, отчислений за использование нет.

Есть ли детский голос

Да, это отдельный признак возраста, и звучит он по-детски, а не как ускоренный взрослый. Лучше всего получается на коротких предложениях.

Можно ли озвучить голосом известного человека

Нет. Для копирования конкретного голоса нужно согласие его владельца, а подделка чужого голоса влечёт ответственность вплоть до уголовной. Мы собираем голос из признаков: пол, возраст, тон, подача, выговор.

Почему слово прочитано с неверным ударением

Синтез ставит ударение по правилам языка и ошибается на редких словах и именах. Поправить просто: напишите спорный слог заглавными буквами — «зАмок» и «замОк» читаются по-разному.

На каких языках говорит

На 69 языках, язык определяется по тексту сам. Выбрать вручную стоит для текста, записанного латиницей по-русски: иначе он будет прочитан как английский.

Сколько занимает озвучка

Несколько секунд на короткий текст. Запись появляется под формой сразу и проигрывается прямо на странице, скачивать для проверки не нужно.

Чем отличается от расшифровки аудио

Это обратная работа: здесь текст становится записью, там запись становится текстом. Для второго у нас отдельная страница — «Аудио в текст».

Что ещё пригодится