Превратите любой текст в озвученный MP3 с субтитрами
Превращает сценарий в озвученный MP3 нейросетевыми голосами и выдаёт субтитры, совпадающие с точностью до миллисекунды.
Сценарий уходит на наш собственный сервис синтеза, возвращается как MP3 с таймингом каждого слова и нигде не сохраняется. Скачивание возможно только через этот движок.
Enter начинает новый абзац, Shift+Enter оставляет перенос строки внутри него. У каждого абзаца может быть свой голос — так и озвучивают диалог.
Как это работает
Принесите сценарий
Наберите, вставьте или перетащите .txt, .md, .srt или .vtt. Каждый абзац становится редактируемым блоком. При загрузке ничего не синтезируется.
Выберите голос
Ищите среди более чем 300 нейросетевых голосов по языку, региону или полу и послушайте образец фразы, прежде чем доверить голосу весь сценарий.
Озвучьте
Каждый абзац синтезируется отдельно, а движок сообщает, где стоит каждое слово. Именно это питает волновую форму и субтитры.
Забирайте
MP3 и WAV с ровно тем звуком, который вы только что слышали, плюс субтитры SRT и VTT по тем же таймингам.
Голоса, звучащие по-человечески
Более 300 нейросетевых голосов в 140 регионах, включая многоязычные: они сохраняют тембр, когда сценарий переходит на другой язык.
Субтитры, которые правда совпадают
Файлы SRT и VTT строятся по таймингам слов и предложений, которые движок возвращает именно для этой озвучки, а не по прикидке скорости чтения.
Свой голос на каждый абзац
Дайте каждому блоку собственный голос и озвучьте диалог, интервью или аудиокнигу с несколькими персонажами за один проход.
Просодия под вашим контролем
Скорость, высота и громкость как общие настройки сценария — и переопределяемые по блокам, когда отдельная реплика требует другой подачи.
Правки без начала с нуля
Вы исправляете опечатку в седьмом абзаце — заново озвучивается только седьмой абзац. Всё, что уже готово, остаётся нетронутым.
Движок без сети
Движок устройства читает сценарий голосами, которые уже есть в вашей системе, вообще без запросов. Только для прослушивания: браузер не даёт это записать.
Озвучка и субтитры за один проход
Напишите или вставьте сценарий, выберите из более чем 300 нейросетевых голосов и заберите готовое аудио вместе с субтитрами SRT и VTT, построенными по этой же озвучке. У каждого абзаца может быть свой голос, своя скорость и своя высота, а правка одной фразы пересоздаёт только эту фразу.
Где рождается звук, без уловок
С движком устройства всё происходит прямо в этой вкладке, голосами, которые уже есть в системе. С нейросетевым движком сценарий уходит на наш собственный сервис, там синтезируется и сразу возвращается: без сторонних посредников, без записи в какую-либо базу данных и без сохранения копии после отправки ответа. Это единственная часть, которая работает не локально, — и именно она делает возможными скачивание и субтитры.
Для озвучки, учёбы и публикаций
Наложите закадровый голос на видео и перетащите соответствующие субтитры на монтажную линейку. Превратите длинную статью в аудио для дороги на работу. Озвучьте курс: один голос для урока, другой для примеров. Проверьте собственные тексты на слух — так вылезают корявые фразы, которых не видит ни одна проверка орфографии. А когда звук готов, отправьте субтитры в инструмент субтитров, ничего не скачивая.
Ваши сценарии, история и настройки живут в этом браузере и больше нигде. Нейросетевой движок получает только тот абзац, который должен произнести, и после ответа не оставляет ничего. Нет учётной записи, нет аналитики по вашему тексту и нет журнала того, что вы давали читать.
Частые вопросы
QМожно ли скачать аудио и совпадает ли оно с тем, что я слышал?+
Да. MP3 — это нетронутый поток от движка, склеенный по абзацам без перекодирования, поэтому он идентичен тому, что только что играл плеер. WAV — то же самое аудио без сжатия, для редакторов, которым так удобнее.
QСубтитры действительно совпадают со звуком?+
Да, потому что они не угаданы. Во время синтеза движок сообщает точный момент начала каждого слова и каждого предложения и их длительность. SRT и VTT строятся по этим числам, поэтому остаются на месте, даже если поменять скорость чтения.
QПокидает ли мой текст браузер?+
С голосами устройства — никогда. С нейросетевыми озвучиваемый абзац уходит на наш собственный сервис, который возвращает звук и ничего не хранит. Это честный ответ: нейросетевые голоса не помещаются во вкладку без загрузки модели в несколько сотен мегабайт.
QЕсть ли ограничение по длине?+
Каждый абзац ограничен 3000 символами — это примерно страница текста; более длинный импорт автоматически режется по границам предложений. У сценария целиком потолка нет, но очень длинный означает много запросов и пропорционально больше времени.
QМожно ли использовать несколько голосов в одном сценарии?+
Да, ради этого он и разбит на абзацы. Откройте любой блок и задайте ему собственный голос, скорость, высоту или громкость. Всё, что вы не переопределили, продолжает следовать общей настройке сценария.
QЕсли я исправлю опечатку, всё озвучится заново?+
Нет. Каждый абзац помнит текст и настройки, с которыми он был озвучен, поэтому после правки повторно уходят только реально изменившиеся. На длинной озвучке это разница между несколькими секундами и несколькими минутами.
QПочему голоса устройства звучат по-разному на каждом компьютере?+
Потому что они принадлежат операционной системе, а не нам: Windows, macOS, Android, iOS и ChromeOS поставляются каждый со своим набором. Установка языковых пакетов добавляет голоса в этот список. Нейросетевые же звучат одинаково везде.