oLoveTools
Текст в речь

Превратите любой текст в озвученный MP3 с субтитрами

Превращает сценарий в озвученный MP3 нейросетевыми голосами и выдаёт субтитры, совпадающие с точностью до миллисекунды.

Более 300 нейросетевых голосов в 140 регионахMP3 и WAV с ровно тем дублем, что вы слышалиSRT и VTT по таймингам самого движка

Сценарий уходит на наш собственный сервис синтеза, возвращается как MP3 с таймингом каждого слова и нигде не сохраняется. Скачивание возможно только через этот движок.

Голос
Скорость чтения1.00×
Высота голоса1.00×
Громкость100%
Сценарий0 слов · 0 символов
0

Enter начинает новый абзац, Shift+Enter оставляет перенос строки внутри него. У каждого абзаца может быть свой голос — так и озвучивают диалог.

Как это работает

1

Принесите сценарий

Наберите, вставьте или перетащите .txt, .md, .srt или .vtt. Каждый абзац становится редактируемым блоком. При загрузке ничего не синтезируется.

2

Выберите голос

Ищите среди более чем 300 нейросетевых голосов по языку, региону или полу и послушайте образец фразы, прежде чем доверить голосу весь сценарий.

3

Озвучьте

Каждый абзац синтезируется отдельно, а движок сообщает, где стоит каждое слово. Именно это питает волновую форму и субтитры.

4

Забирайте

MP3 и WAV с ровно тем звуком, который вы только что слышали, плюс субтитры SRT и VTT по тем же таймингам.

Голоса, звучащие по-человечески

Более 300 нейросетевых голосов в 140 регионах, включая многоязычные: они сохраняют тембр, когда сценарий переходит на другой язык.

Субтитры, которые правда совпадают

Файлы SRT и VTT строятся по таймингам слов и предложений, которые движок возвращает именно для этой озвучки, а не по прикидке скорости чтения.

Свой голос на каждый абзац

Дайте каждому блоку собственный голос и озвучьте диалог, интервью или аудиокнигу с несколькими персонажами за один проход.

Просодия под вашим контролем

Скорость, высота и громкость как общие настройки сценария — и переопределяемые по блокам, когда отдельная реплика требует другой подачи.

Правки без начала с нуля

Вы исправляете опечатку в седьмом абзаце — заново озвучивается только седьмой абзац. Всё, что уже готово, остаётся нетронутым.

Движок без сети

Движок устройства читает сценарий голосами, которые уже есть в вашей системе, вообще без запросов. Только для прослушивания: браузер не даёт это записать.

текст в речь

Озвучка и субтитры за один проход

Напишите или вставьте сценарий, выберите из более чем 300 нейросетевых голосов и заберите готовое аудио вместе с субтитрами SRT и VTT, построенными по этой же озвучке. У каждого абзаца может быть свой голос, своя скорость и своя высота, а правка одной фразы пересоздаёт только эту фразу.

Более 300 нейросетевых голосов в 140 регионах
MP3 и WAV с ровно тем дублем, что вы слышали
SRT и VTT по таймингам самого движка
Отдельный голос для каждого абзаца
Офлайн-голоса устройства для мгновенного прослушивания
Без регистрации, без водяных знаков и без дневных лимитов

Где рождается звук, без уловок

С движком устройства всё происходит прямо в этой вкладке, голосами, которые уже есть в системе. С нейросетевым движком сценарий уходит на наш собственный сервис, там синтезируется и сразу возвращается: без сторонних посредников, без записи в какую-либо базу данных и без сохранения копии после отправки ответа. Это единственная часть, которая работает не локально, — и именно она делает возможными скачивание и субтитры.

Для озвучки, учёбы и публикаций

Наложите закадровый голос на видео и перетащите соответствующие субтитры на монтажную линейку. Превратите длинную статью в аудио для дороги на работу. Озвучьте курс: один голос для урока, другой для примеров. Проверьте собственные тексты на слух — так вылезают корявые фразы, которых не видит ни одна проверка орфографии. А когда звук готов, отправьте субтитры в инструмент субтитров, ничего не скачивая.

Что мы храним, а что нет

Ваши сценарии, история и настройки живут в этом браузере и больше нигде. Нейросетевой движок получает только тот абзац, который должен произнести, и после ответа не оставляет ничего. Нет учётной записи, нет аналитики по вашему тексту и нет журнала того, что вы давали читать.

Частые вопросы

QМожно ли скачать аудио и совпадает ли оно с тем, что я слышал?+

Да. MP3 — это нетронутый поток от движка, склеенный по абзацам без перекодирования, поэтому он идентичен тому, что только что играл плеер. WAV — то же самое аудио без сжатия, для редакторов, которым так удобнее.

QСубтитры действительно совпадают со звуком?+

Да, потому что они не угаданы. Во время синтеза движок сообщает точный момент начала каждого слова и каждого предложения и их длительность. SRT и VTT строятся по этим числам, поэтому остаются на месте, даже если поменять скорость чтения.

QПокидает ли мой текст браузер?+

С голосами устройства — никогда. С нейросетевыми озвучиваемый абзац уходит на наш собственный сервис, который возвращает звук и ничего не хранит. Это честный ответ: нейросетевые голоса не помещаются во вкладку без загрузки модели в несколько сотен мегабайт.

QЕсть ли ограничение по длине?+

Каждый абзац ограничен 3000 символами — это примерно страница текста; более длинный импорт автоматически режется по границам предложений. У сценария целиком потолка нет, но очень длинный означает много запросов и пропорционально больше времени.

QМожно ли использовать несколько голосов в одном сценарии?+

Да, ради этого он и разбит на абзацы. Откройте любой блок и задайте ему собственный голос, скорость, высоту или громкость. Всё, что вы не переопределили, продолжает следовать общей настройке сценария.

QЕсли я исправлю опечатку, всё озвучится заново?+

Нет. Каждый абзац помнит текст и настройки, с которыми он был озвучен, поэтому после правки повторно уходят только реально изменившиеся. На длинной озвучке это разница между несколькими секундами и несколькими минутами.

QПочему голоса устройства звучат по-разному на каждом компьютере?+

Потому что они принадлежат операционной системе, а не нам: Windows, macOS, Android, iOS и ChromeOS поставляются каждый со своим набором. Установка языковых пакетов добавляет голоса в этот список. Нейросетевые же звучат одинаково везде.

Похожие запросы

текст в речьбесплатный синтез речитекст в MP3нейросетевые голосаозвучка нейросетьюсоздать субтитрытекст в SRTозвучить статьюголос для аудиокнигисинтез речи
Часть набора oLoveTools
oLoveTools

Бесплатный, приватный и точный синтез речи — с субтитрами в комплекте.

Где рождается звук, без уловок

С движком устройства всё происходит прямо в этой вкладке, голосами, которые уже есть в системе. С нейросетевым движком сценарий уходит на наш собственный сервис, там синтезируется и сразу возвращается: без сторонних посредников, без записи в какую-либо базу данных и без сохранения копии после отправки ответа. Это единственная часть, которая работает не локально, — и именно она делает возможными скачивание и субтитры.

Для озвучки, учёбы и публикаций

Наложите закадровый голос на видео и перетащите соответствующие субтитры на монтажную линейку. Превратите длинную статью в аудио для дороги на работу. Озвучьте курс: один голос для урока, другой для примеров. Проверьте собственные тексты на слух — так вылезают корявые фразы, которых не видит ни одна проверка орфографии. А когда звук готов, отправьте субтитры в инструмент субтитров, ничего не скачивая.

Озвучка и субтитры за один проход

Ваши сценарии, история и настройки живут в этом браузере и больше нигде. Нейросетевой движок получает только тот абзац, который должен произнести, и после ответа не оставляет ничего. Нет учётной записи, нет аналитики по вашему тексту и нет журнала того, что вы давали читать.

текст в речьбесплатный синтез речитекст в MP3нейросетевые голосаозвучка нейросетьюсоздать субтитрытекст в SRTозвучить статьюголос для аудиокнигисинтез речи

Частые вопросы

Можно ли скачать аудио и совпадает ли оно с тем, что я слышал?

Да. MP3 — это нетронутый поток от движка, склеенный по абзацам без перекодирования, поэтому он идентичен тому, что только что играл плеер. WAV — то же самое аудио без сжатия, для редакторов, которым так удобнее.

Субтитры действительно совпадают со звуком?

Да, потому что они не угаданы. Во время синтеза движок сообщает точный момент начала каждого слова и каждого предложения и их длительность. SRT и VTT строятся по этим числам, поэтому остаются на месте, даже если поменять скорость чтения.

Покидает ли мой текст браузер?

С голосами устройства — никогда. С нейросетевыми озвучиваемый абзац уходит на наш собственный сервис, который возвращает звук и ничего не хранит. Это честный ответ: нейросетевые голоса не помещаются во вкладку без загрузки модели в несколько сотен мегабайт.

Есть ли ограничение по длине?

Каждый абзац ограничен 3000 символами — это примерно страница текста; более длинный импорт автоматически режется по границам предложений. У сценария целиком потолка нет, но очень длинный означает много запросов и пропорционально больше времени.

Можно ли использовать несколько голосов в одном сценарии?

Да, ради этого он и разбит на абзацы. Откройте любой блок и задайте ему собственный голос, скорость, высоту или громкость. Всё, что вы не переопределили, продолжает следовать общей настройке сценария.

Если я исправлю опечатку, всё озвучится заново?

Нет. Каждый абзац помнит текст и настройки, с которыми он был озвучен, поэтому после правки повторно уходят только реально изменившиеся. На длинной озвучке это разница между несколькими секундами и несколькими минутами.

Почему голоса устройства звучат по-разному на каждом компьютере?

Потому что они принадлежат операционной системе, а не нам: Windows, macOS, Android, iOS и ChromeOS поставляются каждый со своим набором. Установка языковых пакетов добавляет голоса в этот список. Нейросетевые же звучат одинаково везде.

© 2026 oLoveToolsО нас

Следующий шаг

Конвертируйте аудио AudioSnap

TTSBolt | Бесплатный синтез речи с экспортом в MP3, WAV и субтитры

Озвучьте любой текст более чем 300 нейросетевыми голосами, скачайте MP3 или WAV и выгрузите субтитры SRT и VTT, построенные по самой озвучке. Отдельный голос для каждого абзаца, бесплатно и без регистрации.

Частые вопросы

Можно ли скачать аудио и совпадает ли оно с тем, что я слышал?

Да. MP3 — это нетронутый поток от движка, склеенный по абзацам без перекодирования, поэтому он идентичен тому, что только что играл плеер. WAV — то же самое аудио без сжатия, для редакторов, которым так удобнее.

Субтитры действительно совпадают со звуком?

Да, потому что они не угаданы. Во время синтеза движок сообщает точный момент начала каждого слова и каждого предложения и их длительность. SRT и VTT строятся по этим числам, поэтому остаются на месте, даже если поменять скорость чтения.

Покидает ли мой текст браузер?

С голосами устройства — никогда. С нейросетевыми озвучиваемый абзац уходит на наш собственный сервис, который возвращает звук и ничего не хранит. Это честный ответ: нейросетевые голоса не помещаются во вкладку без загрузки модели в несколько сотен мегабайт.

Есть ли ограничение по длине?

Каждый абзац ограничен 3000 символами — это примерно страница текста; более длинный импорт автоматически режется по границам предложений. У сценария целиком потолка нет, но очень длинный означает много запросов и пропорционально больше времени.

Можно ли использовать несколько голосов в одном сценарии?

Да, ради этого он и разбит на абзацы. Откройте любой блок и задайте ему собственный голос, скорость, высоту или громкость. Всё, что вы не переопределили, продолжает следовать общей настройке сценария.

Если я исправлю опечатку, всё озвучится заново?

Нет. Каждый абзац помнит текст и настройки, с которыми он был озвучен, поэтому после правки повторно уходят только реально изменившиеся. На длинной озвучке это разница между несколькими секундами и несколькими минутами.

Почему голоса устройства звучат по-разному на каждом компьютере?

Потому что они принадлежат операционной системе, а не нам: Windows, macOS, Android, iOS и ChromeOS поставляются каждый со своим набором. Установка языковых пакетов добавляет голоса в этот список. Нейросетевые же звучат одинаково везде.

Похожие запросы

текст в речь, бесплатный синтез речи, текст в MP3, нейросетевые голоса, озвучка нейросетью, создать субтитры, текст в SRT, озвучить статью, голос для аудиокниги, синтез речи