Озвучивает текст живым голосом с эмоциями, шёпотом, смехом и звуками по тегам в тексте. Цена - 0,012 ₽ за 1 символ.
ElevenLabs Eleven v4 — модель озвучки текста, которую ElevenLabs выпустила в сентябре 2026 года. Читает русский и ещё 35 языков из списка, а теги в квадратных скобках меняют подачу и добавляют в речь звуки окружения, например хлопок двери.
По словам ElevenLabs, четвёртая версия сначала разбирает смысл всей реплики и только потом решает, как её произнести, а цепочки тегов выполняет точнее, чем v3. Мы дали ей три задачи: служебный текст с числами, сцену со звуками и русскую речь вперемешку с английскими словами.
Этот же текст мы озвучили в Eleven v3 и Eleven v4 Turbo, голос везде Sarah: имя есть во всех трёх формах. Остальные настройки по умолчанию, в поле Язык стоит русский.
Напоминаем: вы записаны к стоматологу на 14 ноября, в 9:15, кабинет № 212. Приём стоит 2 450 ₽, договор подпишем на месте. Возьмите паспорт и полис ОМС. Опаздываете? Позвоните, и мы перенесём визит. Звонят вам обычно с номера, который заканчивается на 0347.
голос Sarah, язык «Русский», 257 символов
Запись на 25 секунд пришла через 14. Распознавание речи нашло в ней каждое слово, и сумму модель назвала полностью, с «рублями». Одно отличие от v3 всё же есть. Хвост телефона v4 произнесла по цифре, «ноль три четыре семь», а v3 разбила его на пары. Для номеров это удобнее: слушатель запишет цифры под диктовку. Ударения в «договор» (0:12) и «звонят» (0:20) распознавание не проверяет, их надо послушать.
Кроме эмоций, подсказка формы предлагает теги звуков окружения, а манеру можно описать в скобках своими словами по-английски. Мы собрали короткую сцену: дождь, хлопок двери, вибрация телефона и фраза «сказала нервно, почти плача».
[light rain] [whispers] Ты слышишь? Кто-то поднимается по лестнице. [door slams] [gasps] Это он. [said nervously, almost crying] Я же просила не приходить сегодня… [phone buzzing] [sighs] И телефон, как назло, звонит.
ElevenLabs Eleven v4 · Eleven v4, голос Sarah · 12 ₽ за 1000 символов
ElevenLabs Eleven v4 Turbo · Eleven v4 Turbo, голос Sarah · 7 ₽ за 1000 символов
Сработало не всё. Шума дождя по замеру громкости нет ни в одной версии: в паузах между фразами почти тишина. Зато перед «И телефон, как назло…» почти секунду держится ровный звук одной громкости, у обеих моделей на одном и том же месте (0:07). Похоже, это и есть вибрация телефона, но на что он похож, стоит послушать. Хлопнула ли дверь перед «Это он», тоже лучше решить на слух (0:03). Слова обе версии произнесли одинаково, теги вслух не прозвучали, длина записей отличается на две десятых секунды. Turbo вернула файл через 9 секунд, v4 через 16. Если звук окружения важен для ролика, надёжнее добавить его отдельной дорожкой из Sound Effect V2.
Рабочие сообщения часто наполовину английские. Мы озвучили такой текст дважды, с языком Русский и с Определить автоматически, который форма советует для смешанного текста.
Созвон в Zoom в четверг, дедлайн по проекту — Friday, end of day. Макеты лежат в Figma, а отчёт я скинула в Google Drive. Feedback жду до обеда.
ElevenLabs Eleven v4 · язык «Русский» · 12 ₽ за 1000 символов
ElevenLabs Eleven v4 · язык «Определить автоматически» · 12 ₽ за 1000 символов
Английские слова распознавание разобрало в обеих записях, вплоть до «end of day». Разницу дало первое слово: с русским языком распознавание услышало «Созвон», с автоопределением «Зазвон». Проба одна, но по ней мы оставляем Русский, если русского в тексте больше, а автоопределение пробуйте для текста, где языки идут поровну.
В поле Текст помещается до 5000 символов вместе с тегами. Язык выберите из 36 в списке, от русского и казахского до японского, или оставьте автоопределение. Голос подберите по образцу: кнопки Женские и Мужские оставляют в списке только нужные. Сумму за символы видно на кнопке Отправить. Текст длиннее предела разбейте по абзацам и отправьте частями.
Готовая запись появится под формой в плеере. Её можно скачать в MP3, а кнопка Изменить вернёт текст и настройки в форму. Повторить запускает то же самое ещё раз и даёт другой дубль. Записи лежат в разделе Мои результаты 7 дней, нужные сохраните в библиотеку.
Для первых проб хватает трёх полей: Текст, Язык и Голос. По умолчанию стоит Sarah. Голосов 22. Это не те 64, что в v3: часть имён совпадает, но Alicia и многих других здесь нет, а Rachel, наоборот, есть только в v4. Переключатель Дополнительно открывает четыре поля.
Подсказка у поля Текст делит теги на группы, и формула удобна такая: эмоция в начале фразы, звук голоса там, где он должен прозвучать, звук окружения перед событием.
[эмоция] Фраза. [звук голоса] Следующая фраза. [звук окружения] Фраза после события.
[curious] Слушай, а кто оставил торт на балконе? [chuckles] Признавайтесь. [applause] Ну конечно, это был именинник!
[excited], [sad], [sarcastic], [whispers], [shouts].[laughs], [sighs], [gasps], [clears throat], [pause].[door slams], [applause], [light rain]. В нашей сцене дождь не прозвучал.[slowly and solemnly], [strong French accent]./təˈmɑːtoʊ/. На русских словах мы этот приём не проверяли.Теги пишут по-английски даже в русском тексте и оплачивают как обычные символы.
Цена считается за каждый символ текста вместе с пробелами и тегами, без подписки:
| Что озвучиваем | Цена |
|---|---|
| Голосовое сообщение или реплика, 300 символов | 3,60 ₽ |
| Закадровый текст для ролика на 2–3 минуты, 2000 символов | 24 ₽ |
| Предел одного запуска, 5000 символов | 60 ₽ |
Язык, голос и настройки из блока Дополнительно цену не меняют.
У v4 и Turbo одинаковые поля, голоса и теги. Разница в назначении: по словам ElevenLabs, v4 сделана для дикторского чтения, аудиокниг и ролей, а Turbo для голосовых ассистентов, где важен быстрый ответ. На сайте вы ждёте готовый файл, поэтому разница во времени у нас вышла в несколько секунд, а слова в записях совпали. У v3 голосов больше, зато нет выбора языка и звуков окружения. Подробнее линейка разобрана в обзоре нейросетей ElevenLabs, а с озвучками других разработчиков её сравнивает раздел «Озвучка текста».
| Нейросеть | Цена | Голоса и язык | Когда брать |
|---|---|---|---|
| ElevenLabs Eleven v4 | 12 ₽ за 1000 символов | 22 голоса, язык из списка | дикторский текст, сцены и роли, для них её и делали |
| ElevenLabs Eleven v4 Turbo | 7 ₽ за 1000 символов | 22 голоса, язык из списка | те же поля и теги, модель сделана для быстрого ответа |
| ElevenLabs Eleven v3 | 30 ₽ за 1000 символов | 64 голоса, без выбора языка | нужен голос, которого нет в v4 |
| xAI TTS v1 | 3 ₽ за 1000 символов | 28 голосов, язык из списка | теги смеха и шёпота, текст до 15 000 символов |
Описание обновлено 1 октября 2026 г.