ББратуха
НейросетиСценарииГалереяПомощь
Войти
НейросетиСценарииГалереяПомощь
Братуха

Все нейросети в одном месте и по самым низким ценам.

Разделы

  • Нейросети
  • Чат с нейросетями
  • Сценарии
  • Галерея
  • Промпты

Популярное

  • GPT Image 2
  • Nano Banana Pro
  • Seedream 5.0 Pro
  • Nano Banana 2 Lite
  • Grok Video
  • Nano Banana 2

Помощь

  • Контакты
  • Как пользоваться
  • Инструкции
  • Новости
  • API
  • Для ИИ-агентов
  • Для бизнеса

Компания

  • О нас
  • Мы помогаем
  • Блог
  • Реферальная программа
  • Пользовательское соглашение
  • Политика конфиденциальности
  • Политика обработки в отношении файлов cookie
  • Согласие на обработку персональных данных
  • Согласие на отправку уведомлений рекламно-информационного характера

© 2026 Братуха.ру

257 нейросетей

ElevenLabs Eleven v4

Озвучивает текст живым голосом с эмоциями, шёпотом, смехом и звуками по тегам в тексте. Цена - 0,012 ₽ за 1 символ.

API

0 / 5000

Описание

ElevenLabs Eleven v4 — модель озвучки текста, которую ElevenLabs выпустила в сентябре 2026 года. Читает русский и ещё 35 языков из списка, а теги в квадратных скобках меняют подачу и добавляют в речь звуки окружения, например хлопок двери.

Содержание

  1. Коротко
  2. Что умеет ElevenLabs v4
  3. Как это работает
  4. Настройки
  5. Как писать текст с тегами
  6. Сколько стоит
  7. Для чего подойдёт
  8. Ограничения
  9. Чем v4 отличается от v3 и Turbo
  10. Вопросы про Eleven v4

Коротко

Разработчик
ElevenLabs, модель вышла 28 сентября 2026 года
На входе
текст до 5000 символов, язык текста из списка или автоопределение
Голоса
22 готовых голоса с образцами, клона нет
На выходе
речь в MP3, моно, 44,1 кГц
Русский язык
русский стоит в поле «Язык» по умолчанию
Теги
эмоции, смех и вздохи, звуки окружения, произношение по МФА
Цена
12 ₽ за 1000 символов
Обычно готово
≈ 10 с после отправки
API
есть, документация

Что умеет ElevenLabs v4

По словам ElevenLabs, четвёртая версия сначала разбирает смысл всей реплики и только потом решает, как её произнести, а цепочки тегов выполняет точнее, чем v3. Мы дали ей три задачи: служебный текст с числами, сцену со звуками и русскую речь вперемешку с английскими словами.

Напоминание с датой, суммой и телефоном

Этот же текст мы озвучили в Eleven v3 и Eleven v4 Turbo, голос везде Sarah: имя есть во всех трёх формах. Остальные настройки по умолчанию, в поле Язык стоит русский.

Напоминаем: вы записаны к стоматологу на 14 ноября, в 9:15, кабинет № 212. Приём стоит 2 450 ₽, договор подпишем на месте. Возьмите паспорт и полис ОМС. Опаздываете? Позвоните, и мы перенесём визит. Звонят вам обычно с номера, который заканчивается на 0347.

голос Sarah, язык «Русский», 257 символов

Запись на 25 секунд пришла через 14. Распознавание речи нашло в ней каждое слово, и сумму модель назвала полностью, с «рублями». Одно отличие от v3 всё же есть. Хвост телефона v4 произнесла по цифре, «ноль три четыре семь», а v3 разбила его на пары. Для номеров это удобнее: слушатель запишет цифры под диктовку. Ударения в «договор» (0:12) и «звонят» (0:20) распознавание не проверяет, их надо послушать.

Звуки внутри реплики

Кроме эмоций, подсказка формы предлагает теги звуков окружения, а манеру можно описать в скобках своими словами по-английски. Мы собрали короткую сцену: дождь, хлопок двери, вибрация телефона и фраза «сказала нервно, почти плача».

[light rain] [whispers] Ты слышишь? Кто-то поднимается по лестнице. [door slams] [gasps] Это он. [said nervously, almost crying] Я же просила не приходить сегодня… [phone buzzing] [sighs] И телефон, как назло, звонит.

ElevenLabs Eleven v4 · Eleven v4, голос Sarah · 12 ₽ за 1000 символов

ElevenLabs Eleven v4 Turbo · Eleven v4 Turbo, голос Sarah · 7 ₽ за 1000 символов

Сработало не всё. Шума дождя по замеру громкости нет ни в одной версии: в паузах между фразами почти тишина. Зато перед «И телефон, как назло…» почти секунду держится ровный звук одной громкости, у обеих моделей на одном и том же месте (0:07). Похоже, это и есть вибрация телефона, но на что он похож, стоит послушать. Хлопнула ли дверь перед «Это он», тоже лучше решить на слух (0:03). Слова обе версии произнесли одинаково, теги вслух не прозвучали, длина записей отличается на две десятых секунды. Turbo вернула файл через 9 секунд, v4 через 16. Если звук окружения важен для ролика, надёжнее добавить его отдельной дорожкой из Sound Effect V2.

Русский текст с английскими словами

Рабочие сообщения часто наполовину английские. Мы озвучили такой текст дважды, с языком Русский и с Определить автоматически, который форма советует для смешанного текста.

Созвон в Zoom в четверг, дедлайн по проекту — Friday, end of day. Макеты лежат в Figma, а отчёт я скинула в Google Drive. Feedback жду до обеда.

ElevenLabs Eleven v4 · язык «Русский» · 12 ₽ за 1000 символов

ElevenLabs Eleven v4 · язык «Определить автоматически» · 12 ₽ за 1000 символов

Английские слова распознавание разобрало в обеих записях, вплоть до «end of day». Разницу дало первое слово: с русским языком распознавание услышало «Созвон», с автоопределением «Зазвон». Проба одна, но по ней мы оставляем Русский, если русского в тексте больше, а автоопределение пробуйте для текста, где языки идут поровну.

Как это работает

В поле Текст помещается до 5000 символов вместе с тегами. Язык выберите из 36 в списке, от русского и казахского до японского, или оставьте автоопределение. Голос подберите по образцу: кнопки Женские и Мужские оставляют в списке только нужные. Сумму за символы видно на кнопке Отправить. Текст длиннее предела разбейте по абзацам и отправьте частями.

Готовая запись появится под формой в плеере. Её можно скачать в MP3, а кнопка Изменить вернёт текст и настройки в форму. Повторить запускает то же самое ещё раз и даёт другой дубль. Записи лежат в разделе Мои результаты 7 дней, нужные сохраните в библиотеку.

Настройки

Для первых проб хватает трёх полей: Текст, Язык и Голос. По умолчанию стоит Sarah. Голосов 22. Это не те 64, что в v3: часть имён совпадает, но Alicia и многих других здесь нет, а Rachel, наоборот, есть только в v4. Переключатель Дополнительно открывает четыре поля.

  • Ползунок Стабильность подачи стоит на 0,5. Если сдвинуть ползунок влево, речь станет живее, но дубли будут сильнее отличаться друг от друга. Вправо — ровнее и одинаковее. Для сцены с эмоциями двигайте его влево, для инструкции вправо.
  • У ползунка Сходство с голосом по умолчанию 0,75. Подсказка формы предупреждает, что при высоком значении речь может звучать менее естественно.
  • В поле Чтение чисел и дат три кнопки, Авто, Вкл и Выкл. В нашей пробе «Авто» справилось само, а как ведёт себя «Вкл», мы проверили в v4 Turbo.
  • В Seed вписывают число от 0 до 4294967295. Одинаковый seed при тех же настройках даёт похожую озвучку, хотя полного совпадения модель не обещает. Пригодится, чтобы вернуться к удачному дублю после проб с другими настройками.

Как писать текст с тегами

Подсказка у поля Текст делит теги на группы, и формула удобна такая: эмоция в начале фразы, звук голоса там, где он должен прозвучать, звук окружения перед событием.

[эмоция] Фраза. [звук голоса] Следующая фраза. [звук окружения] Фраза после события.

[curious] Слушай, а кто оставил торт на балконе? [chuckles] Признавайтесь. [applause] Ну конечно, это был именинник!

  • Эмоции и манера: [excited], [sad], [sarcastic], [whispers], [shouts].
  • Звуки голоса: [laughs], [sighs], [gasps], [clears throat], [pause].
  • Окружение: [door slams], [applause], [light rain]. В нашей сцене дождь не прозвучал.
  • Своими словами по-английски: [slowly and solemnly], [strong French accent].
  • Произношение трудного слова пишут в косых чертах международной фонетической записью (МФА), например /təˈmɑːtoʊ/. На русских словах мы этот приём не проверяли.

Теги пишут по-английски даже в русском тексте и оплачивают как обычные символы.

Сколько стоит

Цена считается за каждый символ текста вместе с пробелами и тегами, без подписки:

Что озвучиваемЦена
Голосовое сообщение или реплика, 300 символов3,60 ₽
Закадровый текст для ролика на 2–3 минуты, 2000 символов24 ₽
Предел одного запуска, 5000 символов60 ₽

Язык, голос и настройки из блока Дополнительно цену не меняют.

Для чего подойдёт

  • Сцена для аудиосериала или подкаста, где реплика сама подсказывает звук: вибрация, аплодисменты.
  • Версии одного ролика на разных языках из списка формы.
  • Рабочие объявления и голосовые сообщения с английскими терминами (см. пример выше).
  • Реклама с сарказмом, смешком или шёпотом в нужном месте.
  • Телефонные меню и напоминания, где номер должен прозвучать по цифре.

Ограничения

  • Голосов 22, своего голоса нет. Клон делают в Ультре или Меге.
  • Звуки окружения срабатывают не всегда. Нужен точный звук — сделайте его отдельно и сведите в аудиоредакторе.
  • Больше 5000 символов за раз не отправить, длинный текст делите по смыслу, например по абзацам.

Чем v4 отличается от v3 и Turbo

У v4 и Turbo одинаковые поля, голоса и теги. Разница в назначении: по словам ElevenLabs, v4 сделана для дикторского чтения, аудиокниг и ролей, а Turbo для голосовых ассистентов, где важен быстрый ответ. На сайте вы ждёте готовый файл, поэтому разница во времени у нас вышла в несколько секунд, а слова в записях совпали. У v3 голосов больше, зато нет выбора языка и звуков окружения. Подробнее линейка разобрана в обзоре нейросетей ElevenLabs, а с озвучками других разработчиков её сравнивает раздел «Озвучка текста».

НейросетьЦенаГолоса и языкКогда брать
ElevenLabs Eleven v412 ₽ за 1000 символов22 голоса, язык из спискадикторский текст, сцены и роли, для них её и делали
ElevenLabs Eleven v4 Turbo7 ₽ за 1000 символов22 голоса, язык из спискате же поля и теги, модель сделана для быстрого ответа
ElevenLabs Eleven v330 ₽ за 1000 символов64 голоса, без выбора языканужен голос, которого нет в v4
xAI TTS v13 ₽ за 1000 символов28 голосов, язык из спискатеги смеха и шёпота, текст до 15 000 символов

Вопросы про Eleven v4

Описание обновлено 1 октября 2026 г.

Похожие нейросети

Мега

Озвучивает текст реалистичными голосами и умеет клонировать голос по примеру аудио.

Gemini 3.1 Flash TTS

Озвучивает текст естественной речью одним голосом или как диалог двух собеседников с разными голосами.

Премиум

Озвучивает текст разными голосами - можно выбрать диктора и настроение, а также настроить темп и высоту речи.

ElevenLabs Eleven v3

Озвучивает текст живыми голосами и умеет передавать эмоции, интонации и манеру речи.

Ультра

Озвучивает текст реалистичными голосами и умеет клонировать голос по короткому аудиопримеру.

Inworld TTS 1.5

Озвучивает текст готовыми голосами на 15 языках, включая русский, с выбором между более естественной и более быстрой моделью.

  1. Нейросети
  2. /
  3. Звук
  4. /
  5. Озвучка