ББратуха
НейросетиСценарииГалереяПомощь
Войти
НейросетиСценарииГалереяПомощь
Братуха

Все нейросети в одном месте и по самым низким ценам.

Разделы

  • Нейросети
  • Чат с нейросетями
  • Сценарии
  • Галерея
  • Промпты

Популярное

  • GPT Image 2
  • Nano Banana Pro
  • Seedream 5.0 Pro
  • Nano Banana 2 Lite
  • Grok Video
  • Nano Banana 2

Помощь

  • Контакты
  • Как пользоваться
  • Инструкции
  • Новости
  • API
  • Для ИИ-агентов
  • Для бизнеса

Компания

  • О нас
  • Мы помогаем
  • Блог
  • Реферальная программа
  • Пользовательское соглашение
  • Политика конфиденциальности
  • Политика обработки в отношении файлов cookie
  • Согласие на обработку персональных данных
  • Согласие на отправку уведомлений рекламно-информационного характера

© 2026 Братуха.ру

257 нейросетей

ByteDance Seed Speech TTS 2.0

Озвучивает текст готовыми голосами на 10 иностранных языках и даёт настроить подачу речи. Цена - 10 ₽ за 1000 символов.

API

0 / 5000

0 / 500

Описание

ByteDance Seed Speech TTS 2.0 — нейросеть для озвучки текста на английском, китайском и ещё восьми языках, русского у неё нет. Голосов 40, а тон, темп и громкость описывают словами в отдельном поле. Подойдёт для роликов, уроков и презентаций на иностранном языке.

Содержание

  1. Коротко
  2. Что умеет: одна история, три подачи и урок английского
  3. Как это работает
  4. Настройки: что ставить
  5. Как написать текст и подсказку
  6. Сколько стоит
  7. Для чего подойдёт
  8. Ограничения и что делать
  9. Версии и альтернативы
  10. Частые вопросы

Коротко

Разработчик
ByteDance, команда Seed
На входе
текст до 5000 символов и подсказка, как его произнести
На выходе
запись MP3, моно, 24 кГц
Языки
английский, китайский, японский, корейский, испанский, португальский, французский, немецкий, итальянский, индонезийский
Голоса
40, из них 27 читают по-английски и 28 по-китайски
Русский язык
не читает; подсказку о подаче понимает и по-русски
Цена
10 ₽ за 1000 символов
Обычно готово
≈ 15 с после отправки
API
есть, документация

Что умеет: одна история, три подачи и урок английского

Озвучку текста на английском мы проверили на четырёх записях, каждую ждали от 15 до 18 секунд. Слова сверяли распознаванием речи, а громкость, паузы и длительность мерили по самим файлам, но интонацию никакой замер не оценит, так что её советуем послушать самим.

Поле «Как произнести»: без подсказки, по-русски и по-английски

Короткая страшилка про маяк, голос Стоки, остальные настройки не трогали. Первый раз поле Как произнести оставили пустым, во второй написали подсказку по-русски, в третий ту же мысль по-английски.

ByteDance Seed Speech TTS 2.0 · без подсказки · 10 ₽ за 1000 символов

ByteDance Seed Speech TTS 2.0 · «Шёпотом, напряжённо и медленно, как страшную историю у костра» · 10 ₽ за 1000 символов

ByteDance Seed Speech TTS 2.0 · «Whisper, tense and slow, like telling a scary story by a campfire» · 10 ₽ за 1000 символов

It was 3:15 in the morning when Nora heard the knock. Three slow taps, then silence. Nobody had visited the lighthouse in 12 years. She picked up the lamp and whispered: "Who's there?" No answer. Only the wind, and somewhere below, the sound of a door she was sure she had locked.

Без подсказки история заняла 22 секунды. С русской подсказкой запись растянулась до 26,6 секунды, стала тише примерно на 6 дБ, а голос опустился чуть ниже. Выходит, русскую подсказку модель понимает. Но шёпота по замеру не вышло: доля звонкой речи почти та же, голос просто притих. С английской подсказкой запись ещё немного длиннее, громкость та же, а участков без звонкого голоса, то есть шёпота, заметно больше. Если нужна точная манера, мы бы писали подсказку по-английски. Во всех трёх записях распознавание нашло все 53 слова, время 3:15 и число 12 модель прочитала без запинки.

Текст из учебника на медленной скорости

Второй сценарий связан с домашним заданием: рассказ школьника о себе, как в учебнике. Голос Софи, в блоке Дополнительно скорость речи 0,8, подсказки нет.

Hello! My name is Daniel, and I am from Manchester. I am 14 years old. Every morning I get up at seven o'clock, have breakfast with my family and take the bus to school. My favourite subjects are History and Biology. On Saturdays I play football with my friends, and on Sundays I usually read or watch films. What about you? What do you do at the weekend?

ByteDance Seed Speech TTS 2.0 · голос Софи, скорость речи 0,8 · 10 ₽ за 1000 символов

355 символов превратились в 28 секунд речи. Распознавание записало все 69 слов, а после «Manchester» и «Biology» голос держит паузу больше полсекунды, так что по записи удобно повторять за диктором. Если темп всё равно быстрый, ползунок можно опустить до 0,5.

Голоса на других языках

Рядом с каждым голосом в форме есть кнопка прослушивания, и образец звучит на языке этого голоса: Свен представляется по-немецки, Миними по-японски, Стоки и Джесс по-английски. Среди китайских голосов есть персонаж: Король обезьян, герой старинного романа «Путешествие на Запад». Вот его образец из формы, это не наша генерация:

образец голоса «Король обезьян», китайский

Русский текст: проверили дважды

Мы отправили короткий русский текст сначала с голосом Стоки, потом с Виви. Оба раза нейросеть вернула ошибку, а деньги сами вернулись на баланс. Подсказка у поля Язык озвучки предупреждает о том же: русский модель не поддерживает, и в списке языков его нет.

Как это работает

Сначала выберите в поле Язык озвучки язык своего текста: по умолчанию стоит английский. В поле Голос останутся только голоса, которые на нём говорят, у каждого есть образец. Текст до 5000 символов вставьте в поле Текст уже на нужном языке: модель его не переводит, а только читает. Если хотите другую подачу, опишите её словами в поле Как произнести до 500 символов, например «спокойно, чуть медленнее, с улыбкой»; в записи её не слышно. Переключатель Дополнительно открывает ползунки скорости, громкости и высоты голоса.

Цена зависит от длины текста и видна на кнопке Отправить до запуска. Готовая запись появится в ленте под формой. Там есть кнопки Скачать, Изменить (текст и настройки вернутся в форму, можно поправить) и Повторить (то же задание запустится ещё раз). В Моих результатах запись лежит 7 дней, удачную стоит сохранить в библиотеку.

Настройки: что ставить

ПолеЗачемЧто ставить
Язык озвучкиязык текста, а не подсказки; от него зависит список голосовязык своего текста; у английского 27 голосов, у китайского 28, у испанского 8, у японского и индонезийского по 4, у португальского 3, у корейского 2, у немецкого, французского и итальянского по одному
Голостембр и манера дикторавыбирайте по образцу, а не по имени; Джесс говорит на шести языках, Виви и Минди на пяти, и одним голосом можно сделать английскую и испанскую версии ролика
Как произнестиэмоция, темп, громкость словамипусто для ровной дикторской начитки, описание для рекламы, сказки или персонажа
Скорость речиот 0,5 до 2, обычная 10,8 для учебных текстов, как в нашем примере
Громкостьот 0,5 до 2, обычная 11; громкость удобнее поправить при монтаже
Высота голосаот −12 до 12, родная высота 0небольшой сдвиг, если голос нравится, но звучит слишком высоко или низко

Последние три поля спрятаны за переключателем Дополнительно. Пока он выключен, модель читает с обычной скоростью, громкостью и высотой.

Как написать текст и подсказку

В подсказке хорошо работают четыре части: эмоция, темп, громкость и образ, с которым её легко сравнить. По нашей пробе английская подсказка точнее передала манеру, чем русская, но и русская заметно изменила запись. Шаблоны:

Warm and calm, a little slower than usual, like a teacher explaining a new word

Energetic and confident, fast pace, like a radio ad for a summer sale

Тихо и ласково, медленно, как сказка перед сном

Сам текст пишите для уха. Короткие предложения и знаки препинания дают паузы там, где нужно, а сокращения вроде «approx.» лучше раскрыть. Частые ошибки:

  • Русский текст вместо перевода. Модель его не примет, сначала переведите, например в чате сайта.
  • Язык в форме не совпадает с языком текста. Что выйдет, если выбрать испанский и вставить английский текст, мы не проверяли, а голоса при этом останутся испанские. Надёжнее выбирать язык самого текста.
  • Подсказку вписали в сам текст. Тогда модель прочитает её вслух, а её место в поле Как произнести.

Сколько стоит

Плата берётся за каждую начатую тысячу символов текста, пробелы тоже считаются. Наша страшилка на 280 символов стоила как полная тысяча, поэтому несколько коротких фраз выгоднее отправить одним текстом. Подсказка в поле Как произнести и ползунки на цену не влияют.

Длина текстаКак считаетсяЦена
до 1000 символоводна тысяча10 ₽
2500 символовтри тысячи30 ₽
5000 символов, максимум за разпять тысяч50 ₽

Для чего подойдёт

  • Послушать, как звучит текст из учебника английского, и повторять за диктором на медленной скорости, как в примере выше.
  • Озвучить ролик для англоязычного YouTube или TikTok, когда своего произношения стесняетесь.
  • Сделать английскую и испанскую версии одного рекламного ролика одним голосом.
  • Начитать презентацию или видео о продукте для иностранных партнёров.
  • Подготовить аудио для уроков китайского или японского: у китайского почти три десятка голосов.
  • Дать голос персонажу мультфильма или игры, например Королю обезьян.
  • Собрать черновую дикторскую дорожку на иностранном языке перед записью живого диктора.

Ограничения и что делать

  • Русского нет. Для русской озвучки возьмите ByteDance Seed Audio 1.0: она тоже от ByteDance и говорит по-русски.
  • В записи один голос. Диалог двух собеседников удобнее сделать в Gemini 3.1 Flash TTS.
  • Своего голоса здесь не сделать, только 40 готовых. Клон по записи есть в MiniMax Speech 2.8.
  • У немецкого, французского и итальянского по одному голосу. Если он не подошёл, загляните в Inworld TTS 1.5: там на французском четыре голоса, на немецком и итальянском по два.
  • Подсказка задаёт настроение, но не дословно: «шёпотом» у нас дало тихую речь, а не полный шёпот. Настоящий шёпот, смех или вздох в нужном месте текста, по подсказке формы, задают метками в квадратных скобках в той же Gemini 3.1 Flash TTS.
  • За раз не больше 5000 символов. Длинный текст делите на части и озвучивайте тем же голосом с той же подсказкой.

Версии и альтернативы

Другой версии этой модели на сайте нет, ближайшая родственница у неё Seed Audio 1.0. Как обе звучат рядом с другими моделями ByteDance, показано в обзоре нейросетей ByteDance, а все озвучки сайта с ценами собраны в разделе «Озвучка текста».

НейросетьЦенаРусскийЧем отличается
ByteDance Seed Speech TTS 2.010 ₽ за 1000 символовнет10 языков, 40 голосов, подача словами
ByteDance Seed Audio 1.050 ₽даголос по описанию, по записи или по картинке, плата за запуск
Gemini 3.1 Flash TTS8 ₽ за 1000 символовда24 языка, подача словами и метки вроде [whispering], диалог двух голосов
Inworld TTS 1.5от 6 ₽ за 1000 символовда15 языков, модели Max и Mini
ElevenLabs Eleven v330 ₽ за 1000 символовда64 голоса, поле «Подача»

Частые вопросы

Описание обновлено 2 октября 2026 г.

Похожие нейросети

Мега

Озвучивает текст реалистичными голосами и умеет клонировать голос по примеру аудио.

Gemini 3.1 Flash TTS

Озвучивает текст естественной речью одним голосом или как диалог двух собеседников с разными голосами.

Премиум

Озвучивает текст разными голосами - можно выбрать диктора и настроение, а также настроить темп и высоту речи.

ElevenLabs Eleven v3

Озвучивает текст живыми голосами и умеет передавать эмоции, интонации и манеру речи.

Ультра

Озвучивает текст реалистичными голосами и умеет клонировать голос по короткому аудиопримеру.

ElevenLabs Eleven v4

Озвучивает текст живым голосом с эмоциями, шёпотом, смехом и звуками по тегам в тексте.

  1. Нейросети
  2. /
  3. Звук
  4. /
  5. Озвучка