ББратуха
НейросетиСценарииГалереяПомощь
Войти
НейросетиСценарииГалереяПомощь
Братуха

Все нейросети в одном месте и по самым низким ценам.

Разделы

  • Нейросети
  • Чат с нейросетями
  • Сценарии
  • Галерея
  • Промпты

Популярное

  • GPT Image 2
  • Nano Banana Pro
  • Seedream 5.0 Pro
  • Nano Banana 2 Lite
  • Grok Video
  • Nano Banana 2

Помощь

  • Контакты
  • Как пользоваться
  • Инструкции
  • Новости
  • API
  • Для ИИ-агентов
  • Для бизнеса

Компания

  • О нас
  • Мы помогаем
  • Блог
  • Реферальная программа
  • Пользовательское соглашение
  • Политика конфиденциальности
  • Политика обработки в отношении файлов cookie
  • Согласие на обработку персональных данных
  • Согласие на отправку уведомлений рекламно-информационного характера

© 2026 Братуха.ру

257 нейросетей

Gemini 3.8 Flash Lite TTS

Быстро озвучивает текст одним голосом или как диалог двух собеседников с разными голосами. Цена - 0,005 ₽ за символ текста.

API

0 / 5000

0 / 500

Описание

Похожие нейросети

Мега

Озвучивает текст реалистичными голосами и умеет клонировать голос по примеру аудио.

Gemini 3.1 Flash TTS

Озвучивает текст естественной речью одним голосом или как диалог двух собеседников с разными голосами.

Премиум

Озвучивает текст разными голосами - можно выбрать диктора и настроение, а также настроить темп и высоту речи.

ElevenLabs Eleven v3

Озвучивает текст живыми голосами и умеет передавать эмоции, интонации и манеру речи.

Ультра

Озвучивает текст реалистичными голосами и умеет клонировать голос по короткому аудиопримеру.

ElevenLabs Eleven v4

  1. Нейросети
  2. /
  3. Звук
  4. /
  5. Озвучка

Gemini 3.8 Flash Lite TTS — облегчённая модель озвучки от Google: читает текст одним из 30 голосов или разыгрывает диалог двух собеседников. Форма и голоса у неё те же, что у полной версии 3.8, а сама Lite рассчитана на поток однотипной озвучки: объявления, напоминания, уроки.

Содержание

  1. Коротко
  2. Что умеет: семь наших записей
  3. Чем Lite отличается от полной версии 3.8
  4. Как это работает: от текста до файла
  5. Настройки: голос и подача
  6. Как подготовить текст для озвучки
  7. Сколько стоит запись в Lite
  8. Для чего подойдёт Lite
  9. Ограничения Lite и что с ними делать
  10. Другие Gemini TTS и альтернативы
  11. Частые вопросы

Коротко

Разработчик
Google, вышла 23 сентября 2026 года вместе с полной Gemini 3.8 Flash TTS
На входе
текст до 5000 знаков одним голосом или диалог из 2–50 реплик двух собеседников
На выходе
аудиофайл WAV
Голоса
30 готовых: 14 женских и 16 мужских, образец каждого играет в форме
Русский язык
говорит по-русски, язык определяет по тексту сама
Подача
манера речи словами для всего текста и для каждой реплики, смех и вздох тегами
Цена
5 ₽ за 1000 символов
Обычно готово
≈ 15 с после отправки
API
есть, документация

Что умеет: семь наших записей

Все записи ниже сделаны в Gemini 3.8 Flash Lite TTS прямо в форме этой страницы. Каждую мы расшифровали распознаванием речи и сравнили с исходником, а длительность и паузы замерили по файлу.

Напоминание с датой, временем и суммой

Первая проба — автоматическое сообщение клиники. В нём есть всё, на чём озвучка обычно спотыкается: номер дома, дата, время через двоеточие, сумма с пробелом внутри и английское слово.

Добрый день! Это стоматология «Белый клык» на Садовой, 17. Алексей Петрович, напоминаем: вы записаны к доктору Смирновой на пятницу, 16 октября, в 18:45. Приём займёт около 40 минут, консультация стоит 1 250 рублей. Пароль от Wi-Fi в холле — на стойке администратора. Если не сможете прийти, ответьте на это сообщение цифрой 2 до 12:00 четверга. Спасибо!

Один голос · Schedar · Манера речи пустая

Распознавание нашло в записи все числа: «18:45» прозвучало как время, «12:00» как «12 часов», а слово Wi-Fi не исказилось. Между предложениями модель сама оставила паузы примерно по 0,7 секунды, так что 354 знака заняли 26 секунд. Падежи распознавание не проверяет, их стоит послушать.

Одна фраза, две манеры

Текст из поля Манера речи модель не произносит, а берёт как ремарку в сценарии. Эту ремарку мы проверили на вокзальном объявлении: озвучили его голосом Achird дважды, изменив только подсказку.

«Спокойно и чётко, как диктор на вокзале, ровный темп»

«Взволнованно и быстро, как будто сам опаздывает на этот поезд и говорит на бегу»

Поезд номер сто сорок два Москва — Казань прибывает на третий путь. Нумерация вагонов начинается с головы поезда. Стоянка поезда — пятнадцать минут.

Спокойный диктор говорил 12,8 секунды, торопливый уложился в 6,4. Слова в обеих записях одни и те же, ни одно не съедено. В нашей пробе подсказку о темпе Lite выполнила точно, так что для серии объявлений подсказку можно подобрать один раз и дальше не менять.

Вздох и смех посреди текста

Звуки ставят английскими тегами в угловых скобках прямо в текст: подсказка формы предлагает <sigh> (вздох) и <laugh> (смех).

Представляешь, мне сегодня перезвонили из того самого издательства. <sigh> Я уже думала, что всё, забыли. А они говорят: рукопись берём, но просим сократить на треть. <laugh> На треть! Это же целых сто двадцать страниц. Ладно, вечером сяду и начну резать.

Один голос · Leda · Манера речи пустая

Теги словами не прозвучали: в расшифровке только русский текст. Восклицание «На треть!» распознавание записало с вопросительным знаком: похоже, модель прочитала его как переспрос, и для этой реплики так даже живее. Смех и вздох распознавание не ловит, поэтому места после «издательства» и перед «Ладно» лучше послушать самим. Теги входят в счёт знаков.

Диалог двух соседей

В режиме Диалог каждая реплика занимает отдельную строку формы: выбираете, кто говорит, пишете текст и при желании манеру именно этой реплики.

1 (удивлённо): Геннадий Иванович, это ваш кот опять сидит у меня на коврике? 2 (устало): Мой. <sigh> Третий раз за неделю сбегает, я уже и дверь не закрываю. 1 (с подозрением): Так он же у вас рыжий был, а этот серый! 2 (смущённо): <laugh> Он в подвале сидел. Отмоется — порыжеет. 1 (со смехом): Забирайте своего хамелеона. И миску мою верните, он из неё со вторника ест. 2 (тепло, примирительно): Верну, верну. Завтра в восемь занесу, вместе с пирогом.

Диалог · Собеседник 1: Aoede, Собеседник 2: Algenib · 6 реплик

Цифра в начале строки — собеседник, в скобках — Манера реплики, общую Манеру речи мы описали как «живой бытовой разговор двух соседей на лестничной клетке». Голоса чередуются строго по репликам: мы замерили высоту тона, и в каждой строке первого собеседника она выше, чем у второго. В последней реплике распознавание услышало «завтра восемь занесу» без «в», это место на 25-й секунде стоит переслушать.

Английские фразы внутри русского текста

Поля для языка в форме нет, Lite определяет его сама. Мы проверили это на уроке английского, где русские и английские предложения идут вперемешку.

Друзья, урок английского начинаем с повторения. Повторяйте за мной: Could you tell me the way to the station, please? А теперь вежливый ответ: Sure, go straight and turn left at the bank. Отлично, у вас получается!

Один голос · Puck · Манера речи пустая

Обе английские фразы распознаны слово в слово, русские тоже. Акцента при переходе с языка на язык мы по расшифровке оценить не можем, это вопрос к собственным ушам.

Рассказ на 1797 знаков

Последняя проба — семейная история про крыжовниковое варенье, около страницы обычного текста одним запуском.

Один голос · Vindemiatrix · «Тепло и спокойно, как в аудиокниге, с лёгкой улыбкой, без спешки»

Вышло 2 минуты 18 секунд, и файл пришёл примерно через 40 секунд после отправки. Пропусков нет: 34 фрагмента расшифровки совпали с текстом. Перед новым абзацем модель держит паузу около секунды, а короткие фразы вроде «Мы гадали годами» отделяет сама, хотя мы ничего не размечали.

Чем Lite отличается от полной версии 3.8

На сайте у обеих одна и та же форма: те же 30 голосов, режим Диалог до 50 реплик, теги <laugh> и <sigh>, одинаковый предел длины. Различаются модели внутри. Google называет полную версию моделью для тонкой актёрской игры: аудиокниг, подкастов, сложных диалогов. Lite разработчик предлагает для больших объёмов: массовой озвучки, чтения вслух, голосовых помощников, обычной речи одним голосом.

Цены обеих видны в таблице в конце статьи.

Чтобы услышать разницу, мы отправили фразу про издательство тем же голосом Leda в полную версию.

Gemini 3.8 Flash Lite TTS · Gemini 3.8 Flash Lite TTS · Leda · 5 ₽ за 1000 символов

Gemini 3.8 Flash TTS · Gemini 3.8 Flash TTS · Leda · 7 ₽ за 1000 символов

Полная версия читала медленнее: 21,4 секунды против 18,7 у Lite. После «издательства», где стоит вздох, она держит паузу почти в секунду, у Lite там всего треть секунды. Текст обе прочитали целиком.

Для объявлений, уроков и спокойного чтения нам хватило Lite. Сценку, где важны оттенки игры, и длинный художественный текст мы бы сначала послушали в обеих: для таких задач Google сама советует полную версию.

Как это работает: от текста до файла

Всё начинается с переключателя Тип генерации. В режиме Один голос модель читает всё, что вставлено в поле Текст. Диалог собирается из реплик: у каждой выбираете, кто говорит (Собеседник 1 или 2), и пишете её текст, а голоса собеседников задаются выше, в полях Голос собеседника 1 и Голос собеседника 2. Реплик от 2 до 50, в сумме до 5000 знаков, как и у одного голоса.

Голос выбирают на слух: у каждого из 30 вариантов есть кнопка воспроизведения образца. Переключатель Голоса оставит только женские или только мужские, а тон и темп можно описать в необязательном поле Манера речи. Цену покажет кнопка Отправить.

Когда запись готова, под формой появляется плеер и три кнопки. Скачать сохраняет WAV. Изменить подставляет в форму прежний текст с настройками, чтобы поправить реплику, а Повторить без правок отправляет то же задание заново, и дубли звучат немного по-разному. Запись лежит в Моих результатах 7 дней, нужную перенесите в библиотеку.

Настройки: голос и подача

  • Голос. По умолчанию стоит Kore, в диалоге Kore и Puck. Google описывает голоса одним словом: Kore твёрдый, Puck бодрый, Achird дружелюбный, Vindemiatrix мягкий, Algenib с хрипотцой. Перед длинным текстом послушайте три-четыре образца.
  • Манера речи. До 500 знаков, в цену не входит. Нам хватало одной строки: настроение, темп и ситуация. Для серии одинаковых объявлений подберите подсказку на одном тексте и копируйте её дальше.
  • Манера реплики в диалоге: до 300 знаков на строку. Короткое наречие («удивлённо», «устало») работает, длинный абзац не нужен.
  • Два одинаковых голоса в диалоге форма тоже примет, но слушатель не поймёт, кто говорит. Для разговора лучше пара «женский и мужской» или два голоса, заметно разных по высоте.

Как подготовить текст для озвучки

Пишите так, как текст должен звучать вслух. Цифры, даты и время модель в наших пробах прочитала верно, но если важно склонение («до двенадцати часов»), проще написать его словами. Длинные предложения разбейте точками: в наших записях заметные паузы стояли именно на них. Подсказку к подаче составляйте как ремарку для актёра:

Негромко и доверительно, чуть медленнее обычного, как будто рассказывает подруге секрет на кухне

Типичные промахи:

  • Ремарки в скобках прямо в тексте, вроде «(шёпотом)». Для них есть Манера речи и Манера реплики: эти поля не озвучиваются и не оплачиваются, а скобки в тексте считаются знаками.
  • Теги в квадратных скобках, как у Gemini 3.1 Flash TTS. Подсказка этой формы предлагает угловые: <laugh> и <sigh>.
  • Текст длиннее 5000 знаков. Форма его не отправит, поэтому длинный материал делите заранее, по абзацам или главам.

Сколько стоит запись в Lite

Оплачиваются знаки текста вместе с пробелами и тегами, а в диалоге считается сумма всех реплик. Голос, режим и подсказки к подаче цену не меняют.

Длина текстаЗвучит примерноЦена
300 знаков, короткое объявление20–25 секунд1,50 ₽
1000 знаков, полстраницы1 минута 15 секунд5 ₽
5000 знаков, предел одного запускаоколо шести минут25 ₽

Длительность — по нашим записям в спокойном темпе. Если попросить говорить быстрее, запись станет короче, а цена останется прежней.

Для чего подойдёт Lite

  • Напоминания и автоматические сообщения с датами, временем и суммами, как в первом примере.
  • Объявления, которые нужно выпускать сериями одинаковым голосом и темпом.
  • Уроки иностранного языка: русские пояснения и английские фразы одним файлом.
  • Учебные и рекламные сценки на два голоса.
  • Статьи, инструкции и рассылки для чтения вслух, частями до 5000 знаков.
  • Пробная озвучка ролика до записи диктора: сразу слышно, укладывается ли текст по времени.

Ограничения Lite и что с ними делать

  • За один запуск не больше 5000 знаков. Книгу или длинную лекцию делите по главам и склеивайте файлы при монтаже.
  • Собеседников в диалоге двое. Если в сценке есть третий, соберите его реплики отдельной записью и добавьте при монтаже.
  • Только 30 готовых голосов. У Google модель умеет и больше, но в форме сайта своего голоса и клона нет: для клона подойдут другие озвучки из подборки нейросетей для озвучки текста.
  • Ударение не задать. Неудачно прочитанное слово проще заменить другим или передвинуть в другое место фразы.
  • Манера и теги для Lite — пожелание. Если смеха там, где он нужен, не слышно, нажмите Повторить или отправьте текст в полную версию 3.8.

Другие Gemini TTS и альтернативы

В таблице — все версии Gemini TTS на сайте и одна озвучка другого разработчика. Сравнение озвучек на одной фразе есть в статье о нейросетях для озвучки текста, остальные модели Google — в обзоре нейросетей Google.

НейросетьЦенаЗнаков за разКогда брать
Gemini 3.8 Flash Lite TTS5 ₽ за 1000 символов5000поток объявлений и напоминаний, уроки, диалоги без сложной игры
Gemini 3.8 Flash TTS7 ₽ за 1000 символов5000та же форма; сценки, рассказы и аудиокниги, где важны оттенки игры
Gemini 3.1 Flash TTS8 ₽ за 1000 символов2500нужен выбор языка в форме и метки в квадратных скобках
Gemini 2.5 Flash TTS4 ₽ за 1000 символов4000выбор из 24 языков, диалог одним текстом с именами, файл MP3
ElevenLabs Eleven v330 ₽ за 1000 символов5000другой набор голосов, без режима диалога

Частые вопросы

Описание обновлено 2 октября 2026 г.

Озвучивает текст живым голосом с эмоциями, шёпотом, смехом и звуками по тегам в тексте.