Братуха
НейросетиСценарииГалереяПомощь
Войти
НейросетиСценарииГалереяПомощь
Братуха

Все нейросети в одном месте и по самым низким ценам.

Разделы

  • Нейросети
  • Чат с нейросетями
  • Сценарии
  • Галерея
  • Промпты

Популярное

  • GPT Image 2
  • Nano Banana Pro
  • Seedream 5.0 Pro
  • Nano Banana 2 Lite
  • Nano Banana 2
  • Grok Video

Помощь

  • Контакты
  • Как пользоваться
  • Инструкции
  • Новости
  • API

Компания

  • О нас
  • Мы помогаем
  • Блог
  • Реферальная программа
  • Пользовательское соглашение
  • Политика конфиденциальности
  • Политика обработки в отношении файлов cookie
  • Согласие на обработку персональных данных
  • Согласие на отправку уведомлений рекламно-информационного характера

© 2026 Братуха.ру

232 нейросети

Gemini Omni 1.1 (Audio)

Создаёт короткие видео по описанию, изображениям и исходному видео, а ещё умеет делать персонажей и настраивать голоса для аудио. Цена на видео - от 48 до 190 ₽ за генерацию, зависит от длительности, разрешения и того, загружено ли исходное видео.

0 / 20000

Загрузить файлы
Перетащите файлы сюда
или нажмите, чтобы выбрать
Поддерживаются JPG, PNG, WebP, HEIC и HEIF. До 7 изображений, каждый файл до 20 МБ.
0/7
Загрузить файлы
Перетащите файлы сюда
или нажмите, чтобы выбрать
Поддерживаются MP4, MOV и WebM. 1 видео до 100 МБ и до 30 секунд. Используемый фрагмент не должен превышать 10 секунд.
0/1

0 / 200

Описание

Gemini Omni 1.1 (Audio) - модель от Google для создания и редактирования коротких роликов с поддержкой текста, картинок, видео, персонажей и озвучки. В этой версии акцент сделан не только на генерации с нуля, но и на более управляемом монтаже: можно задать сцену словами, добавить референсные изображения, взять кусок готового видео и получить новый фрагмент в том же духе.

По заявлениям создателей, Gemini Omni 1.1 Flash умеет генерировать видео вместе со звуком, включая речь, движения губ и фоновые шумы сцены. Google делает упор на больший контроль над результатом: модель понимает сочетание разных типов входных данных и рассчитана на редактирование роликов, где нужно сохранить движение, образ персонажа и общее настроение кадра.

В найденных описаниях этой версии часто упоминаются 360p, 720p, 1080p и 4K, работа с короткими видеореференсами, продолжение сцены и использование последних секунд исходного ролика как контекста. Для обычного пользователя это означает простую вещь: модель лучше держит логику движения между кадрами, чем инструменты, которые просто рисуют отдельные красивые, но слабо связанные фрагменты.

Как это работает

Схема простая: вы выбираете режим, загружаете нужные материалы и пишете, что хотите получить. Для видео это может быть текстовое задание, несколько картинок для внешнего вида сцены, а иногда и исходный ролик, из которого берётся короткий фрагмент. Модель смотрит на все подсказки сразу и собирает новый результат - с учётом стиля, движения и звука.

Режим персонажа нужен, когда вы хотите заранее подготовить героя, а потом использовать его в роликах повторно. Это помогает не описывать одного и того же человека заново в каждом запросе.

Режим аудио работает как заготовка голоса. Вы выбираете голосовой пресет, задаёте название и при желании описываете манеру речи - например, спокойный диктор, бодрый ведущий или мягкий разговорный тон.

Настройки

  • Тип генерации - выбор между видео, персонажем и аудио.
  • Задание - текстовое описание сцены: что происходит, как движется камера, какая атмосфера нужна.
  • Референсные изображения - картинки, которые помогают задать внешность, стиль, одежду, предметы или фон.
  • Видео - исходный ролик для переработки или продолжения сцены.
  • Начало фрагмента видео и конец фрагмента видео - выбор куска из загруженного ролика. Это полезно, когда нужен не весь файл, а только нужный момент.
  • Персонажи - можно подставить заранее созданных героев по их ID, чтобы сохранить образ между генерациями.
  • Длительность - 4, 6, 8 или 10 секунд.
  • Соотношение сторон - горизонтальный формат 16:9 или вертикальный 9:16.
  • Разрешение - от 360p до 4K.
  • Описание персонажа - текст, где вы задаёте внешность, одежду, характер и манеру поведения героя.
  • Изображение персонажа - одна картинка, на основе которой собирается образ.
  • ID аудио для голоса - привязка заранее подготовленного голоса к персонажу.
  • Имя персонажа - просто подпись, чтобы не путаться в заготовках.
  • Голос - выбор готового пресета с разным тембром.
  • Название голоса - как вы сами назовёте заготовку.
  • Описание голоса - можно уточнить темп, настроение и подачу.
  • Пример реплики - короткая фраза для ориентира по речи.

Для чего подойдёт

  • Сделать короткий рекламный ролик товара по тексту и фото, когда нужно быстро показать упаковку, свет и движение камеры.
  • Оживить картинку персонажа и потом использовать этого героя в нескольких видео подряд.
  • Переделать кусок уже снятого ролика - например, сменить атмосферу сцены, фон или подачу.
  • Собрать вертикальное видео для сторис, рилса или короткого объявления.
  • Подготовить голос для виртуального ведущего, продавца, рассказчика или персонажа в мини-сериале.
  • Показать идею клипа, заставки или анимационной сцены без полноценной съёмки.
  • Сделать пробный ролик в 360p, а потом заказать тот же замысел в более высоком качестве.

Ограничения

Ролики здесь короткие: в настройках доступны от 4 до 10 секунд. Для длинных историй придётся собирать несколько сцен по частям.

Исходное видео ограничено по размеру и длине, а используемый фрагмент не должен быть длиннее 10 секунд. Из-за этого инструмент больше заточен под короткие вставки, продолжения сцен и переработку отдельных моментов, а не под монтаж большого фильма.

Судя по найденным материалам о модели, основной упор сделан на видео. Режим аудио в такой форме больше похож на создание голосовой заготовки, чем на полноценный редактор звука с тонкой правкой каждой фразы.

Чем отличается от аналогов

Главная особенность Gemini Omni 1.1 - сочетание нескольких режимов в одной модели: видео, персонажи и аудио связаны между собой. У похожих решений часто бывает перекос в одну сторону: одни лучше рисуют красивые сцены с нуля, другие - лучше редактируют готовый ролик. Здесь сильная сторона именно в комбинировании источников: текст, картинки, кусок видео и голосовые настройки могут работать вместе.

Ещё одно отличие - упор на согласованность сцены. Когда модель учитывает короткий фрагмент исходного видео и референсы персонажа, легче получить ролик, где герой, движение и общий стиль меньше "прыгают" от кадра к кадру. Для человека без опыта это полезно: меньше времени уходит на бесконечные перегенерации из-за того, что лицо, одежда или ракурс внезапно меняются.