ББратуха
НейросетиСценарииГалереяПомощь
Войти
НейросетиСценарииГалереяПомощь
Братуха

Все нейросети в одном месте и по самым низким ценам.

Разделы

  • Нейросети
  • Чат с нейросетями
  • Сценарии
  • Галерея
  • Промпты

Популярное

  • GPT Image 2
  • Nano Banana Pro
  • Seedream 5.0 Pro
  • Nano Banana 2 Lite
  • Grok Video
  • Nano Banana 2

Помощь

  • Контакты
  • Как пользоваться
  • Инструкции
  • Новости
  • API
  • Для ИИ-агентов
  • Для бизнеса

Компания

  • О нас
  • Мы помогаем
  • Блог
  • Реферальная программа
  • Пользовательское соглашение
  • Политика конфиденциальности
  • Политика обработки в отношении файлов cookie
  • Согласие на обработку персональных данных
  • Согласие на отправку уведомлений рекламно-информационного характера

© 2026 Братуха.ру

257 нейросетей

Нейросети для создания видео по референсам

Как выбрать
Загружаем фильтры...
Пример работы нейросети Seedance 2.5

Seedance 2.5

Цена: от 8 ₽/сек.
Видео из текста
Видео из изображений
Редактирование видео
Видео по референсам
Видео-переход между кадрами
Видео из текста
Видео из изображений
Редактирование видео
Видео по референсам
Видео-переход между кадрами

Seedance 2.5 — нейросеть ByteDance для видео со звуком: создаёт ролик до 30 секунд из текста, фото или набора образцов и переделывает готовое видео словами. Название читают «сиданс».

Пример работы нейросети Grok Video

Grok Video

Цена: от 2 ₽/сек
Видео из текста
Видео из изображений
Видео по референсам
Видео из текста
Видео из изображений
Видео по референсам

Grok Video — видеонейросеть xAI: снимает ролики со звуком по описанию или оживляет картинки, до семи на один ролик. Длина ролика от 6 до 30 секунд. Секунда видео у неё одна из самых дешёвых на сайте, поэтому здесь удобно проверять идеи и делать ролики для соцсетей.

Пример работы нейросети Seedance 1.5 Pro

Seedance 1.5 Pro

Цена: от 7 ₽
Видео из текста
Видео из изображений
Видео по референсам
Видео из текста
Видео из изображений
Видео по референсам

Seedance 1.5 Pro — нейросеть ByteDance для коротких роликов со звуком: видео на 4, 8 или 12 секунд по описанию или по одной-двум картинкам. В ней удобно перебирать идеи и снимать короткие сцены для соцсетей, а двумя картинками задавать первый и последний кадр.

Пример работы нейросети Wan 3.0 Video Prime

Wan 3.0 Video Prime

Цена: от 9 ₽/сек.
Видео из изображений
Видео из текста
Видео по референсам
Видео-переход между кадрами
Видео из изображений
Видео из текста
Видео по референсам
Видео-переход между кадрами

Wan 3.0 Video Prime — ускоренная версия видеонейросети Alibaba Wan 3.0: ролик от 2 до 30 секунд со звуком из текста, кадров, образцов, документа или ссылки на страницу. Режимы и поля те же, что у обычной Wan 3.0, а готовое видео приходит быстрее.

Пример работы нейросети Wan 2.7 Video

Wan 2.7 Video

Цена: от 90 ₽
Продление видео
Редактирование видео
Видео из текста
Видео из изображений
Видео по референсам
Видео-переход между кадрами
Продление видео
Редактирование видео
Видео из текста
Видео из изображений
Видео по референсам
Видео-переход между кадрами

Wan 2.7 Video — нейросеть Alibaba для коротких роликов до 15 секунд: снимает видео по описанию, фото и роликам-образцам, а ещё правит и продлевает готовое видео. Пригодится, когда ролик нужен под свою озвучку или снятое надо переделать, а не снимать заново.

Пример работы нейросети Wan 3.0 Video

Wan 3.0 Video

Цена: от 5 ₽/сек.
Видео из текста
Видео по референсам
Видео-переход между кадрами
Видео из текста
Видео по референсам
Видео-переход между кадрами

Wan 3.0 — нейросеть Alibaba, которая снимает видео со звуком длиной от 2 до 30 секунд: из текста, по фото, между двумя кадрами, по картинкам-образцам и даже по PDF, презентации или ссылке на статью. Подойдёт для длинной сцены с репликами по-русски и обучающего ролика по готовому документу.

Пример работы нейросети Gemini Omni

Gemini Omni

Цена: от 60 ₽
Редактирование видео
Видео из текста
Видео из видео
Видео по референсам
Редактирование видео
Видео из текста
Видео из видео
Видео по референсам

Gemini Omni — видеонейросеть Google: снимает ролик со звуком до 10 секунд по описанию, картинкам или сохранённому персонажу и переделывает загруженное видео по просьбе словами. У Google эта модель называется Gemini Omni Flash, а название читают «джемини омни».

Пример работы нейросети Kling 3.0

Kling 3.0

Цена: от 11 ₽/сек.
Видео из изображений
Видео из текста
Редактирование видео
Видео по референсам
Видео из изображений
Видео из текста
Редактирование видео
Видео по референсам

Kling 3.0 — нейросеть Kuaishou, которая делает видео до 15 секунд из текста, картинки или набора референсов и перерисовывает готовые ролики. Её главная сила — сцены: в одном ролике можно задать несколько планов со своей длиной и сохранить героя по фото.

Пример работы нейросети Gemini Omni 1.1

Gemini Omni 1.1

Цена: от 48 ₽
Видео из изображений
Видео из текста
Редактирование видео
Видео по референсам
Видео из изображений
Видео из текста
Редактирование видео
Видео по референсам

Gemini Omni 1.1 Flash — видеонейросеть Google, вторая модель Omni: снимает ролики до 10 секунд со звуком и русской речью по тексту, картинкам и вашему видео. Помнит сохранённых героев и голоса, а для быстрых проб умеет 360p.

Пример работы нейросети Seedance 2.0 Mini

Seedance 2.0 Mini

Цена: от 5 ₽/сек.
Видео из изображений
Видео из текста
Видео по референсам
Видео-переход между кадрами
Видео из изображений
Видео из текста
Видео по референсам
Видео-переход между кадрами

Seedance 2.0 Mini — облегчённая нейросеть ByteDance для коротких роликов без звука: снимает видео от 4 до 15 секунд из текста, из картинки или по набору референсов в 480p или 720p. Удобна, чтобы недорого перебрать варианты сцены до финального запуска.

Пример работы нейросети Seedance 2.0

Seedance 2.0

Цена: от 5 ₽/сек.
Редактирование видео
Видео из текста
Видео из изображений
Видео по референсам
Редактирование видео
Видео из текста
Видео из изображений
Видео по референсам

Seedance 2.0 — нейросеть ByteDance для видео до 15 секунд: снимает ролик по описанию, по фото, по первому и конечному кадру или по набору референсов и переделывает готовое видео. Для снимков с лицами людей в форме есть модели Face.

Пример работы нейросети MiniMax H3

MiniMax H3

Цена: от 6 ₽/сек.
Видео из текста
Видео из изображений
Видео по референсам
Видео-переход между кадрами
Видео из текста
Видео из изображений
Видео по референсам
Видео-переход между кадрами

MiniMax H3 — видеонейросеть компании MiniMax: снимает ролик со звуком из описания, из картинки или по образцам — фото, видео и аудио. Две модели: H3 в 768P и 2K и H3 Max в 480p–1080p, длина от 5 до 15 секунд; русскую речь и надписи из задания в наших пробах передала без ошибок.

  • Wan 2.6 Flash — Wan 2.6 Flash — быстрая версия видеомодели Wan 2.6 от Alibaba: оживляет картинку на 2–15 секунд или собирает ролик по пяти референсам, со звуком или без. Подойдёт, когда нужен короткий ролик точной длины или несколько планов в одном видео.
  • Veo 3.1 — Veo 3.1 — нейросеть Google для видео со звуком: снимает восьмисекундный ролик по описанию, по картинке, по референсам или между двумя заданными кадрами, и герои в нём говорят по-русски. Модели Lite, Fast и Обычная отличаются ценой и проработкой кадра.
  • Flux 3 Video — Flux 3 Video — видеонейросеть Black Forest Labs: снимает ролик на 5–20 секунд со звуком по описанию или по 1–10 картинкам. Сначала можно сделать дешёвый черновик, а удачный довести до HD или FHD с тем же сюжетом и движением.
  • Pika 2.2 — Pika 2.2 — нейросеть американской компании Pika Labs для коротких роликов: оживляет фото, снимает видео по описанию, ведёт сюжет через 2–5 ключевых кадров и собирает сцену из нескольких картинок. Ролик приходит без звука, задание можно писать по-русски.
  • Vidu One-Click V2 MV — Vidu One-Click V2 MV - нейросеть для создания видео из фотографий и аудио. Вы загружаете 1-3 изображения, добавляете музыку или голос (одним файлом) и получаете ролик, где картинка “оживает” за счёт плавных движений камеры и смены планов.
  • PixVerse C1 — PixVerse C1 - модель для генерации видео от компании PixVerse. Она делает ролики по текстовому описанию, оживляет одно изображение, собирает сцену по референсам и умеет строить переходы между первым и конечным кадром. Максимум в этой версии - до 15 секунд и до 1080p, а звук можно сгенерировать вместе с видео.
  • HappyHorse 1.1 — HappyHorse 1.1 - нейросеть для генерации коротких видео по тексту, картинке или референсным изображениям. Модель связана с Alibaba и рассчитана на ролики до 1080p, где важны движение, композиция кадра и более стабильный внешний вид персонажей от сцены к сцене.
  • Vidu Q3 Drama — Vidu Q3 Drama - нейросеть для создания драматических видео по сценарию, картинкам и подготовленным ассетам. Модель относится к линейке Vidu Q3 и заточена под сюжетные ролики, где важны цельная сцена, эмоции, движение камеры и ритм.
  • Vidu Q3 Ad — Vidu Q3 Ad - модель для генерации коротких рекламных роликов по описанию и изображениям. Она берёт фото товара или несколько референсов, собирает из них сцену и делает готовое видео в нужном формате кадра. Vidu создан компанией ShengShu Technology.

Как выбрать нейросеть

Содержание

  1. Героиня, банка и пекарня в пяти нейросетях
  2. Как собрать ролик из референсов на сайте
  3. С каких нейросетей начать
  4. Остальные нейросети категории
  5. Таблица: сколько файлов и какой длины ролик
  6. Что выбрать под задачу
  7. Каким должен быть референс
  8. Вопросы

Видео по референсу — ролик, который нейросеть собирает по вашим образцам: вы загружаете фото героя, снимок товара или места, короткий ролик с нужным движением или запись голоса. Такой файл и называется референсом. В новом ролике сохраняются лицо, одежда, этикетка и интерьер, а что происходит в кадре, решает ваше задание. Так снимают серию роликов с одним персонажем, рекламу конкретного товара или сценку для сторис в знакомом месте.

От видео из фото это отличается тем, что картинка не становится первым кадром. Из нескольких картинок собирается новая сцена, которой не было ни на одной из них. Мы проверили это на трёх своих картинках в пяти нейросетях-лидерах. Сцену с первого раза собрали все пять, а различались они местом, этикеткой и речью: одна нейросеть придумала свою пекарню, другая не выговорила русскую фразу.

Героиня, банка и пекарня в пяти нейросетях

Исходники мы сгенерировали сами в Nano Banana Pro: женщина-пекарь, которой не существует, банка вишнёвого варенья с рисунком вместо надписи и пустая пекарня с голубой плиткой.

Три референса: выдуманная женщина-пекарь, банка вишнёвого варенья и пустая пекарня

Задание у всех одно. Отличается только то, как в нём названы картинки: у каждой нейросети своя запись, о ней ниже. Все ролики на 6 секунд, 720p, вертикальные 9:16, со звуком.

Героиня с @image1 стоит за прилавком в пекарне с @image3. Она ставит на прилавок банку варенья с @image2, поворачивает её этикеткой к камере, улыбается и говорит по-русски: «Вишнёвое, сами варили. Попробуйте!» Камера медленно приближается. Реалистичная съёмка, тёплый утренний свет.

Seedance 2.5 · 6 с, 720p · от 8 ₽/сек.

Grok Video · 6 с, 720p · от 2 ₽/сек

Wan 3.0 Video Prime · 6 с, 720p · от 9 ₽/сек.

Kling 3.0 · 6 с, 720p

Героиню узнать можно везде: чёлка, веснушки, горчичный фартук, рубашка в полоску. Пекарню и банку ближе всех к картинкам перенесли Wan 3.0 Video Prime и Gemini Omni, с той же плиткой, латунными лампами и вишнями на этикетке. Лицо ближе всего к фото у Omni и Seedance 2.5, причём Seedance единственная по-настоящему выполнила «камера медленно приближается»: подвела камеру к крупному плану лица, и черты при этом не поплыли. Grok Video героиню сохранила, а пекарню придумала свою: серая плитка, полок больше, окна нет, вишни на этикетке перерисованы.

Речь мы проверяли распознаванием. Фразу слово в слово сказали четыре нейросети, а у Kling 3.0 вышло что-то вроде «вишня мы саби это сделать», хотя картинку она собрала точно. Всё сравнение обошлось нам в 458 ₽, больше половины из них пришлось на две самые дорогие нейросети, Seedance 2.5 и Wan 3.0 Video Prime.

Как собрать ролик из референсов на сайте

Откройте нейросеть по карточке выше. У большинства лидеров в поле Тип генерации нужно выбрать «Видео по референсам». У Grok Video такого пункта нет: там режим «Видео из изображений», и картинок в него можно загрузить до 7. У Gemini Omni режим называется «Видео». Загрузите файлы, в поле Задание (это и есть промпт) опишите сцену, выберите длительность, разрешение и пропорции кадра и нажмите Отправить. Цена видна на кнопке до запуска и меняется вместе с настройками. Разрешение 480p годится для проб, 720p — для телефона, 1080p и 4K — для большого экрана.

Готовый ролик появится под формой и в разделе Мои результаты, хранится 7 дней. Если сайт для вас новый, начните с инструкции по сайту.

Главное в задании: сказать, какой файл за что отвечает. Файлы нумеруются в порядке загрузки, а записывать номер нейросети просят по-разному:

  • в Seedance 2.5 и Seedance 2.0 Mini пишут @image1, @video1, @audio1, в Kling 3.0 — только @image1 и дальше по номерам, потому что видео и аудио в этом режиме она не берёт; можно набрать @ и выбрать файл из меню;
  • в Wan 3.0 Video и Wan 3.0 Video Prime называют словами: «изображение 1», «видео 1», «аудио 1»;
  • у Grok Video и Gemini Omni подсказки в форме нет; у нас сработали «с изображения 1» в Grok и @image1 в Omni.

С каких нейросетей начать

Seedance 2.5: больше всего референсов и образец движения

Seedance 2.5 от ByteDance вышла в конце июля 2026. Она принимает до 30 картинок, до 10 видео и до 10 аудиофайлов. Каждое видео и аудио длится от 2 до 30 секунд; все видео вместе — не больше 30 секунд, все аудио — тоже. Ролик выходит на 4–30 секунд, в 480p, 720p или 1080p. Платите за секунду: с видео-референсом ставка ниже, но к секундам ролика прибавляются секунды образца. Наши 5 секунд ролика с 6-секундным образцом посчитались как 11. Самая низкая ставка: от 8 ₽/сек..

Видео-референс есть не у всех нейросетей категории. Мы сняли в Grok Video 6-секундный ролик: парень в студии делает два шага, поворачивается и поднимает руки. Героиня повторила всё это за 5 секунд, уже в пекарне и в своём фартуке. С первого раза образец не приняли: у Grok он вышел 416×752, меньше 480p, а Seedance 2.5 берёт видео-референс в 480p, 720p или 1080p. Мы увеличили ролик до 720×1280, а деньги за отклонённый запуск вернулись. Сами разработчики в блоге ByteDance Seed пишут, что сложные движения и сцены с несколькими героями модель пока передаёт не всегда правдоподобно.

Слева образец движения, справа результат.

Героиня с @image1 в пекарне с @image2 повторяет движения из @video1: два шага вправо, поворот вокруг себя и руки вверх. Камера облетает её на полкруга, как в @video1. Лицо, причёска и одежда — как на @image1, фон — пекарня, а не студия.

Seedance 2.5 · 2 картинки и видео, 5 с, 720p · от 8 ₽/сек.

Grok Video: дёшево и до 30 секунд

Grok Video от xAI дешевле остальных лидеров: от 2 ₽/сек, самый короткий ролик у неё 6 секунд в 480p. В режиме «Видео из изображений» она берёт до 7 картинок, ролик тянется до 30 секунд, разрешение 480p или 720p.

Пекарню в сравнении Grok придумала свою, зато героиню держит долго. Мы расписали ролик на 20 секунд по отрезкам: открывает пекарню, раскладывает хлеб, ставит банку, встречает покупателя. Все четыре отрезка Grok выполнила по порядку, и героиня до конца осталась той же. От себя нейросеть добавила покупательницу и реплики «Доброе утро! Добро пожаловать в нашу пекарню», хотя речи в задании не было. Если слова не нужны, так и напишите: «без речи».

Один ролик на 20 секунд. 0–5 с: раннее утро, героиня с изображения 1 открывает дверь пекарни с изображения 3 и включает лампы над прилавком. 5–10 с: она достаёт из печи румяные караваи и раскладывает их по плетёным корзинам. 10–15 с: ставит на прилавок банку варенья с изображения 2 рядом с хлебом. 15–20 с: входит первый покупатель, героиня машет ему рукой и улыбается. Реалистичная съёмка, тёплый утренний свет.

Grok Video · 3 картинки, 20 с, 720p · от 2 ₽/сек

Wan 3.0 Video Prime и Wan 3.0 Video: точнее всех переносят место

Wan 3.0 Video Prime от Alibaba вышла в августе 2026. В режиме «Видео по референсам» она принимает до 10 картинок, до 5 видео и до 5 аудио: каждый файл от 1 до 15 секунд, всего не больше 15. Ролик длится от 2 до 30 секунд. Цена за секунду зависит только от разрешения, звук на неё не влияет: от 9 ₽/сек.. У Wan 3.0 Video такие же лимиты, а секунда дешевле: от 5 ₽/сек.. Ещё обе умеют собрать ролик по документу (PDF, презентация, таблица) или по публичной странице, это пригодится для роликов-объяснений.

В сравнении Prime перенесла пекарню почти кадр в кадр. Потом мы проверили аудио-референс: записали в «Меге» фразу женским голосом и попросили героиню сказать этим голосом другую. Слова Wan произнесла чисто, но голос в ролике заметно выше, чем в образце, так что точной копии не ждите. Когда голос должен совпасть, надёжнее говорящее фото: там ваша запись идёт в ролик без изменений.

Образец голоса, который мы загрузили:

Героиня с изображения 1 стоит за прилавком в пекарне с изображения 2, смотрит в камеру и говорит по-русски голосом из аудио 1: «Хлеб только из печи, берите горячим!» Реалистичная съёмка, тёплый утренний свет.

Wan 3.0 Video Prime · 2 картинки и аудио, 6 с, 720p · от 9 ₽/сек.

Kling 3.0: несколько планов и 4K

Kling 3.0 принимает до 7 картинок-референсов (JPG или PNG, от 300×300) и делает ролик на 3–15 секунд в 720p, 1080p или 4K. Главное в её форме — поле Сцены. В режиме «Один ролик» получается один план, в «Умном планировании» нейросеть сама режет задание на планы, а в «Своих сценах» длительность и задание каждой сцены пишете вы. В поле Элементы загружают картинки героя или предмета, который должен остаться узнаваемым. Цена — от 11 ₽/сек.; в 720p и 1080p со звуком (переключатель Нативное аудио) секунда дороже.

В «Умном планировании» мы расписали три сцены на 10 секунд: общий план у полок, крупно руки с банкой, героиня смотрит в камеру. Получилось ровно три плана, героиня и банка в каждом одинаковые. Русскую фразу Kling и здесь не выговорила, поэтому звук в этом примере мы убрали.

Три сцены с одной героиней. Сцена 1: героиня с @image1 раскладывает караваи по полкам в пекарне с @image3, общий план. Сцена 2: крупный план её рук, она ставит банку варенья с @image2 на прилавок. Сцена 3: героиня улыбается в камеру и говорит по-русски: «Ждём вас с утра!»

Kling 3.0 · «Умное планирование», 10 с, 720p, звук убран · от 11 ₽/сек.

Gemini Omni: двое людей в одной сцене

Gemini Omni от Google принимает до 7 картинок и исходный ролик до 30 секунд, из которого берётся фрагмент до 10 секунд. Платите не за секунду, а за ролик на 4, 6, 8 или 10 секунд: от 60 ₽. В режиме Персонаж нейросеть по одной картинке и описанию создаёт героя, и потом его можно добавить в новый ролик через поле Персонажи, до трёх в одном. Лимит у Omni общий: картинки, по 2 за каждое видео и персонажи вместе дают не больше 7.

Для примера мы дали ей двух выдуманных людей, продавщицу и пожилого покупателя, и ту же пекарню. Оба узнаются, а реплики «Ваш любимый, ещё тёплый» и «Спасибо, дочка!» распознались слово в слово.

Два референса: выдуманные продавщица и пожилой покупатель в кепке

@image1 — продавщица за прилавком в пекарне с @image3. @image2 — пожилой покупатель, он входит и подходит к прилавку. Она протягивает ему бумажный пакет с багетом и говорит по-русски: «Ваш любимый, ещё тёплый». Он улыбается и отвечает: «Спасибо, дочка!» Реалистичная съёмка, тёплый утренний свет.

Gemini Omni · 3 картинки, 6 с, 720p · от 60 ₽

Остальные нейросети категории

Другие версии лидеров

Gemini Omni 1.1 новее и дешевле Omni при той же длине ролика, а задание в ней может быть до 20 000 знаков. У Seedance 2.0 Mini та же запись @image1 и те же три вида файлов, что у Seedance 2.5, а секунда дешевле: ролик на 4–15 секунд в 480p или 720p. Наш ролик из сравнения в 480p вышел узнаваемым, но без звука: переключателя звука в её форме нет, и героиня шевелит губами молча.

То же задание, что в сравнении выше.

Seedance 2.0 Mini · 5 с, 480p, без звука · от 5 ₽/сек.

У Seedance 2.0 до 9 картинок-референсов, две модели (быстрая Fast и обычная) и правка готового ролика до 15 секунд. Seedance 1.5 Pro ближе к видео из фото: картинок в ней не больше двух. Wan 2.7 Video в режиме «Видео по референсам» принимает одну картинку и до 4 роликов, ролик на 2–10 секунд, а ещё умеет править и продлевать видео. У Wan 2.6 Flash до 5 референсов (видео среди них до 3), ролик на 5 или 10 секунд и режим «Несколько кадров». Veo 3.1 от Google умеет работать по референсам в вариантах 1 и 3 поля Версия: до 3 картинок, разрешение до 4K.

Высокое разрешение и новые модели

MiniMax H3 делает ролик сразу в 2K на 5–15 секунд. Кроме картинок она принимает видео и аудио, но аудио одно не сработает, а каждая секунда видео-референса добавляется к цене. HappyHorse 1.1 берёт до 9 картинок и снимает 3–15 секунд в 720p или 1080p. PixVerse C1 умеет и референсы, и переход между первым и последним кадром, звук добавляет по желанию, разрешение от 360p до 1080p. Flux 3 Video собирает ролик на 5–20 секунд из 1–10 картинок: сначала можно сделать дешёвый черновик, а удачный потом довести до HD или FHD.

Для особых задач

В Pika 2.2 режим Scenes собирает сцену из 2–5 картинок (точно или свободнее), а Pikaframes делает переходы между ключевыми кадрами, до 25 секунд. Vidu One-Click V2 MV превращает 1–3 фото и музыку в клип с движением камеры и субтитрами. Vidu Q3 Drama работает от сценария до 5000 знаков и ассетов: персонажей, мест и предметов, до 14 штук. Vidu Q3 Ad снимает рекламный ролик на 3–16 секунд по 1–7 фото товара, со звуком.

Таблица: сколько файлов и какой длины ролик

В таблице лидеры и заметные нейросети категории, остальные видны карточками выше. Цена указана за самые дешёвые настройки.

НейросетьЦенаРеференсыДлина роликаЧем выделяется
Seedance 2.5от 8 ₽/сек.до 30 картинок, 10 видео, 10 аудио4–30 собразец движения, наезд до крупного плана
Grok Videoот 2 ₽/секдо 7 картинок6–30 ссамая дешёвая из лидеров
Wan 3.0 Video Primeот 9 ₽/сек.до 10 картинок, 5 видео, 5 аудио2–30 сточнее всех перенесла место
Wan 3.0 Videoот 5 ₽/сек.до 10 картинок, 5 видео, 5 аудио2–30 сте же лимиты, дешевле Prime
Kling 3.0от 11 ₽/сек.до 7 картинок3–15 снесколько планов, 4K; русская речь неразборчива
Gemini Omniот 60 ₽до 7 файлов и персонажей4–10 сдвое людей в кадре, лицо близко к фото
Gemini Omni 1.1от 48 ₽до 7 файлов и персонажей4–10 сновее и дешевле Omni
Seedance 2.0 Miniот 5 ₽/сек.до 9 картинок, 3 видео, 3 аудио4–15 сдёшево, без звука
Seedance 2.0от 5 ₽/сек.до 9 картинок5, 10 или 15 справка готового ролика

Что выбрать под задачу

  • Если нужен один герой в серии роликов и речь по-русски, берите Seedance 2.5 или Gemini Omni: лицо у них ближе всего к фото.
  • Если важнее всего место или товар, начните с Wan 3.0 Video Prime, а ради цены переходите на Wan 3.0 Video с той же формой.
  • Чтобы герой повторил движение или ход камеры из готового ролика, подойдёт Seedance 2.5 с видео-референсом.
  • Длинный ролик за небольшие деньги даст Grok Video: до 30 секунд одним куском.
  • Несколько планов в одном ролике или 4K умеет Kling 3.0, но голос по-русски лучше накладывать отдельно.
  • Двоих или троих людей в кадре лучше отдать Gemini Omni.
  • Для рекламы по готовым фото товара есть Vidu Q3 Ad, а для картинки в 2K — MiniMax H3.
  • Клип из фотографий под музыку соберёт Vidu One-Click V2 MV.

Каким должен быть референс

  • Одна вещь на файл: героиня отдельно, товар отдельно, место отдельно. Так проще и назвать каждую в задании.
  • Лист персонажа (одна картинка, где герой нарисован в нескольких позах и ракурсах) хорош для картинок, но в видео может навредить: когда мы готовили другую статью, Kling 3.0 по такому листу поставила в кадр сразу нескольких одинаковых героев. Для видео лучше одно чёткое фото.
  • Лицо крупно, свет ровный, фон простой: чем меньше деталей лица видно на фото, тем больше нейросеть дорисовывает сама.
  • Назовите в задании роль каждого файла: «героиня с @image1», «банка с @image2». Если не уточнить, из картинки может перейти лишнее, например фон с фото героя.
  • Текст не должен спорить с картинкой. Если на фото рубашка в полоску, не пишите «в белой футболке»: какая-то из подсказок проиграет.
  • Видео-референс берите не меньше 480p, лучше 720p, и обрежьте до нужного движения. В Seedance 2.5 и MiniMax H3 его секунды входят в цену.

Вопросы

Как придумать героев и снять с ними несколько серий, мы разобрали в инструкции «Сериал с помощью нейросети», а рекламный ролик по шагам — в статье о рекламном видео. Если нужно перенести движение из готового ролика на другого героя или заменить человека в видео, загляните в раздел «Видео из видео».

Статья обновлена 25 сентября 2026 г.

· от 11 ₽/сек.

Gemini Omni · 6 с, 720p · от 60 ₽

MiniMax H3
от 6 ₽/сек.
до 8 картинок, 4 видео, 4 аудио
5–15 с
сразу 2K
HappyHorse 1.1от 18 ₽/сек.до 9 картинок3–15 с1080p
Wan 2.7 Videoот 90 ₽1 картинка и до 4 видео2–10 справка и продление ролика
Flux 3 Videoот 8 ₽/сек.1–10 картинок5–20 счерновик, потом HD или FHD
Vidu Q3 Drama14 ₽/сек.до 14 ассетов2–30 сролик по сценарию
Vidu Q3 Adот 22,5 ₽/сек.1–7 фото товара3–16 среклама со звуком