ББратуха
НейросетиСценарииГалереяПомощь
Войти
НейросетиСценарииГалереяПомощь
Братуха

Все нейросети в одном месте и по самым низким ценам.

Разделы

  • Нейросети
  • Чат с нейросетями
  • Сценарии
  • Галерея
  • Промпты

Популярное

  • GPT Image 2
  • Nano Banana Pro
  • Seedream 5.0 Pro
  • Nano Banana 2 Lite
  • Grok Video
  • Nano Banana 2

Помощь

  • Контакты
  • Как пользоваться
  • Инструкции
  • Новости
  • API
  • Для ИИ-агентов
  • Для бизнеса

Компания

  • О нас
  • Мы помогаем
  • Блог
  • Реферальная программа
  • Пользовательское соглашение
  • Политика конфиденциальности
  • Политика обработки в отношении файлов cookie
  • Согласие на обработку персональных данных
  • Согласие на отправку уведомлений рекламно-информационного характера

© 2026 Братуха.ру

257 нейросетей

Зарубежные нейросети по разработчикам

Как выбрать
Загружаем фильтры...
Пример работы нейросети Seedance 2.5

Seedance 2.5

Цена: от 8 ₽/сек.
Видео из текста
Видео из изображений
Редактирование видео
Видео по референсам
Видео-переход между кадрами
Видео из текста
Видео из изображений
Редактирование видео
Видео по референсам
Видео-переход между кадрами

Seedance 2.5 — нейросеть ByteDance для видео со звуком: создаёт ролик до 30 секунд из текста, фото или набора образцов и переделывает готовое видео словами. Название читают «сиданс».

Пример работы нейросети Seedream 5.0 Pro

Seedream 5.0 Pro

Цена: от 5 ₽
Создание изображений
Редактирование изображений
Создание изображений
Редактирование изображений

Seedream 5.0 Pro — нейросеть ByteDance, которая рисует картинки по описанию и правит загруженные фото. У неё есть то, чего почти нет у соседей: она раскладывает готовую картинку на слои, меняет место, отмеченное точкой или рамкой, и делает PNG с прозрачным фоном.

Пример работы нейросети GPT Image 2.5

GPT Image 2.5

Цена: от 2 ₽
Создание изображений
Редактирование изображений
Создание изображений
Редактирование изображений

GPT Image 2.5 — нейросеть OpenAI, которая рисует картинки по описанию и правит загруженные фото словами. Она чисто пишет русский текст, делает прозрачный фон и пропорции до 3:1, а в поле «Модель» можно выбрать быструю Flare или более точную Sunburst.

Пример работы нейросети GPT Image 2

GPT Image 2

Цена: от 2 ₽
Редактирование изображений
Создание изображений
Редактирование изображений
Создание изображений

GPT Image 2 — нейросеть OpenAI, которая рисует картинки по описанию и переделывает загруженные фото по словам. В наших пробах русские надписи на плакатах и инфографике вышли без ошибок даже в самом дешёвом качестве Low. Подойдёт для афиш, открыток и портретов по фото.

Пример работы нейросети Nano Banana Pro

Nano Banana Pro

Цена: от 5 ₽
Редактирование изображений
Создание изображений
Редактирование изображений
Создание изображений

Nano Banana Pro — нейросеть Google, которая рисует картинки по описанию и меняет загруженные фото словами. Она аккуратно пишет на картинке русский текст и отдаёт результат до 4K. Подойдёт для карточек товаров, постеров и портретов по вашему фото.

Пример работы нейросети Nano Banana 2 Lite

Nano Banana 2 Lite

Цена: 1 ₽
Редактирование изображений
Создание изображений
Редактирование изображений
Создание изображений

Nano Banana 2 Lite — нейросеть Google, самая быстрая и дешёвая из версий Nano Banana на сайте: рисует картинки по описанию и меняет загруженные фото словами. Её берут для черновиков, стикеров и простой правки товара, когда хватает размера 1K: 1000–1600 пикселей по длинной стороне.

Пример работы нейросети Grok Video

Grok Video

Цена: от 2 ₽/сек
Видео из текста
Видео из изображений
Видео по референсам
Видео из текста
Видео из изображений
Видео по референсам

Grok Video — видеонейросеть xAI: снимает ролики со звуком по описанию или оживляет картинки, до семи на один ролик. Длина ролика от 6 до 30 секунд. Секунда видео у неё одна из самых дешёвых на сайте, поэтому здесь удобно проверять идеи и делать ролики для соцсетей.

Пример работы нейросети Nano Banana 2

Nano Banana 2

Цена: от 4 ₽
Редактирование изображений
Создание изображений
Редактирование изображений
Создание изображений

Nano Banana 2 — нейросеть Google, которая создаёт картинки по описанию и правит загруженные фото словами. Она работает быстрее Nano Banana Pro, пишет по-русски прямо на изображении, переводит надписи с других языков и держит одного героя в целой серии.

Пример работы нейросети Seedream 4.5

Seedream 4.5

Цена: 5 ₽
Редактирование изображений
Создание изображений
Редактирование изображений
Создание изображений

Seedream 4.5 — нейросеть ByteDance, которая рисует картинки по описанию и правит загруженные фото. Она отдаёт 4K по той же цене, что и 2K, и аккуратно пишет по-русски, поэтому её берут для меню, афиш, этикеток и картинок под печать.

Пример работы нейросети Nano Banana

Nano Banana

Цена: от 1 ₽
Редактирование изображений
Создание изображений
Редактирование изображений
Создание изображений

Nano Banana — первая модель Google в одноимённом семействе: рисует картинки по описанию и меняет загруженные фото словами. В Дешёвом режиме стоит столько же, сколько 2 Lite. Подойдёт, чтобы раскрасить старый снимок, переодеть питомца или сделать объявление и карточку рецепта с русским текстом.

Пример работы нейросети Grok Video 1.5

Grok Video 1.5

Цена: от 2 ₽/сек
Видео из изображений
Видео из изображений

Grok Video 1.5 — видеонейросеть xAI, которая оживляет картинки: по одной или нескольким картинкам и описанию снимает ролик от 1 до 15 секунд со звуком, а герои в нём говорят по-русски. У разработчика она называется Grok Imagine 1.5.

Пример работы нейросети Suno

Suno

Цена: 10 ₽ за 2 трека
Музыка
Музыка

Suno — нейросеть для создания песен на русском: по одной фразе сочиняет и слова, и музыку, а по вашим стихам поёт в заданном стиле. За один запуск приходят два разных трека.

  • Grok Image — Grok Image — нейросеть компании xAI, которая рисует картинки по описанию и правит загруженные фото словами. По тексту она присылает сразу два варианта, а при точной правке меняет только то, что вы назвали. Подойдёт для фото еды и товаров, иллюстраций к постам и быстрых правок снимков.
  • GPT Image 1.5 — GPT Image 1.5 — нейросеть OpenAI, которая рисует картинки по описанию и правит загруженные фото словами, оставляя остальное как было. Пишет на картинке русский текст, даже мелкий. В форме всего две настройки: пропорции и качество.
  • Seedance 1.5 Pro — Seedance 1.5 Pro — нейросеть ByteDance для коротких роликов со звуком: видео на 4, 8 или 12 секунд по описанию или по одной-двум картинкам. В ней удобно перебирать идеи и снимать короткие сцены для соцсетей, а двумя картинками задавать первый и последний кадр.
  • Wan 2.7 Image — Wan 2.7 Image — нейросеть Alibaba, которая рисует картинки по описанию и меняет загруженные фото словами или по рамке. Она собирает сцену из нескольких снимков, выдаёт серию до 12 картинок в одном стиле и может брать цвета из заданной палитры.
  • Grok Image Pro — Grok Image Pro — нейросеть xAI из линейки Grok Imagine, которая рисует картинки по описанию и меняет загруженные снимки словами. Это режим качества линейки: картинка до 2K, ровные русские надписи и до трёх файлов на входе. Подойдёт для открыток, баннеров и предметных сцен.
  • Wan 3.0 Video Prime — Wan 3.0 Video Prime — ускоренная версия видеонейросети Alibaba Wan 3.0: ролик от 2 до 30 секунд со звуком из текста, кадров, образцов, документа или ссылки на страницу. Режимы и поля те же, что у обычной Wan 3.0, а готовое видео приходит быстрее.
  • Wan 2.6 Image — Wan 2.6 Image — нейросеть Alibaba для картинок по описанию и правки фото словами: переодеть человека, сменить фон или поверхность под товаром. Лицо, позу и сам предмет она почти не трогает, а вторая картинка на входе может задать стиль.
  • Midjourney — Midjourney — нейросеть американской лаборатории Midjourney, которая рисует картинки по описанию, смешивает ваши изображения и делает узоры без стыков. За один запуск приходят четыре варианта, а ползунки стилизации и разнообразия решают, насколько смело она отойдёт от задания.
  • Runway 4 Turbo — Runway 4 Turbo — нейросеть Runway для коротких роликов без звука: оживляет фото или рисунок и снимает сцену по описанию, 5 или 10 секунд. Задание можно писать по-русски, а готовый ролик — продлить.
  • Wan 2.2 Ultra Fast — Wan 2.2 Ultra Fast — нейросеть Alibaba из линейки Wan 2.2: делает ролик на 5 или 8 секунд без звука из описания или картинки, умеет довести видео до заданного конечного кадра. Удобна для черновиков: в 480p ролик готов быстро, и можно перебрать несколько вариантов промпта до финальной съёмки.
  • Gemini 3.1 Flash TTS — Gemini 3.1 Flash TTS — нейросеть Google для озвучки текста: читает его одним из 30 голосов или разыгрывает диалог двух собеседников. Тон, темп и настроение задают обычными словами, а вздох, смех и шёпот — метками прямо в тексте. Русский язык в форме выбран заранее.
  • Wan 2.7 Video — Wan 2.7 Video — нейросеть Alibaba для коротких роликов до 15 секунд: снимает видео по описанию, фото и роликам-образцам, а ещё правит и продлевает готовое видео. Пригодится, когда ролик нужен под свою озвучку или снятое надо переделать, а не снимать заново.
  • Kling 2.1 — Kling 2.1 — нейросеть Kuaishou, которая оживляет картинку в ролик на 5 или 10 секунд, а в модели «Мастер» снимает видео и по текстовому описанию. В форме три модели: «Стандарт» для черновиков в 720p, «Про» с конечным кадром и 1080p, «Мастер» для видео из текста.
  • Seedream 5.0 Lite — Seedream 5.0 Lite — нейросеть ByteDance, которая рисует картинки по описанию и правит загруженные фото, а перед работой обдумывает задание. Она принимает до 14 картинок-образцов и отдаёт результат в 2K или 3K. Подойдёт для иллюстраций, пошаговых схем и серий с одним героем.
  • Kling 2.5 Turbo Pro — Kling 2.5 Turbo Pro — нейросеть Kuaishou для коротких видео: делает ролик 1080p на 5 или 10 секунд по описанию или оживляет картинку. Умеет привести видео к заданному конечному кадру, понимает негативный промпт и обходится дешевле Kling 3.0.
  • Wan 3.0 Video — Wan 3.0 — нейросеть Alibaba, которая снимает видео со звуком длиной от 2 до 30 секунд: из текста, по фото, между двумя кадрами, по картинкам-образцам и даже по PDF, презентации или ссылке на статью. Подойдёт для длинной сцены с репликами по-русски и обучающего ролика по готовому документу.
  • Gemini Omni — Gemini Omni — видеонейросеть Google: снимает ролик со звуком до 10 секунд по описанию, картинкам или сохранённому персонажу и переделывает загруженное видео по просьбе словами. У Google эта модель называется Gemini Omni Flash, а название читают «джемини омни».
  • Flux 2 — Flux 2 — нейросеть Black Forest Labs, которая рисует картинки по описанию и меняет загруженные фото словами. Она собирает сцену из нескольких образцов, до восьми за раз, а в разрешении 2K в наших пробах писала русские надписи без ошибок. Подойдёт для афиш, иллюстраций и снимков товара на человеке.
  • Kling Image O3 — Kling Image O3 — нейросеть Kuaishou, которая рисует картинки по описанию и переделывает загруженные фото. По нашему сопоставлению, у разработчика это IMAGE 3.0 Omni. За один запуск выходит до 10 вариантов в 1K, 2K или 4K, а товар или героя с фото она бережно переносит в новую сцену.
  • Midjourney 8 — Midjourney 8 (V8) — нейросеть лаборатории Midjourney, которая рисует картинки по описанию, по четыре варианта за запуск. Форма короткая: задание, одна картинка-образец, пропорции, три ползунка и список запретов, без выбора версий и скорости.
  • Seedream 4.0 — Seedream 4.0 — нейросеть ByteDance для картинок по описанию и правки загруженных фото. Её главная особенность: до 15 картинок за один запуск, поэтому в ней удобно делать серии кадров с одним героем, наборы фото товара и варианты одной идеи на выбор.
  • PixVerse 6.0 — PixVerse 6.0 — нейросеть для коротких роликов от 1 до 15 секунд: оживляет фото, снимает видео по описанию, строит переход между двумя кадрами и продлевает готовое видео. Звук и голос за кадром создаёт вместе с картинкой, задание понимает по-русски.
  • Qwen Image 3.0 — Qwen Image 3.0 — нейросеть Alibaba, которая рисует картинки по описанию и правит загруженные фото, до трёх за раз. Она рассчитана на длинные задания и плотную вёрстку: меню, открытки, афиши. За один запуск можно получить до шести вариантов и выбрать лучший.
  • Seedance 1.0 — Seedance 1.0 — первая видеонейросеть ByteDance из линейки Seedance: делает беззвучный ролик на 5 или 10 секунд из фото или описания, вплоть до 1080p. Внутри три модели: Lite для проб и перехода к конечному кадру, Pro для финального ролика и Pro Fast для роликов из фото.
  • Meta Muse Image — Meta Muse Image — нейросеть для картинок по описанию и правки фото словами. Она точно держит задание: нужное число предметов, русские надписи на этикетке, одного и того же персонажа в разных сценах. До 10 картинок можно свести в одну, например героя и товар.
  • Kling 3.0 — Kling 3.0 — нейросеть Kuaishou, которая делает видео до 15 секунд из текста, картинки или набора референсов и перерисовывает готовые ролики. Её главная сила — сцены: в одном ролике можно задать несколько планов со своей длиной и сохранить героя по фото.
  • Kling 2.6 Motion Control — Kling 2.6 Motion Control — нейросеть Kuaishou, которая переносит движение из короткого ролика на персонажа с картинки: герой повторяет походку, танец или жест. Ролик-образец можно снять самому, а героем сделать мультперсонажа, зверя или себя.
  • Gemini Omni 1.1 — Gemini Omni 1.1 Flash — видеонейросеть Google, вторая модель Omni: снимает ролики до 10 секунд со звуком и русской речью по тексту, картинкам и вашему видео. Помнит сохранённых героев и голоса, а для быстрых проб умеет 360p.
  • Topaz Image Upscale — Topaz Image Upscale — нейросеть Topaz Labs, которая увеличивает фото и картинки в 2 или 4 раза. На выбор четыре типа улучшения и 18 моделей Topaz AI: одни бережно держатся за исходник, другие дорисовывают детали, а отдельный тип сохраняет прозрачный фон логотипа.
  • Seedance 2.0 Mini — Seedance 2.0 Mini — облегчённая нейросеть ByteDance для коротких роликов без звука: снимает видео от 4 до 15 секунд из текста, из картинки или по набору референсов в 480p или 720p. Удобна, чтобы недорого перебрать варианты сцены до финального запуска.
  • SeedVR2 Image Upscaler — SeedVR2 Image Upscaler — нейросеть ByteDance, которая увеличивает картинку до 2K, 4K или 8K и заодно чистит её от шума и квадратиков сжатия. Подойдёт для старого снимка, пережатой картинки из переписки и иллюстрации, которую нужно напечатать крупно. Задание писать не нужно.
  • ElevenLabs Eleven v3 — ElevenLabs Eleven v3 — нейросеть ElevenLabs для озвучки текста живыми голосами: читает русский текст с интонацией и играет эмоции по тегам — шёпот, смех, крик. Её берут для рекламы, роликов и реплик персонажей, где ровного дикторского чтения мало.
  • Qwen Image 2.1 — Qwen Image 2.1 — нейросеть Alibaba, которая рисует предметы на прозрачном фоне и меняет на фото только закрашенное место, не трогая остальное. Ещё она создаёт картинки по описанию на русском и собирает одну сцену из нескольких снимков, до десяти за раз.
  • ElevenLabs Eleven v4 — ElevenLabs Eleven v4 — модель озвучки текста, которую ElevenLabs выпустила в сентябре 2026 года. Читает русский и ещё 35 языков из списка, а теги в квадратных скобках меняют подачу и добавляют в речь звуки окружения, например хлопок двери.
  • Grok Image 2.0 — Grok Image 2.0 — нейросеть xAI, которая рисует картинки по текстовому описанию. Русские надписи она пишет аккуратно, даже в несколько строк мелким шрифтом, и за один запуск может прислать до 12 вариантов. Подойдёт для афиш, меню, карточек товаров, обложек и открыток.
  • Wan 2.2 — Wan 2.2 — нейросеть Alibaba, которая оживляет картинку: по фото или рисунку и короткому описанию движения снимает ролик на 5 или 8 секунд без звука. Берите её, когда кадр уже готов и важно сохранить его цвета, лица и стиль, а ещё для плавного перехода ко второй картинке.
  • Topaz Video — Topaz Video — нейросеть Topaz Labs, которая помогает улучшить качество видео онлайн: поднимает ролик до 720p, 1080p или 4K, убирает мыло и квадратики сжатия и по желанию делает движение плавнее, до 60 кадров в секунду. Программу ставить не нужно.
  • ByteDance Video Upscaler — ByteDance Video Upscaler увеличивает видео до 1080p, 2K или 4K и аккуратно подтягивает резкость, почти ничего не выдумывая. Подойдёт, чтобы улучшить качество видео нейросетью, когда исходник чистый, но мелкий: клип в 360p или 480p, запись экрана с мелким текстом.
  • Lyria 3 Pro — Lyria 3 Pro — нейросеть Google DeepMind, которая пишет музыку по описанию: песню на ваши стихи или с текстом, который сочинит сама, инструментал, фон для ролика и даже трек по картинке. Ход трека можно расписать по секундам, а поёт она и по-русски.
  • Topaz Image — Topaz Image — нейросеть Topaz Labs, которая чинит фото без увеличения: убирает пыль и царапины, смаз и шум, осветляет тёмные кадры, исправляет желтизну и раскрашивает чёрно-белые снимки. Нужно выбрать, что не так с фото, и загрузить его.
  • Recraft V4.1 — Recraft V4.1 — нейросеть компании Recraft, которая рисует по описанию обычные картинки и настоящий вектор SVG. Её берут для иконок, афиш, обложек и снимков товара: русские надписи в наших пробах вышли без ошибок, а режим Utility снимает предмет спокойно и по центру, как для каталога.
  • MiniMax Music 3.0 — MiniMax Music 3.0 — нейросеть китайской компании MiniMax, которая поёт ваш текст песни с аранжировкой. Звучание описывают в одном поле, слова в другом, а пометки в квадратных скобках задают куплеты, припевы и проигрыши.
  • xAI TTS v1 — xAI TTS v1 — озвучка Grok: нейросеть xAI, создателей чат-бота Grok, читает текст одним из 28 голосов, а шёпот, смех, вздох, паузу и даже пение задают короткие теги прямо в тексте. Русский и ещё 15 языков, до 15 000 символов за раз — хватит и на объявление, и на главу рассказа.
  • ElevenLabs Eleven v4 Turbo — ElevenLabs Eleven v4 Turbo — быстрая версия модели озвучки Eleven v4. Поля и теги у неё те же: 22 голоса, выбор языка, эмоции и звуки в квадратных скобках. ElevenLabs делала её для голосовых ассистентов, а на сайте она подойдёт для уведомлений, аудиогидов и уроков.
  • ElevenLabs Sound Effect V2 — ElevenLabs Sound Effect V2 — нейросеть для звуковых эффектов: по короткому описанию на английском делает шаги, удары, «вжухи» и фоновые шумы длиной от полсекунды до 22 секунд. Её берут, когда звук нужен точно под длину кадра, а фон должен крутиться петлёй без щелчка на стыке.
  • MiniMax Speech 2.8 — MiniMax Speech 2.8 — нейросеть MiniMax для озвучки текста взрослыми и детскими голосами, с выбором эмоции и клоном своего голоса. Смех, вздох и паузу можно вписать прямо в текст, а модель HD или более быструю Turbo выбирают под задачу.
  • Vidu Q2 Pro — Vidu Q2 Pro — нейросеть ShengShu Technology, которая оживляет фото: из одной картинки делает ролик от 1 до 10 секунд, а со второй картинкой ведёт сцену к нужному конечному кадру. В нашей пробе с портретом она сохранила черты лица и передала смену эмоций.
  • Hailuo 2.3 — Hailuo 2.3 — видеонейросеть MiniMax, которая оживляет одну картинку в ролик на 6 или 10 секунд: человек улыбается и танцует, рисунок двигается, оставаясь рисунком. Она новее Hailuo 02 и в нашем сравнении точнее держала стиль рисунка, но снимает только из изображения.
  • Hailuo 02 — Hailuo 02 — видеонейросеть MiniMax: оживляет картинку в ролик на 6 или 10 секунд, снимает сцену по текстовому описанию, а с конечным кадром ведёт её от одного изображения к другому. Звука в роликах нет, задание можно писать по-русски.
  • Seedance 2.0 — Seedance 2.0 — нейросеть ByteDance для видео до 15 секунд: снимает ролик по описанию, по фото, по первому и конечному кадру или по набору референсов и переделывает готовое видео. Для снимков с лицами людей в форме есть модели Face.
  • Wan 2.1 MoCha — Wan 2.1 MoCha — нейросеть, которая меняет человека в готовом ролике на персонажа с картинки: другого человека, мультяшного героя или зверя. Движения, мимика, фон, свет и звук остаются из исходника. Подойдёт, чтобы заменить персонажа в видео без пересъёмки.
  • SeedVR2 Video Upscaler — SeedVR2 Video Upscaler — нейросеть ByteDance, которая восстанавливает испорченное видео: убирает шум, муть и квадратики сжатия и заново прорисовывает детали. Поможет увеличить разрешение видео до 720p, 1080p, 2K или 4K, если запись старая или сильно пережата.
  • Recraft Crisp Upscale — Recraft Crisp Upscale — нейросеть Recraft для чёткого апскейла: увеличивает картинку примерно до 4 мегапикселей, убирает мыло и квадратики сжатия и почти ничего не меняет в сюжете. Настроек нет, только файл. Подойдёт для логотипов, иллюстраций, скриншотов и фото для экрана.
  • Clarity AI Crystal Upscaler — Clarity AI Crystal Upscaler — нейросеть для апскейла фото: увеличивает снимок до заданного размера, от 1 до 200 мегапикселей, и дорисовывает мелкие детали. Её делали для портретов и снимков товаров, поэтому она держится за исходник, а смелость дорисовки задаёт ползунок «Креативность».
  • Flux Kontext — Flux Kontext — нейросеть Black Forest Labs, которая меняет готовую картинку по короткой команде: убрать предмет, сменить фон или время года, надеть очки, перерисовать акварелью. Остальной кадр она старается не трогать, поэтому снимок удобно доводить правками по одной, шаг за шагом.
  • Kling 3.0 Motion Control — Kling 3.0 Motion Control — нейросеть Kuaishou, которая переносит движение из короткого видео на героя с картинки: он машет, танцует или кланяется так же, как человек в ролике. Подойдёт, чтобы оживить мультперсонажа, маскота или рисунок по готовому образцу движения.
  • Qwen Image Max — Qwen Image Max — нейросеть Alibaba для фотореалистичных картинок: портретов, предметных фото, сцен из нескольких снимков. Её берут ради живой кожи, ткани и света, а загруженные фото, до шести за раз, она правит по описанию. Надписи по-русски ей даются плохо.
  • Замена одежды (Google) — Замена одежды (Google) — нейросеть, чтобы примерить одежду онлайн по двум снимкам: фото человека и фото вещи. Она надевает платье, рубашку, брюки или целый образ, а лицо, поза и фон остаются прежними. Пригодится покупателю перед заказом и продавцу маркетплейса для фото на модели.
  • Gemini 2.5 Flash TTS — Gemini 2.5 Flash TTS — нейросеть Google для озвучки текста: читает его одним из 30 голосов или разыгрывает диалог двух собеседников. За один запуск берёт до 4000 знаков, около пяти с половиной минут речи, а язык произношения выбирают из 24 вариантов.
  • Gemini 3.8 Flash Lite TTS — Gemini 3.8 Flash Lite TTS — облегчённая модель озвучки от Google: читает текст одним из 30 голосов или разыгрывает диалог двух собеседников. Форма и голоса у неё те же, что у полной версии 3.8, а сама Lite рассчитана на поток однотипной озвучки: объявления, напоминания, уроки.
  • Qwen Image 2.0 — Qwen Image 2.0 — нейросеть Alibaba для картинок точного размера: вы задаёте ширину и высоту в пикселях, а она рисует по описанию или переделывает загруженное фото. Подходит для баннеров и обложек нестандартного формата. Надписи на русском аккуратнее выходят в версии Pro.
  • MiniMax H3 — MiniMax H3 — видеонейросеть компании MiniMax: снимает ролик со звуком из описания, из картинки или по образцам — фото, видео и аудио. Две модели: H3 в 768P и 2K и H3 Max в 480p–1080p, длина от 5 до 15 секунд; русскую речь и надписи из задания в наших пробах передала без ошибок.
  • PixVerse Lipsync — PixVerse Lipsync — нейросеть, которая переозвучивает готовое видео: вы загружаете ролик с человеком и новую запись голоса, а губы в кадре начинают двигаться под неё. Настроек нет, готовый ролик выходит длиной с запись. Подходит для влогов, перевода и замены неудачной фразы.
  • MiniMax Speech 2.5 — MiniMax Speech 2.5 — нейросеть MiniMax для озвучки текста и клона голоса: 34 готовых голоса, семь эмоций и 40 языков в списке. Тегов смеха и вздохов у этой версии нет, зато она спокойно читает длинный ровный текст: аудиогид, урок, объявление.
  • SAM 3D — SAM 3D — нейросеть, которая делает 3D-модель человека по фото: фигуру в той же позе, но без одежды и с обобщённым лицом. Второй режим вырезает из снимка предмет по слову или маске и достраивает его со всех сторон, с цветом. Пригодится для набросков поз, макетов и заготовок для игр.
  • ByteDance Seed Speech TTS 2.0 — ByteDance Seed Speech TTS 2.0 — нейросеть для озвучки текста на английском, китайском и ещё восьми языках, русского у неё нет. Голосов 40, а тон, темп и громкость описывают словами в отдельном поле. Подойдёт для роликов, уроков и презентаций на иностранном языке.
  • Gemini 3.8 Flash TTS — Gemini 3.8 Flash TTS — нейросеть Google для озвучки текста: читает до 5000 символов одним из 30 голосов или собирает диалог двух собеседников из отдельных реплик, и у каждой реплики может быть своя манера. Смех и вздох ставятся тегами прямо в тексте, а язык модель определяет сама.
  • PixVerse 5.6 — PixVerse 5.6 — нейросеть китайской компании AIsphere для коротких роликов: оживляет картинку и строит переход между двумя кадрами, по желанию со звуком. Ролик выходит ровно на 5, 8 или 10 секунд, а задание можно писать по-русски.
  • Heygen 720p — Heygen 720p — нейросеть HeyGen, которая оживляет фото под вашу запись голоса длиной до минуты и выдаёт ролик 720p. Настроек нет, только снимок и звук, а герой в наших пробах держался спокойно и почти без жестов.
  • LTX 2.3 — LTX 2.3 — нейросеть Lightricks для видео со звуком: снимает ролик по описанию или картинке, оживляет портрет под запись голоса, дописывает готовое видео и переснимает в нём отдельный кусок. Её берут, когда нужен длинный дубль до 20 секунд, 4K или правка без пересъёмки всего ролика.
  • Wan 2.6 Flash — Wan 2.6 Flash — быстрая версия видеомодели Wan 2.6 от Alibaba: оживляет картинку на 2–15 секунд или собирает ролик по пяти референсам, со звуком или без. Подойдёт, когда нужен короткий ролик точной длины или несколько планов в одном видео.
  • Kling 2.6 — Kling 2.6 — нейросеть Kuaishou для коротких роликов на 5 или 10 секунд: снимает сцену по описанию или оживляет картинку. С неё в линейке Kling появился звук: включите переключатель, и шумы, фон и голоса создадутся вместе с картинкой.
  • Krea 2 — Krea 2 — нейросеть компании Krea, которая рисует картинки по текстовому описанию. Её сильная сторона — стиль: плёночное фото, гравюра, аниме, старый плакат. Модель Medium подходит для иллюстраций и проб, Large — для фотореализма, а «Креативность» решает, насколько вольно читать задание.
  • Seedream 5.0 Flash — Seedream 5.0 Flash — быстрая версия нейросети ByteDance для картинок: рисует по описанию, правит фото по отметке, раскладывает готовую картинку на слои и делает PNG с прозрачным фоном. Подойдёт для черновиков, серий вариантов и правки одной детали на фото.
  • Qwen 2511 Multiple Angles — Qwen 2511 Multiple Angles — нейросеть, которая по одному снимку показывает тот же предмет с другой стороны: сбоку, сзади или сверху. Камеру поворачивают на схеме или ползунками, задание писать не обязательно. Помогает изменить ракурс фото для карточки товара, когда снимок всего один.
  • Kling Video-to-Audio — Kling Video-to-Audio — нейросеть Kuaishou, которая смотрит на ролик до 20 секунд и сочиняет к нему звук: рёв мотора, плеск, шорох бумаги, грохот. Выручает, когда нужно наложить звук на видео нейросетью: ролик немой или родная дорожка не нравится. Для мелких звуков есть ASMR‑режим.
  • MiniMax Speech 2.6 — MiniMax Speech 2.6 — нейросеть MiniMax для озвучки текста, которую готовили для голосовых помощников и сообщений с телефонами, почтой и суммами. По-русски в наших пробах верно вышел только телефон в модели HD, остальное надёжнее писать словами. Голоса, эмоции, 40 языков и клон — как у 2.5 и 2.8.
  • ElevenLabs Audio Isolation — ElevenLabs Audio Isolation — нейросеть, которая помогает убрать шум из видео или аудиозаписи и оставить только голос: без гула, машин за окном, музыки и чужих разговоров. Пригодится, когда голосовое записано на улице, интервью в кафе, а ролик снят на телефон.
  • Fibo 1.5 — Fibo 1.5 — нейросеть Bria AI, которая рисует картинки по подробному описанию и правит загруженные, принимая до четырёх на входе. По маске она меняет только закрашенный участок. Длинное задание про свет, ракурс и расположение предметов модель держит хорошо, а надписи у нас вышли только латиницей.
  • Ideogram V4 — Ideogram V4 — нейросеть канадской компании Ideogram: рисует картинки по описанию и вписывает в них надписи, от заголовка афиши до названия на этикетке. Версия 4.0 рисует только квадрат; английские слова в наших пробах без ошибок, но строки она нередко ставит вертикально, и английские тоже.
  • Recraft V4 — Recraft V4 — нейросеть лондонской компании Recraft: по текстовому описанию она рисует обычные картинки и настоящий вектор SVG. Её берут для упаковки, баннеров, логотипов и иконок, где надпись должна встать на своё место в макете и быть написана по-русски без ошибок.
  • Clarity AI Flux Upscaler — Clarity AI Flux Upscaler увеличивает рисунки, иллюстрации и картинки из нейросетей до 64 мегапикселей и перерисовывает их начисто: контуры становятся чёткими, мелочи прорисованы. Насколько смело модель фантазирует, решает ползунок «Креативность»: от бережного увеличения до картинки по мотивам.
  • Luma UNI V1 — Luma UNI V1 — нейросеть Luma AI, которая рисует картинки по описанию и правит готовые по заданию. Она переносит персонажа и стиль с картинок-образцов в новую сцену и пишет русские надписи, поэтому подходит для афиш, серий иллюстраций и комиксов с одним героем.
  • Luma 3.2 — Luma 3.2 — видеонейросеть американской Luma AI на модели Luma Ray 3.2. Она снимает ролик по описанию или из картинки, правит готовое видео текстом и переводит его в другой формат кадра, дорисовывая края. Четыре режима в одной форме, до 1080p, задания понимает на русском.
  • Veo 3.1 — Veo 3.1 — нейросеть Google для видео со звуком: снимает восьмисекундный ролик по описанию, по картинке, по референсам или между двумя заданными кадрами, и герои в нём говорят по-русски. Модели Lite, Fast и Обычная отличаются ценой и проработкой кадра.
  • Qwen3 TTS — Qwen3 TTS — нейросеть Alibaba для озвучки текста на русском и ещё девяти языках. Она читает одним из 9 готовых голосов, собирает новый голос по словесному описанию или повторяет голос по записи на несколько секунд, и всё это в одной форме.
  • HunyuanVideo-Foley — HunyuanVideo-Foley — нейросеть Tencent, которая озвучивает немое видео: смотрит, что происходит в кадре, и добавляет фоли звуки — шум волн, шаги, скрип, треск пластинки. Задание можно не писать, а если написать, она добавит и звук, которого в кадре нет.
  • Kling LipSync — Kling LipSync — нейросеть Kuaishou, которая подгоняет губы в коротком видео под вашу запись: человек или мультяшный герой в кадре начинает говорить новый текст. Берёт ролики от 2 до 60 секунд, удобна для поздравлений, мемов и перевода коротких фраз.
  • Flux 3 Video — Flux 3 Video — видеонейросеть Black Forest Labs: снимает ролик на 5–20 секунд со звуком по описанию или по 1–10 картинкам. Сначала можно сделать дешёвый черновик, а удачный довести до HD или FHD с тем же сюжетом и движением.
  • Kling 3.0 Turbo — Kling 3.0 Turbo — облегчённая видеомодель Kuaishou: делает ролик от 3 до 15 секунд из текста или одной картинки, и звук в нём есть всегда. Берите её, когда нужен короткий клип с шумами и музыкой без лишних настроек: сцен, референсов и 4K, как в обычной Kling 3.0, здесь нет.
  • Wan 2.2 Animate — Wan 2.2 Animate — нейросеть Alibaba, которая переносит движения и мимику человека из видео на героя с картинки или ставит этого героя вместо человека в готовый ролик. Нужен один кадр с персонажем и видео с движением, рисовать и снимать заново ничего не надо.
  • Ideogram V3 — Ideogram V3 — нейросеть канадской компании Ideogram для картинок с надписями: афиш, баннеров, обложек и упаковки. В отличие от четвёртой версии рисует в пяти пропорциях, до четырёх вариантов за раз и подхватывает стиль с картинок-образцов. Русские строки ставит ровно, но мелкие стоит перечитать.
  • Wan 2.2 Animate 2 — Wan 2.2 Animate 2 — нейросеть Alibaba для анимации персонажа по видео: герой с картинки повторяет позы, жесты и мимику человека из загруженного ролика. Заменять человека в готовой сцене она не умеет, зато внешность героя и фон описываются в отдельном поле, не смешиваясь с движением.
  • Wan 2.2 Avatar — Wan 2.2 Avatar — нейросеть Alibaba, которая оживляет фото с голосом: по снимку и записи речи делает ролик, где человек говорит, моргает и жестикулирует. Жесты и настроение подсказывает поле «Задание», качество — 480p или 720p, запись принимается до 10 минут.
  • ByteDance Seed Audio 1.0 — ByteDance Seed Audio 1.0 — нейросеть для озвучки текста на русском. Голос она подбирает сама, повторяет по вашей записи или придумывает по картинке, поэтому с ней удобно сделать голос персонажа: загрузите портрет героя и вставьте его реплику.
  • Pika 2.2 — Pika 2.2 — нейросеть американской компании Pika Labs для коротких роликов: оживляет фото, снимает видео по описанию, ведёт сюжет через 2–5 ключевых кадров и собирает сцену из нескольких картинок. Ролик приходит без звука, задание можно писать по-русски.
  • Qwen3 TTS Flash — Qwen3 TTS Flash — нейросеть Alibaba для быстрой озвучки текста готовыми голосами. Выбираете один из 17 голосов, вставляете до 2000 символов на русском, английском или другом языке из списка и получаете запись WAV, без настройки тембра и загрузки образцов.
  • Bria Creative Upscale — Bria Creative Upscale — нейросеть Bria AI, которая увеличивает картинку ровно вдвое по каждой стороне и рисует детали заново. В наших пробах лучше всего ей дались логотипы на прозрачном фоне, а фото, мелкий текст и лица она может заметно поменять, поэтому результат стоит сверить с исходником.
  • DreamActor V2 — DreamActor V2 — нейросеть ByteDance, которая заставляет героя с картинки повторить движения, мимику и жесты из вашего видео. Справляется со зверями, рисованными персонажами и сценами, где в кадре сразу двое.
  • Luma Reframe — Luma Reframe — видеонейросеть Luma AI, которая переводит готовый ролик в другой формат и дорисовывает края кадра вместо обрезки. С ней можно расширить видео нейросетью из 16:9 в 9:16 для сторис или, наоборот, сделать вертикальный клип широким для YouTube. Принимает ролики до 30 секунд.
  • Wan 2.5 Video-Extend — Wan 2.5 Video-Extend — нейросеть Alibaba, которая продолжает готовый ролик: смотрит на его последние кадры и досчитывает ещё 3–10 секунд по вашему заданию. К новым секундам можно приложить свою музыку, а исходник вернётся в том же файле, без склейки в редакторе.
  • Wan 2.2 Video Edit — Wan 2.2 Video Edit — нейросеть семейства Wan от Alibaba, которая правит готовый ролик по одному текстовому заданию: поможет заменить одежду на видео, перекрасить вещь или поменять слово на вывеске, а движение и звук оставит прежними. Задание пишется по-русски, исходник — до двух минут.
  • Ideogram V4.5 — Ideogram V4.5 — нейросеть компании Ideogram, которая рисует картинки с надписями по описанию и правит готовые изображения по заданию. Она меняет текст и предметы на картинке, почти не трогая остальное, поэтому подходит для афиш, баннеров, логотипов и их новых версий.
  • Runway Gen4 Image — Runway Gen4 Image — нейросеть компании Runway, которая рисует картинки по описанию и по референсам. Загрузите до трёх картинок с героем, местом или стилем, и модель соберёт из них новую сцену. Это удобно, когда один и тот же персонаж нужен в серии кадров или в первом кадре будущего ролика.
  • Wan 2.1 MultiTalk — Wan 2.1 MultiTalk — нейросеть команды MeiGen-AI, которая делает говорящего персонажа из одного фото и вашей записи: губы, мимика и голова двигаются под речь или песню. В наших пробах она оживила портрет, мультяшного кота и певицу, а поле «Задание» меняло настроение героя.
  • Hunyuan 3D v3.1 — Hunyuan 3D v3.1 — нейросеть Tencent, которая собирает 3D-модель по фото предмета или по описанию. В Pro к фото можно добавить ещё семь снимков с разных сторон, а «Только геометрия» даёт серую форму без цвета, удобную для 3D-печати.
  • Kling AI Avatar 2 — Kling AI Avatar 2 — нейросеть Kuaishou, которая оживляет портрет под вашу запись голоса: губы попадают в речь, человек моргает, улыбается и двигает головой. Ролик может длиться до 5 минут, а морщины и черты лица остаются как на снимке, поэтому её берут, когда герой должен остаться узнаваемым.
  • Wan 2.2 Fun Control — Wan 2.2 Fun Control — нейросеть Alibaba для стилизации видео: она перерисовывает ваш ролик по одному кадру-образцу и оставляет движение, позы и камеру как в исходнике. Так осенняя прогулка становится зимней, а съёмка превращается в аниме или карандашный набросок.
  • Wan 2.6 — Wan 2.6 — нейросеть Alibaba для видео со звуком: снимает ролик на 5, 10 или 15 секунд по описанию, оживляет картинку или переносит героя из вашего видео в новую сцену. Умеет делить ролик на несколько планов со склейками, реплики говорит по-русски.
  • Bytedance LipSync — Bytedance LipSync - нейросеть для липсинка: она берёт ваше видео с лицом и отдельную аудиодорожку, а затем подгоняет движения губ и рта под речь, чтобы совпадали слова и артикуляция.
  • FLUX.2 Pro Outpaint — FLUX.2 Pro Outpaint - нейросеть для расширения изображения за исходные края. Она берёт готовую картинку и достраивает фон, интерьер, небо, предметы и другие детали так, чтобы новая часть выглядела продолжением сцены. Модель относится к семейству FLUX.2 от Black Forest Labs.
  • LTX-2 19B Video Upscaler — LTX-2 19B Video Upscaler — нейросеть Lightricks, которая повышает разрешение видео до 720p, 1080p, 2K или 4K и дорисовывает детали в каждом кадре. Лучше всего она увеличивает ролики из видеонейросетей в 480p, а лица и надписи после неё стоит сверять с исходником.
  • PixVerse 5.5 — PixVerse 5.5 — нейросеть AIsphere для коротких роликов из картинки: оживляет фото, делает переход между двумя кадрами и знает 98 готовых эффектов вроде поцелуя или зума из космоса. Для эффекта хватает одного фото, писать задание не нужно.
  • Recraft Creative Upscale — Recraft Creative Upscale — нейросеть Recraft, которая увеличивает картинку примерно до 17 мегапикселей и дорисовывает то, что потерялось при сжатии: пальцы, пряди, фактуру ткани и плетения. Подходит, чтобы улучшить детализацию фото или картинки из нейросети, когда сходство до пикселя не важно.
  • Wan 2.5 — Wan 2.5 — видеомодель Alibaba, с которой у линейки Wan появился звук: снимает ролик на 5 или 10 секунд по описанию или оживляет картинку, а герои произносят реплики по-русски. Удобна для вертикального или квадратного ролика из одного текста и простой сцены с одной фразой.
  • Luma Modify — Luma Modify - это нейросеть от Luma AI для редактирования видео по инструкции (формат “скажи словами, что поменять”). Вы загружаете ролик до 10 секунд, пишете задание, и модель перерисовывает сцену: может сменить окружение, одежду, материалы, свет и общий стиль, при этом стараясь сохранить движение, мимику и “живую” динамику исходника.
  • Wan 2.2 Turbo — Wan 2.2 Turbo - нейросеть для генерации коротких видео: можно написать текст, что должно происходить в кадре, или взять одно изображение и “оживить” его движением.
  • Wan Motion — Wan Motion — нейросеть из линейки Wan от Alibaba, которая анимирует персонажа с картинки по вашему видео: герой повторяет танец, жесты и повороты человека из ролика. Движение она подгоняет под фигуру героя, поэтому коренастый гном или маскот не вытягивается в длинноногого танцора.
  • Vidu One-Click V2 MV — Vidu One-Click V2 MV - нейросеть для создания видео из фотографий и аудио. Вы загружаете 1-3 изображения, добавляете музыку или голос (одним файлом) и получаете ролик, где картинка “оживает” за счёт плавных движений камеры и смены планов.
  • Bytedance LatentSync — Bytedance LatentSync — открытая модель ByteDance, которая перерисовывает рот человека в готовом видео под новую запись голоса. Звук она не обрезает: если запись длиннее ролика, недостающие кадры дорисует сама. Видео и запись принимает до 10 минут.
  • Kling Voice — Kling Voice - это нейросеть, которая делает “слепок” голоса по короткому фрагменту аудио или видео и превращает его в кастомный голосовой профиль. Дальше такой голос можно использовать для озвучки текста - например, чтобы один и тот же персонаж говорил одинаково в разных роликах.
  • Clarity AI Pro Upscaler — Clarity AI Pro Upscaler - нейросеть для увеличения изображений с дорисовкой деталей. По найденным описаниям это фотореалистичный апскейлер: он не просто растягивает картинку, а старается сделать её более чёткой и детальной, сохраняя общий вид исходника.
  • LTX-2.3 Reframe — LTX-2.3 Reframe - нейросеть для переработки готового видео под другой формат кадра. Она не просто обрезает ролик, а расширяет сцену по краям и генерирует недостающие части изображения, чтобы из горизонтального видео можно было сделать вертикальное, квадратное или наоборот.
  • Lyria 3.5 — Lyria 3.5 — нейросеть Google DeepMind для музыки: пишет песню с вокалом или инструментал около трёх минут по описанию либо поёт ваш текст в выбранном стиле, в том числе по-русски. Темп задаётся числом, текст и стиль — в разных полях.
  • Bria Video Upscaler — Bria Video Upscaler - инструмент компании Bria для увеличения разрешения видео. Он берёт готовый ролик, поднимает его качество вплоть до 8K и сохраняет важные свойства исходника: пропорции кадра, частоту кадров, глубину цвета, звук, а в некоторых форматах ещё и прозрачность.
  • Meshy-6 — Meshy-6 - нейросеть для генерации 3D-моделей: можно загрузить картинку и получить объёмный объект, или описать предмет словами и получить 3D «с нуля». Это удобно, когда нужно быстро набросать модель для игры, печати на 3D-принтере, презентации или визуализации.
  • Runway Aleph 2 — Runway Aleph 2 — нейросеть Runway для правки готового видео по текстовому заданию: меняет свет, погоду, предмет в кадре или стиль ролика, а движение и ракурс берёт из исходника. Чтобы точнее показать нужный вид, к ролику можно добавить до пяти ключевых кадров.
  • Meshy 7.1 — Meshy 7.1 — нейросеть Meshy AI, которая собирает 3D-модель по фото, по 1–4 снимкам предмета или по описанию. Модель приходит лёгким файлом GLB, а с авто-риггингом персонаж получает скелет и готовые движения: ходьбу, бег и ещё одно на выбор.
  • OmniHuman 1.5 — OmniHuman 1.5 — нейросеть ByteDance, которая превращает фото и запись голоса в ролик: человек на снимке говорит или поёт, а мимику и жесты она подбирает по смыслу слов. Настроек нет, всё поведение задаёт звук.
  • Midjourney Video — Midjourney Video — нейросеть лаборатории Midjourney, которая оживляет готовую картинку: из одного кадра получается ролик около 5 секунд без звука. За запуск приходят сразу четыре варианта движения, а рисованный стиль исходника в них сохраняется, поэтому модель удобна для артов и иллюстраций.
  • PixVerse VibeMV — PixVerse VibeMV — нейросеть, которая делает клип из музыки: вы загружаете готовую песню, выбираете стиль и формат кадра, а сцены, героя и смену планов под ритм она придумывает сама. Задание писать не нужно, фото героя и картинка-образец стиля — по желанию.
  • Clarity AI Crystal Video Upscaler — Clarity AI Crystal Video Upscaler - нейросеть для апскейла видео: она повышает разрешение ролика и подтягивает чёткость кадров. Модель относится к линейке Clarity AI, а создатели делают упор на точное улучшение без лишних выдуманных деталей.
  • ElevenLabs Music v2.5 — ElevenLabs Music v2.5 — новая версия Eleven Music, музыкальной нейросети ElevenLabs: песни с вокалом и музыка без слов по текстовому описанию. Длину трека вы задаёте сами, от 3 секунд до 10 минут, а слова песни, в том числе русские, вписываете прямо в задание.
  • Heygen Lipsync V3 — Heygen Lipsync V3 - инструмент HeyGen для замены речи в готовом видео с подстройкой движения губ под новую аудиодорожку. Такой формат нужен, когда ролик уже снят, а текст, язык или озвучку хочется поменять без пересъёмки.
  • Heygen Translate 2 — Heygen Translate 2 - это нейросеть от HeyGen для перевода видео на другие языки: она распознаёт речь, переводит текст, озвучивает на выбранном языке и (если не отключать) подстраивает артикуляцию на лице так, чтобы выглядело похоже на настоящую речь.
  • PixVerse C1 — PixVerse C1 - модель для генерации видео от компании PixVerse. Она делает ролики по текстовому описанию, оживляет одно изображение, собирает сцену по референсам и умеет строить переходы между первым и конечным кадром. Максимум в этой версии - до 15 секунд и до 1080p, а звук можно сгенерировать вместе с видео.
  • Vidu Q3 — Vidu Q3 — нейросеть ShengShu Technology, которая снимает ролик до 16 секунд по описанию или по картинке и сразу его озвучивает: звуки сцены, фоновую музыку и реплики героев модель делает вместе с видео. Подойдёт для коротких сцен с несколькими планами, а реплики героям лучше писать по-английски.
  • Hunyuan World 1.0 — Hunyuan World 1.0 - нейросеть от Tencent, которая берёт вашу картинку и «достраивает» вокруг неё сцену: либо как круговую панораму (360°), либо как 3D‑мир, по которому можно как будто перемещать камеру и смотреть по сторонам.
  • PixVerse Motion Control Mimic — PixVerse Motion Control Mimic - это инструмент PixVerse для переноса движения с одного видео на статичную картинку. Вы загружаете изображение персонажа и референсное видео, а модель собирает новый ролик, в котором герой с картинки повторяет движения из исходного фрагмента.
  • Vidu Q3 Drama — Vidu Q3 Drama - нейросеть для создания драматических видео по сценарию, картинкам и подготовленным ассетам. Модель относится к линейке Vidu Q3 и заточена под сюжетные ролики, где важны цельная сцена, эмоции, движение камеры и ритм.
  • Volcengine Lip Sync — Volcengine Lip Sync - нейросеть для замены артикуляции в готовом ролике под новую речь. Вы загружаете видео и отдельную аудиодорожку, а модель перестраивает движения рта так, чтобы они совпадали с голосом. По найденным описаниям это решение связано с экосистемой Volcengine от ByteDance и рассчитано именно на сценарий video-to-video: исходное видео сохраняется, меняется в основном область рта и синхронизация речи.
  • ElevenLabs Music v2 — ElevenLabs Music v2 — прошлая версия музыкальной нейросети ElevenLabs: пишет песни с вокалом и музыку без слов по текстовому заданию, русский текст тоже поёт. Пригодится, чтобы продолжить серию треков в том же звучании или услышать другую аранжировку задания, уже сделанного в v2.5.
  • OmniHuman 1.0 — OmniHuman 1.0 - нейросеть из класса “говорящее фото по аудио”: вы загружаете портрет, добавляете аудиодорожку, а на выходе получаете видео, где человек “оживает” и говорит с синхронизацией губ.
  • Meshy 7 — Meshy 7 - нейросеть для создания 3D-моделей по изображениям. Вы загружаете одну картинку или несколько ракурсов одного объекта, а сервис собирает из этого объёмную модель и при желании сразу накладывает текстуры.
  • Vidu Q3 Ad — Vidu Q3 Ad - модель для генерации коротких рекламных роликов по описанию и изображениям. Она берёт фото товара или несколько референсов, собирает из них сцену и делает готовое видео в нужном формате кадра. Vidu создан компанией ShengShu Technology.
  • Waver 1.0 — Waver 1.0 - нейросеть, которая «оживляет» картинку: вы загружаете изображение, пишете, что должно происходить в кадре, и получаете короткий видеоролик. Это формат image-to-video: одна картинка становится основой, а текст задаёт движение, камеру и настроение.
  • Vidu Q3 Drama Clip — Vidu Q3 Drama Clip - инструмент на базе Vidu Q3 для создания коротких сюжетных видео по сценарию и списку ассетов: персонажей, локаций и важных предметов. Он рассчитан на сцены, где нужно сохранить логику кадра, выдержать драматический ритм и не потерять внешний вид героев между планами.

Как выбрать нейросеть

Содержание

  1. Какая компания стоит за нейросетью
  2. Как пользоваться зарубежными нейросетями из России
  3. Китайские нейросети на сайте
  4. Шесть крупных разработчиков
  5. Зачем одной компании несколько версий
  6. Остальные разработчики по задачам
  7. Флагманы разработчиков: цены и сильные стороны
  8. Выбирайте по задаче, а не по бренду
  9. Вопросы о разработчиках нейросетей

Здесь собраны зарубежные нейросети: больше 140 моделей от 27 компаний, в основном из США и Китая. Nano Banana и Veo делает Google, GPT Image — OpenAI, Seedream и Seedance выпускает ByteDance, владелец TikTok, а за Kling стоит китайская Kuaishou. Ниже разбираем, кто за какой нейросетью стоит, чем сильна каждая линейка и зачем у одной модели по пять версий. Все примеры сделаны на нашем сайте.

Какая компания стоит за нейросетью

Название модели часто не совпадает с именем компании, поэтому на сайте есть теги обоих видов: по компании (Google, OpenAI, MiniMax) и по линейке (Banana, Seedream, Hailuo). В таблице они сведены вместе, ссылки ведут на страницы тегов.

КомпанияСтранаНейросети на сайте
GoogleСШАлинейка Banana, Veo, Gemini Omni, Lyria, озвучка Gemini
OpenAIСШАGPT Image
ByteDanceКитайSeedream, Seedance, OmniHuman, улучшение видео и липсинк
xAIСШАGrok Video, Grok Image, озвучка xAI
AlibabaКитайWan, Qwen Image
KuaishouКитайKling
MiniMaxКитайHailuo, MiniMax H3, Speech, Music
TencentКитайHunyuan
ShengShuКитайVidu
AIsphereКитайPixVerse
Black Forest LabsГерманияFlux
LightricksИзраильLTX

У остальных пятнадцати компаний имя совпадает с названием нейросети: Midjourney, Runway, Luma, Suno, ElevenLabs и другие. О них ниже.

Как пользоваться зарубежными нейросетями из России

Напрямую многие из этих сервисов не принимают российские карты, а часть не открывается без VPN. Здесь аккаунт у разработчика не нужен и подписки нет. Баланс пополняется в рублях, платите вы за каждый запуск.

Откройте нейросеть по карточке выше, опишите задачу в поле Задание (это описание называют промптом) и выберите настройки. Задание можно писать по-русски, все примеры здесь сделаны по русским промптам. Цена видна на кнопке Отправить до запуска, а если нейросеть вернула ошибку, деньги сами вернутся на баланс. Результат появится под формой и в разделе Мои результаты, где хранится 7 дней. Если сайт для вас новый, загляните в инструкцию по сайту.

Китайские нейросети на сайте

Из 27 компаний семь китайские, и почти все делают видео: Kling, Seedance, Wan, Hailuo, Vidu и PixVerse. Картинки рисуют Seedream от ByteDance, Wan Image и Qwen Image от Alibaba и Kling Image O3, звук к видео и 3D-модели делает Hunyuan от Tencent. Обновляются они часто. Только за июль и август 2026 года вышли Seedance 2.5, Wan 3.0 и MiniMax H3.

Из китайских нейросетей для картинок у нас чаще всего запускают Seedream 5.0 Pro и 4.5, из видео — Seedance 2.5. Самая большая линейка на сайте тоже китайская: у Wan двадцать нейросетей.

Шесть крупных разработчиков

Порядок — по спросу за последний месяц.

Google: Nano Banana, Veo и Gemini Omni

Nano Banana — прозвище моделей Gemini для картинок от Google DeepMind. Nano Banana вышла в августе 2025 года, Pro в ноябре, Nano Banana 2 в феврале 2026-го, а 2 Lite в июле. Самые дешёвые картинки у Google дают 2 Lite и обычная Nano Banana в режиме «Дешёвый», а самая популярная у нас Pro. Она принимает до 14 фото, даёт 4K (около 4000 точек по длинной стороне) и держит длинные надписи: в этой инфографике почти два десятка подписей по-русски.

Рисованная инфографика рецепта пиццы Маргарита с ингредиентами и шестью шагами, Nano Banana Pro

Инфографика рецепта пиццы «Маргарита», иллюстрация, вдохновлённая эстетикой студии Ghibli, традиционная итальянская обстановка кухни, тёплый золотистый свет заката, пицца целиком в центре с пузырящимся сыром, ингредиенты в симпатичных контейнерах, шарики из теста, 150 г томатного соуса, 200 г моцареллы, свежие листья базилика, сбрызнутые оливковым маслом, этикетки в стиле блокнота, написанные от руки, мягкие пастельные тона, живописная текстура, нежный пар и волшебное свечение, причудливое ощущение уюта, чётко организованный макет, читаемый текст, высокая детализация.

Шаги рецепта нейросеть придумала сама: 220 °C и 10 минут в промпте не было. Огрехи тоже есть: на бутылке масла написано «Сбрызнуто», а у четвёртого шага в схеме лишняя скобка.

Nano Banana Pro · 3:4, 4K · от 5 ₽

Для видео у Google есть Veo 3.1 с оплатой за ролик целиком и Gemini Omni, показанная в мае 2026 года. Omni собирает ролик из текста, картинок и готового видео и правит его обычными словами. Ещё у Google есть песни Lyria 3 Pro, Замена одежды по фото и две озвучки Gemini.

OpenAI: GPT Image 2 и 2.5

GPT Image 2 вышла в апреле 2026 года, и за последний месяц её запускали чаще любой другой нейросети этого раздела. GPT Image 2.5 появилась 8 сентября 2026 года: в поле Модель у неё два варианта, быстрый Flare и Sunburst для точной правки. Обе принимают до 16 фото. Обложку ниже, готовый пример с сайта, сделали в самом дешёвом качестве Low, и все три надписи по-русски вышли без ошибок.

Обложка книги «Жар-птица»: птица из вырезанной цветной бумаги над ночным лесом

Создай вертикальную обложку вымышленной книги «ЖАР-ПТИЦА». Соотношение сторон строго 3:4. Только лицевая обложка на весь кадр, без объёмного макета книги. Центральный рисунок выглядит как настоящая многослойная скульптура из вырезанной вручную цветной бумаги. Огромная жар-птица взлетает над ночным лесом… В верхней четверти крупное название: «ЖАР-ПТИЦА». Под ним: «Сказки, которые светятся в темноте». Внизу: «Арина Северная».

Промпт сокращён, полный откроется по кнопке.

GPT Image 2.5 · Flare, Low, 1K, 3:4 · от 2 ₽

Прошлая версия GPT Image 1.5 знает только три пропорции и берёт задание до 3000 знаков.

ByteDance: Seedream и Seedance

Модели ByteDance делает её подразделение Seed. Seedream 5.0 Pro вышла в июле 2026 года. Она раскладывает картинку на слои и правит место, отмеченное рамкой, точкой или кистью. С прошлыми версиями мы её сравнили ниже.

Seedance 2.5 вышла 31 июля 2026 года и снимает до 30 секунд со звуком за один запуск. Как образцы (их называют референсами) она берёт до 30 фото, а ещё видео и аудио. Из прошлых версий популярна Seedance 1.5 Pro: у неё оплата за ролик целиком, и выходит дешевле. Говорящее видео по фото и записи голоса делает OmniHuman 1.5 той же компании.

xAI: Grok Video и Grok Image

Компанию xAI основал Илон Маск. Grok Video снимает от 6 до 30 секунд, и секунда видео у неё одна из самых дешёвых в каталоге. Обе версии принимают до 7 фото. Grok Video 1.5 снимает короче, от 1 до 15 секунд, а 720p у неё дороже. Картинки рисуют Grok Image, Grok Image Pro и Grok Image 2.0, последняя выдаёт до 12 штук за запуск.

Создай рекламный ролик 6 секунд для наручных часов: часы медленно вращаются на чёрном бархате, луч света скользит по металлическому корпусу и стеклу, создавая блики. Затем камера делает плавный круговой облёт часов. Саунд: одиночный фортепианный аккорд, эхо.

В промпте написано «6 секунд», а ролик вышел на 8: длину задаёт поле Длительность, а не текст задания.

Grok Video · Из текста, 8 с, 720p, 2:3 · от 2 ₽/сек

Alibaba: Wan и Qwen Image

Wan 3.0 Video Prime и Wan 3.0 Video вышли в августе 2026 года. Они снимают до 30 секунд и делают ролик даже по документу до 50 страниц или по ссылке на страницу. Prime, по словам разработчиков, ускоренная версия, а обычная дешевле за секунду. Для пробы хватит 5 секунд в 480p: это самое низкое разрешение, для телефона берите 720p, для большого экрана — 1080p.

Кинематографичный пролёт камеры над утренним Байкалом: ледяная гладь с трещинами, восходящее солнце, лёгкий туман, реалистичный звук ветра

Wan 3.0 Video Prime · Из текста, 5 с, 480p, 16:9, со звуком · от 9 ₽/сек.

Среди остальных Wan популярнее всего картинки Wan 2.7 Image и 2.6 Image, а из видео — Wan 2.7 Video. Версию 2.2 Alibaba выложила в открытый доступ, и на ней построены инструменты для персонажей: Wan 2.2 Animate переносит движения с видео на героя по фото, Wan 2.2 Avatar делает говорящее фото. Вторая линейка Alibaba рисует картинки. Qwen Image 3.0 принимает задание до 18 000 знаков, а вариант Pro в поле Версия рассчитан на плотный текст, меню и вёрстку.

Kuaishou: Kling

Kling делает китайская компания Kuaishou, владелец одноимённой видеоплатформы. Kling 3.0 вышла в феврале 2026 года: ролики от 3 до 15 секунд, 4K и до шести сцен, каждую можно расписать отдельно. Пример с раскадровкой есть в статье про видео из текста. Из прошлых версий популярны Kling 2.5 Turbo Pro и Kling 2.1, а картинки рисует Kling Image O3.

Ещё Kling известна переносом движений: Kling 2.6 Motion Control и Kling 3.0 Motion Control повторяют танец или жест с видео на человеке с фото, подробнее в статье про контроль движения. Есть у Kling и нейросети для липсинка (подгонки губ под речь), аватаров и звука к видео.

Зачем одной компании несколько версий

Новая версия почти всегда умеет больше, но старые остаются в каталоге: они дешевле, быстрее или рисуют в манере, к которой вы привыкли. Мы проверили это на четырёх версиях Seedream: один промпт, пропорции 4:3, разрешение 2K. Под картинками указано, сколько ждали. Каждая сделала картинку с первой попытки, все четыре вместе обошлись нам в 23,5 ₽.

Иллюстрация в стиле детской книги: рыжая лиса-почтальон в синей куртке едет на велосипеде по заснеженной деревенской улице и везёт письма. На её сумке крупная надпись «ПОЧТА». Вдоль улицы три деревянных домика, из труб идёт дым, в окнах тёплый свет. В небе зелёное северное сияние, падает редкий снег. За лисой бежит маленький белый заяц с конвертом в зубах.

Акварельная лиса на велосипеде у бревенчатых домов, на стене дома лишняя металлическая труба, Seedream 4.0

Seedream 4.0 · 27 с · от 4 ₽

Лиса в синей куртке с сумкой «ПОЧТА», за ней бежит заяц с конвертом в зубах, Seedream 4.5

Seedream 4.5 · 25 с · 5 ₽

Плоская мультяшная лиса на маленьком велосипеде с конвертом в лапе, Seedream 5.0 Lite

Seedream 5.0 Lite · 68 с · 4,50 ₽

Лиса-почтальон в шарфе едет к деревне под месяцем и северным сиянием, Seedream 5.0 Pro

Seedream 5.0 Pro · 105 с · от 5 ₽

Точнее всех задание выполнила Seedream 4.5: синяя куртка, три дома, дым из труб, заяц бежит позади и держит конверт в зубах. Seedream 5.0 Pro нарисовала самую богатую сцену, от себя добавила месяц, почтовый указатель и шарф, но заяц держит конверт лапами. Seedream 5.0 Lite ушла в плоский мультик и сделала велосипед слишком маленьким для лисы. У Seedream 4.0 на стене дома выросла железная труба, а куртка вышла бирюзовой. Зато только 4.0 выдаёт до 15 картинок за запуск.

Новая 5.0 Pro нужна ради слоёв и правки по отметке, а обычную иллюстрацию 4.5 нарисовала точнее и дешевле.

Остальные разработчики по задачам

Картинки и дизайн

Midjourney 8 выбирают за художественную манеру. Ползунок Стилизация в её форме идёт от 0 до 1000: чем выше, тем больше она рисует по-своему. За запуск выходит четыре варианта, ниже первый.

Самурай с красным зонтом на ночной улице под дождём, неоновые фонари, Midjourney 8

Одинокий самурай под дождём на ночной улице Киото, неон, отражения, кинематографичный кадр

Midjourney 8 · 16:9, стилизация 250 · 10 ₽

В общей Midjourney есть прошлые версии, режим Niji для аниме и смешивание до четырёх картинок. Flux 2 немецкой Black Forest Labs берёт до 8 фото, а FLUX.2 Pro Outpaint дорисовывает картинку за края. Ideogram V4 рисует только по тексту и даёт три скорости на выбор, Recraft V4.1 умеет векторные картинки, которые можно увеличивать без потери качества, а Krea 2 повторит стиль по десяти образцам. Дешевле всех из этой группы Meta Muse Image от Meta (признана экстремистской организацией и запрещена в РФ).

Видео

Runway 4 Turbo продлевает готовый ролик, Luma 3.2 правит видео и меняет его пропорции. PixVerse 6.0 собирает ролик из нескольких клипов со звуком, Vidu Q2 Pro оживляет фото и подкладывает фоновую музыку. У MiniMax новая MiniMax H3 снимает только в 2K, а Hailuo 02 и Hailuo 2.3 дешевле.

Ещё в этой группе LTX 2.3 от Lightricks с разрешением до 4K (2160p) и говорящее фото HeyGen по записи голоса до минуты.

Звук и голос

Самая популярная у нас нейросеть для песен — Suno: за запуск два трека с вокалом до 6 минут, на выбор модели V6, V6 Mini и V6 Wild. Песни делает и MiniMax Music 3.0. У ElevenLabs на сайте озвучка Eleven v3 с 64 голосами, звуковые эффекты, музыка и очистка голоса от шума. Голоса мы сравнили в статье про озвучку текста, песни — в разделе Музыка.

Улучшение и 3D

Topaz Image Upscale увеличивает фото в 2 или 4 раза, моделей для этого у неё полтора десятка, а для видео есть Topaz Video. Фото увеличивает и Clarity AI Flux Upscaler, а видео — Bria Video Upscaler и ByteDance Video Upscaler. 3D-модель по фото или тексту сделают Meshy 7.1, с текстурами и скелетом для анимации, и Hunyuan 3D v3.1.

Флагманы разработчиков: цены и сильные стороны

По одной-две главные нейросети каждой крупной компании. Остальные видны карточками выше.

НейросетьЦенаРазработчикЧем сильна
Nano Banana Proот 5 ₽GoogleИнфографика, до 14 фото, 4K
Gemini Omniот 60 ₽GoogleВидео из текста, картинок и готового ролика, до 4K
GPT Image 2от 2 ₽OpenAIПравка по 16 фото, до 4K
GPT Image 2.5от 2 ₽OpenAIМодели Flare и Sunburst, прозрачный фон
Seedream 5.0 Proот 5 ₽ByteDanceСлои, правка по отметке
Seedance 2.5от 8 ₽/сек.ByteDanceДо 30 с со звуком, фото, видео и аудио как образцы
Grok Videoот 2 ₽/секxAIДо 30 с, дешёвая секунда
Wan 3.0 Video Primeот 9 ₽/сек.AlibabaВидео по документу или ссылке
Qwen Image 3.0от 4.5 ₽AlibabaЗадание до 18 000 знаков
Kling 3.0от 11 ₽/сек.KuaishouДо 6 сцен, 4K
MiniMax H3от 6 ₽/сек.MiniMax2K, референсы с видео и звуком
Midjourney 810 ₽MidjourneyХудожественный стиль, 4 варианта
Runway 4 Turboот 15 ₽RunwayПродление ролика
Suno10 ₽ за 2 трекаSunoПесни с вокалом, 2 трека за запуск
ElevenLabs Eleven v330 ₽ за 1000 символовElevenLabs64 голоса, три вида подачи

Выбирайте по задаче, а не по бренду

Имя компании подскажет, чего ждать, но выбирать лучше под задачу. Картинку с надписью по-русски начните с GPT Image 2 или Nano Banana Pro. Иллюстрацию начните с Midjourney 8 или Seedream. Длинный ролик со звуком снимут Seedance 2.5 и Wan 3.0, дешёвую пробу видео — Grok Video. Песню напишет Suno, текст озвучит Eleven v3, 3D-модель сделает Meshy 7.1, а самые дешёвые картинки — в Nano Banana 2 Lite и Nano Banana в дешёвом режиме.

Сравнения на одной задаче собраны в статьях: создание изображений, редактирование фото, видео из фото. Пошагово про отдельные модели написано в инструкциях как повторить трендовое видео в Seedance 2.0 и как перенести движения на своего персонажа в Kling.

Вопросы о разработчиках нейросетей

Статья обновлена 25 сентября 2026 г.