Создаёт видео по тексту или изображениям, а ещё может довести черновик до финального результата. Цена зависит от качества: черновик - 8 ₽/сек., HD - 20 ₽/сек., FHD - 32 ₽/сек.
Заявление на камеру
Промт к исходному фото находится в галерее Нейрофотосессии
Промпт: Создай вертикальный кадр: мужчина с референса, одежда с референса, сидит на кухне обычной городской квартиры и даёт интервью прямо в камеру, петличный микрофон на воротнике. Он смотрит в объектив и произносит вслух, отчётливо артикулируя, губы двигаются точно в такт словам, спокойный разговорный тон: «Слушай, я уже всё решил: щенка мы забираем в четверг». Затем он коротко улыбается и кивает. Камера зафиксирована на уровне глаз, лицо крупно, малая глубина резкости. Audio: его голос на переднем плане, чистый и без обработки, под ним тихий гул холодильника и приглушённый двор за окном. Без музы
Flux 3 Video — видеонейросеть Black Forest Labs: снимает ролик на 5–20 секунд со звуком по описанию или по 1–10 картинкам. Сначала можно сделать дешёвый черновик, а удачный довести до HD или FHD с тем же сюжетом и движением.
По словам разработчиков, FLUX 3 учили сразу на изображениях, видео и звуке, поэтому ролик приходит уже озвученным: голоса, плеск воды, ветер. Мы сделали три запуска, все задания написаны по-русски, ролики только сжаты для страницы.
Картинки на входе нет, тип генерации «Видео из текста», качество «Черновик», 5 секунд. Мы попросили двух рыбаков и две короткие реплики.
Рассвет на лесном озере, над водой стелется туман. В деревянной лодке сидят двое рыбаков: пожилой в выцветшей штормовке и молодой парень в вязаной шапке. Поплавок дёргается. Пожилой поднимает палец и тихо говорит по-русски: «Тише. Клюёт». Молодой шёпотом отвечает: «Вижу» — и медленно берётся за удочку. Камера стоит на воде сбоку от лодки, кадр не меняется. Звук: их голоса, плеск воды о борт, далёкая кукушка, без музыки. Без субтитров.
Видео из текста · черновик, 16:9, 5 с
Ролик пришёл меньше чем через минуту. Туман, отражение леса и круги от поплавка получились как на фотографии, камера не сдвинулась. Мы прогнали звук через распознавание речи. «Тише, клюёт» разобралось слово в слово. Шёпот «Вижу» пропал. Молодой рыбак в конце берётся за удочку, как просили. Лица сняты издалека, поэтому совпадение губ со словами здесь толком не разглядеть.
В режиме «Видео из изображений» можно загрузить до 10 картинок, и модель проходит их по порядку, как ключевые кадры. Мы дали две: летнюю улицу с пекарней и ту же улицу зимой. Обе нарисованы на сайте, зимнюю версию сделала Flux Kontext из летней.

Картинка 1

Картинка 2
Таймлапс: на одной и той же улице летний закат сменяется зимним вечером. Небо темнеет, начинается снегопад, снег постепенно ложится на мостовую, крыши и подоконники, в окнах загорается тёплый свет, зажигаются фонари. Рыжий кот всё время сидит на тротуаре на своём месте, его заносит снегом. Камера неподвижна. Вывеска пекарни не меняется. Звук: летний вечер с птицами постепенно сменяется тихим зимним ветром и скрипом снега, без музыки.
Видео из изображений · черновик → HD, «Авто», 5 с
Это лучший из наших роликов. Смена сезона заняла все пять секунд: сначала мостовую припорошило, потом потемнело небо, в окнах и фонарях зажёгся свет. Последний кадр совпал со второй картинкой вплоть до шапки снега на голове кота, а слово «ПЕКАРНЯ» ни разу не поплыло. Соотношение стояло на «Авто», и по картинкам 16:9 модель сама выбрала горизонтальный кадр.
Ролик выше сначала был черновиком, его мы и довели до HD режимом «Финализация черновика». Сюжет, движение и звук остались прежними, оба ролика вышли размером 1280×704. Разница — в мелочах. Слева кадр черновика, справа тот же момент после финализации: резьба на наличниках и спицы велосипедов чётче, снежинки различимы по отдельности.
Черновик ждали 71 секунду, финализацию ещё 63. В обзоре всех нейросетей Flux мы доводили черновик и до FHD: там ролик стал крупнее в полтора раза, а речь, смазанная в черновике, после доводки распозналась без ошибок.
Сначала выберите Тип генерации. По умолчанию стоит «Видео из изображений», и без хотя бы одной картинки он не запустится. Чтобы снять ролик только по описанию, переключитесь на «Видео из текста». В поле Задание опишите, кто в кадре, что происходит, как движется камера и что слышно.
Когда сцена ещё не найдена, ставьте Качество «Черновик»: это самый дешёвый вариант, и пятисекундный ролик у нас приходил примерно за минуту. Понравившийся черновик доводят без повторной генерации с нуля:
Цена видна на кнопке Отправить до запуска. Готовый ролик появится в ленте под формой и пролежит 7 дней в разделе Мои результаты, нужное скачайте или сохраните в библиотеку. Кнопка Повторить в карточке сразу запускает то же задание ещё раз, а Изменить возвращает задание и настройки в форму, чтобы что-то поправить.
По-русски модель понимает хорошо, все задания на этой странице русские. За пять секунд успевает случиться одно действие и одна-две реплики, остальное модель сожмёт или пропустит. Порядок, который сработал у нас: кто в кадре и где, что делает, что говорит (слова в кавычках, с пометкой «по-русски»), как стоит камера, что слышно.
[Место и время суток]. [Кто в кадре, во что одет]. [Одно действие]. [Герой] говорит по-русски [каким голосом]: «[короткая фраза]». Камера: [неподвижна / медленно приближается]. Звук: [голос, шумы], без музыки. Без субтитров.
Для перехода между картинками пишите, что меняется и в каком порядке, а отдельно — что должно остаться на месте:
Переход от первой картинки ко второй: [что меняется, по шагам]. Не меняются: [герой, вывеска, предметы]. Камера неподвижна. Звук: [как меняется звук от начала к концу].
Шёпот модель может не озвучить вовсе, как вышло у нас с рыбаками, поэтому важную фразу пусть герой скажет обычным голосом. В переходе прямо перечисляйте, что не должно меняться: вывеска и кот в нашем ролике остались на месте. Готовые задания других людей собраны на странице готовых промптов, общие приёмы для камеры и звука — в инструкции про промпты для видео.
Оплата за каждую секунду ролика, цену меняет только качество. Финализация считается по длине черновика и цене выбранного качества, поэтому черновик плюс доводка обходятся дороже, чем сразу HD. Черновики выгодны, когда вы перебираете несколько вариантов сцены, а доводите один.
| Режим | Качество | Длина | Цена |
|---|---|---|---|
| Новый ролик | Черновик | 5 с | 40 ₽ |
| Новый ролик | HD | 5 с | 100 ₽ |
| Новый ролик | FHD | 5 с | 160 ₽ |
| Финализация черновика | HD | черновик 5 с | 100 ₽ |
| Финализация черновика | FHD | черновик 5 с | 160 ₽ |
| Новый ролик | Черновик | 20 с | 160 ₽ |
| Новый ролик | FHD | 20 с | 640 ₽ |
Для этой страницы нам хватило двух черновиков и одной доводки до HD. Если нейросеть отклонит запрос или не ответит, деньги вернутся на баланс сами.
Других видеомоделей у Black Forest Labs на сайте нет, Flux 2 и Flux Kontext рисуют и правят картинки и годятся, чтобы подготовить кадры для ролика. Все четыре нейросети Flux сравниваются в обзоре линейки, а среди других видеонейросетей стоит посмотреть эти:
| Нейросеть | Цена | Что на входе | Когда брать |
|---|---|---|---|
| Flux 3 Video | от 8 ₽/сек. | текст или 1–10 картинок, 5–20 с | черновики для перебора, переход через несколько ключевых кадров |
| Seedance 2.5 | от 8 ₽/сек. | текст, картинки, референсы, видео, 4–30 с | ролик длиннее 20 секунд, правка готового видео |
| Kling 3.0 | от 11 ₽/сек. | текст, до 7 картинок, видео, 3–15 с | несколько планов в одном ролике с отдельным описанием каждого |
| Veo 3.1 | от 10 ₽ | текст, картинка или референсы, 8 с | русская речь слово в слово |
| Flux 2 | от 5 ₽ | текст и картинки | нарисовать кадры для ролика |
Как видеонейросети выглядят рядом на одних и тех же заданиях, разобрано на страницах видео из текста и видео из изображений.
Описание обновлено 2 октября 2026 г.