Как сгенерировать видео с помощью ИИ: от промта до короткого фильма

Ролик нейросетью делают двумя способами. Можно описать сцену текстом и получить клип (text-to-video). Можно сначала сделать или загрузить картинку и попросить модель её оживить (image-to-video). Длина клипа за один запуск зависит от модели: в каталоге есть варианты от 5 до 15 секунд. Всё длиннее собирают на монтаже из нескольких клипов.
Для первой пробы подойдёт модель HappyHorse, которая делает видео из текста и из фото: в режиме text-to-video она выдаёт до 15 секунд и до 1080P. Дальше по шагам: как выбрать режим, как писать промт под движение камеры и как собрать из клипов фильм с одним героем и звуком.
Из чего нейросеть делает видео: текст, картинка или референсы
У видеомодели бывает три вида входа:
- Текст. Вы описываете сцену, модель сама придумывает композицию, героя и свет.
- Картинка как первый кадр. Модель продолжает кадр во времени, а внешность, стиль и расстановку вы задаёте заранее.
- Референсы. Несколько изображений, по которым модель держит персонажа или объект. Мультимодальные референсы заявлены у Seedance 2.0 и Seedance 2.0 Mini, референсы элементов есть у Kling 3.0.
Чем больше вы задаёте на входе, тем меньше модель додумывает сама.
Text-to-video или image-to-video: какой режим выбрать под задачу
Text-to-video берите, когда нужна атмосфера, фон, заставка или быстрая проверка идеи, а внешность героя неважна. Image-to-video берите, если кадр должен выглядеть определённым образом: персонаж, продукт, фирменные цвета, серия связанных сцен.
Быстрая проверка: расстроит ли вас, если герой в следующем клипе окажется другим человеком? Если да, нужен image-to-video. Для серии сцен из одного только текста герой почти наверняка будет меняться: модель каждый раз заново придумывает лицо и одежду.
Видеомодели в Молекуле: сравнение по режимам, длине и качеству
Данные на сентябрь 2026. Стоимость запуска показана рядом с моделью в каталоге, видео стоит дороже текстовых запросов.
| Модель | Вход | Длина клипа | Качество и особенности |
|---|---|---|---|
| HappyHorse Text-to-Video | текст | до 15 с | до 1080P |
| HappyHorse Image-to-Video | картинка, обязательно | - | анимация по референсу |
| Wan 2.6 (image-to-video) | картинка | 5, 10 или 15 с | 720p или 1080p |
| Kling 2.1 Standard (image-to-video) | картинка | 5 или 10 с | - |
| Kling 3.0 | - | - | несколько планов в ролике, референсы элементов, режим 4K |
| Kling 3.0 (image-to-video) | картинка | - | анимация фото с движением камеры |
| Hailuo 02 Standard (image-to-video) | картинка | 6 или 10 с | 512P или 768P |
| Seedance v1 Lite (image-to-video) | картинка | 5 или 10 с | 480p, 720p или 1080p |
| Seedance 2.0 / 2.0 Mini | текст, картинка, референсы | - | Mini быстрее и дешевле |
| Veo 3.1 | текст, картинка | - | опция 1080P |
| Veo Omni | текст, картинка | - | до 4K |
| Grok Imagine Video / Grok Imagine (image-to-video) | текст / картинка | - | - |
Похожие названия означают разные модели. Kling 3.0 и Kling 3.0 (image-to-video) идут отдельными записями, у каждой свои возможности и своя цена. Несколько планов и 4K заявлены только у первой.

Первый ролик из текста: пошаговая инструкция
- Найдите в каталоге text-to-video модель, например HappyHorse Text-to-Video или Veo 3.1.
- Перед запуском посмотрите цену рядом с моделью и сверьте её со своим остатком кредитов. На бесплатном тарифе квота 5 кредитов, так что для видео может понадобиться платный тариф.
- Первый запуск делайте на минимальной длине: так вы оцените движение, не потратив лишнего.
- Впишите промт по шаблону из раздела про промты ниже.
- Проверьте результат по трём признакам: камера движется так, как вы описали; объекты не «плывут» и не меняют форму; первая и последняя секунды без рывков.
- Если всё в порядке, повторите запуск с нужной длиной и разрешением.
Промт из примера ниже можно запустить сразу: утренний туман, лодка и камера низко над водой.

Как оживить фото: сначала кадр, потом движение
Композицию, свет и внешность удобнее подбирать на картинках, а видео запускать уже по готовому кадру. На сентябрь 2026 GPT Image 2.5 Flare стоит 6 кредитов за запуск, Seedream v4.5 - 13. Цену видеомодели сравните сами: она указана в каталоге.
Порядок работы:
- Сгенерируйте опорный кадр нейросетью в том же соотношении сторон, что и будущий ролик.
- Если нужна правка, например другой цвет куртки или лишний предмет в кадре, отправьте кадр в Nano Banana Editor, а не генерируйте его заново.
- Загрузите кадр в image-to-video модель: Wan 2.6, Kling 3.0 (image-to-video), Seedance 2.0 (image-to-video) или Veo 3.1 (image-to-video).
- В промте опишите только движение. Что изображено на картинке, модель уже видит.
Кадры с мелким текстом, толпой или руками крупным планом лучше не оживлять: при движении они искажаются первыми.
Как писать промт для видео: сцена, действие, камера, свет
В видеопромте оставляйте одно действие и одно движение камеры на клип. Если попросить модель «герой встаёт, идёт к окну и оборачивается» за 5 секунд, обычно получаются склейки и дёрганая пластика. Каркас для text-to-video:
Сцена: где и когда, 1 фраза
Объект: кто или что в кадре, с 2-3 приметами
Действие: одно действие, темп (медленно, плавно)
Камера: план + движение (общий план, медленный наезд / пролёт / панорама влево / статика)
Свет: время суток и источник
Стиль: кинематографично, плёночное зерно, документальноПример заполнения:
Сцена: горное озеро на рассвете, над водой туман
Объект: деревянная лодка, старая краска, один гребец в сером плаще
Действие: лодка медленно плывёт к берегу, вёсла почти беззвучно входят в воду
Камера: общий план, камера плавно летит низко над водой навстречу лодке
Свет: мягкий рассветный свет сбоку, золотые блики на воде
Стиль: кинематографично, приглушённые цветаДля image-to-video оставьте только строки «Действие» и «Камера». Если описать заново то, что уже есть на картинке, модель может начать перерисовывать кадр.
Как сделать фильм с помощью нейросети: сценарий, раскадровка, один герой во всех сценах
Сценарий и раскадровка
Сначала напишите сценарий и раскадровку с помощью ИИ. Для черновика хватит DeepSeek V4 Flash за 1 кредит, для финальной версии подойдёт Claude Opus 5.5 за 20 кредитов (цены на сентябрь 2026). Запрос:
Роль: ты режиссёр короткого метра.
Задача: раскадровка фильма на 6 сцен по 10 секунд про [сюжет].
Формат: таблица - номер, кадр, одно действие, движение камеры, свет.
Ограничения: один герой, одно действие на сцену, без диалогов.Один герой во всех сценах
Сделайте лист персонажа: герой в анфас, в профиль и в полный рост на нейтральном фоне. Затем соберите опорные кадры сцен, передавая лист как референс. Nano Banana Pro принимает до 14 входных картинок. Каждую сцену оживляйте в image-to-video, в строке «Камера» берите движение из раскадровки.
Чтобы проверить сходство, поставьте первые кадры всех сцен рядом. Если у героя в одной сцене другая причёска или цвет одежды, исправлять надо картинку, а не видео.
Звук, музыка и финальная обработка: эффекты, саундтрек, апскейл
Звук удобнее собирать отдельно:
- Эффекты. ElevenLabs Sound Effects делает звук по описанию, например «плеск вёсел в тихом озере, далёкие птицы». Генерируйте по эффекту на сцену.
- Музыка. Suno V5 или V4.5 пишут трек по текстовому описанию жанра и настроения, Suno V3.5 выдаёт треки до 4 минут. Для короткого фильма просите инструментал без вокала, чтобы музыка не спорила с эффектами.
- Субтитры. Если в ролике есть речь, ElevenLabs Speech-to-Text расшифрует её в текст.
- Апскейл. Topaz Video Upscale увеличивает разрешение видео до 4 раз. Делайте его последним шагом, на смонтированном материале.
Клипы склеивают в ИИ-редакторе видео или в любом привычном монтажном редакторе. Если после сведения голос или шум звучат грязно, можно улучшить звук в готовом ролике.
Частые ошибки в ИИ-видео и как их исправить
- Герой меняется от сцены к сцене. Вы генерировали из текста. Переходите на опорные кадры с референсом.
- Объекты плывут и деформируются. В промте слишком много действий. Оставьте одно и замедлите темп словами «медленно» и «плавно».
- Камера стоит, хотя просили пролёт. Движение описано расплывчато. Пишите конкретно: «камера медленно наезжает», «пролёт низко над водой».
- Рывок на стыке клипов. Возьмите последний кадр предыдущего клипа как первый кадр следующего.
- Кредиты уходят впустую. Вы подбирали композицию на видео. Подбирайте её на картинках, а видео запускайте, когда кадр утверждён.
- Мыло после апскейла. Исходник был в низком разрешении и с артефактами, апскейл их не уберёт. Пересоздайте клип в 1080p.
Фильм одной кнопкой пока не получится, зато каждый клип запускается отдельно, и испорченную сцену проще перегенерировать, чем исправлять на монтаже.

Частые вопросы
Похожие статьи
Текст и работаТолкование сна онлайн: как разобрать сновидение с помощью нейросети
Когда текст слишком объёмный, читать и работать с ним становится сложно. Нужно сделать конспект, сократить рассказ, подготовить доклад или быстро выделить смысл — и тут важно убрать лишнее, но не потерять основную мысль. С этим помогает Молекула АИ: сервис умеет сократить текст онлайн, оставить ключевые идеи и преобразовать даже длинный фрагмент в компактный, понятный вариант.
УчёбаРешить задачу по физике с помощью Молекула АИ
Физика часто упирается в задачи. Формулы, законы, графики, единицы измерения — легко запутаться, даже если теория знакома. Одно дело понять пример в классе, другое — решить задание по физике самому, когда рядом нет учителя. В этот момент удобно иметь инструмент, который не просто выдаёт ответ, а помогает разобраться в ходе решения. Эту роль берёт на себя Молекула АИ.
УчёбаРешить задачу по химии с помощью Молекула АИ
Химия часто упирается не только в теорию, но и в умение разбирать задачи. Уравнения, расчёты, формулы, коэффициенты — легко запутаться, особенно когда задач много, а времени мало. В таких случаях логично не просто «списать ответ», а использовать инструмент, который помогает решить задачу по химии, разобрать ход решения и понять логику. Для этого подойдёт Молекула АИ.

Корпоративный доступ к ИИ-моделям
Счёт для юрлица, централизованная оплата, приоритетная поддержка
- Доступ к моделям ChatGPT, Gemini, Grok, Claude, DeepSeek
- Библиотека промтов и общий доступ внутри команды