Видео просят везде: карточке товара — ролик вместо статичного фото, соцсетям — вертикальные сторис, рассылке — короткая анимация, объявлению — движение вместо картинки. Снять это руками — смена оператора, монтаж и правки на каждый вариант. Сделать десять версий под десять сегментов — десять смен.
В Staqflow появился узел «Генерация видео». На входе описание словами и, если нужно, картинка; на выходе готовый видеофайл, который следующий шаг отправляет в Telegram, кладёт в хранилище или прикладывает к карточке товара.
Генерация видео в workflow — это шаг процесса, который по текстовому описанию снимает короткий ролик и отдаёт его файлом дальше по цепочке. Картинку на входе он может оживить: она становится первым кадром, а модель достраивает движение.
Что умеет узел «Генерация видео»
- Снимает по описанию. Промпт собирается из данных процесса: названия товара, темы поста, имени клиента.
- Оживляет картинку. Стартовый кадр берётся из бинарного поля или по ссылке — например, прямо от узла генерации изображений.
- Дожидается результата сам. Видео рендерится минутами: узел ставит задачу, опрашивает готовность и отдаёт файл, когда он готов.
- Отдаёт готовый файл. Ролик лежит в бинарном поле элемента, и его принимает любой узел, работающий с файлами.
- Не молчит про отказы. Что провайдер не принял, возвращается полем
ignored.
Пять провайдеров в одной панели
| Провайдер | Чем снимает | Особенности |
|---|---|---|
| OpenAI | видеомодели аккаунта | длительность задаётся параметром |
| Google Gemini | модели Veo | только 16:9 и 9:16, есть «чего избегать» и выбор разрешения |
| Qwen (Alibaba Cloud) | семейство wan — отдельно текст в видео и картинка в видео | «чего избегать», зерно для повторяемости |
| xAI (Grok) | видеомодели Grok | длительность параметром |
| OpenRouter | каталог видеомоделей разных вендоров | разрешение и зерно; редакторы видео в списке не показываются |
Список моделей узел подтягивает сам, а у Qwen подставляет известный набор. Модели с i2v в имени оживляют картинку и без стартового кадра не работают — это видно по названию.
Как настроить
- Добавьте подключение к сервису в учётных данных пространства — то же, на котором работает языковая модель.
- Поставьте узел «Генерация видео» и выберите провайдера и модель.
- Опишите сцену в поле «Промпт». Здесь работают выражения:
Медленный облёт вокруг {{ $json.title }} на белом фоне, мягкий свет. - Выберите пропорции: горизонтальные 16:9, вертикальные 9:16 для сторис или квадрат 1:1. У Gemini квадрата нет.
- При необходимости задайте стартовый кадр — из бинарного поля или по ссылке.
Параметры
- Длительность от 1 до 60 секунд, по умолчанию 5. Принимают все пятеро, но каждый округляет до того, что умеет его модель.
- Чего избегать — то, чего не должно быть в кадре. Принимают Gemini и Qwen.
- Разрешение 720p или 1080p — у Gemini и OpenRouter. Выше — чётче и дороже.
- Зерно — одинаковое зерно и тот же промпт дают похожий результат. Есть у Qwen и OpenRouter.
- Ждать готовности — по умолчанию 4 минуты, и спрашивать раз в 10 секунд. Это и есть механика: узел ставит задачу провайдеру и опрашивает её, пока ролик не готов.
Тяжёлые модели в минуту не укладываются — поднимайте ожидание, а не сокращайте ролик. Параметры показываются только тем провайдерам, которые их принимают.
Как описать сцену
Промпт для видео отличается от промпта для картинки одним: в нём нужно движение. Модель снимает не кадр, а несколько секунд, и если не сказать, что происходит, она придумает это сама.
- Что в кадре: предмет, человек, обстановка. Конкретика лучше эпитетов.
- Как движется камера: медленный облёт, наезд, проезд вдоль, статичный план. Статику тоже стоит указывать явно.
- Что движется в кадре: пар над чашкой, страницы, ткань на ветру. Одно-два движения на пять секунд — больше модель смажет.
- Свет и настроение: мягкий утренний, контровой, студийный.
- Чего избегать — отдельным полем у Gemini и Qwen: текст на экране, люди в кадре, резкие склейки.
Короткие ролики дешевле, поэтому промпт отлаживают на пяти секундах и только потом ставят длительность и разрешение побольше. Одинаковое зерно у Qwen и OpenRouter помогает сравнивать правки промпта, а не случайность.
Что приходит на выход
providerиmodel— кто снимал и чем;fileName,mimeType,bytes— имя файла, тип и размер;durationSec— фактическая длительность, когда провайдер её называет;ignored— параметры, которые провайдер не принял.
Сам файл лежит в бинарном поле data, имя поля меняется в параметрах.
Связка с соседними узлами
Отдельно взятая генерация видео — половина дела. В процессе она обычно стоит в середине:
Картинка → видео. Узел генерации изображений рисует кадр по описанию товара, узел видео берёт его стартовым кадром и добавляет движение. Так проще удержать нужный вид: композицию задаёт картинка, а не случайность модели.
Видео → озвучка. Ролик уходит в публикацию, а закадровый текст собирает языковая модель и озвучивает узел синтеза речи. Два файла делает один процесс.
Видео → рассылка. Готовый файл отправляется в Telegram, кладётся в хранилище или прикладывается к карточке на маркетплейсе — дальше работают обычные узлы интеграций.
Сценарии автоматизации
Ролики для карточек товара
Новый товар появился в учётной системе → описание собирается из характеристик → фото товара идёт стартовым кадром → получается короткий облёт вокруг предмета → файл уезжает в карточку и в папку с медиа.
Вертикальные сторис под соцсети
Тот же процесс с пропорциями 9:16 и другим промптом даёт вертикальную версию. Одна схема — два формата, руками ничего не переснимают.
Анонсы постов и рассылок
По заголовку статьи собирается пятисекундная заставка, ложится в рассылку и в чат редакции на согласование. Обложку к той же статье рисует соседний узел.
Персональные объявления
Для сегмента клиентов или конкретного города собирается свой ролик: летняя акция для одних, зимняя для других. Дальше рассылка или сообщение бота.
Оживление архива фотографий
Старые предметные фото по очереди уходят стартовыми кадрами, получая лёгкое движение, — каталог обновляется без новой съёмки.
Сколько это стоит
Видео — самая дорогая из ИИ-операций: провайдеры считают по секундам и по разрешению, и разница между 720p и 1080p заметна в счёте. Поэтому длительность и разрешение стоит подбирать осознанно, а промпт отлаживать на коротких роликах.
Считать удобно не за ролик, а за вариант: если процесс делает горизонтальную и вертикальную версии для каждого товара, счёт умножается на два. Поэтому вертикальную версию часто ставят на отдельную ветку с условием — и снимают её только для тех позиций, что действительно уходят в соцсети.
В Staqflow оплачивается только работа процесса: токены за CPU-секунды. Ожидание рендера процессор почти не грузит — узел просто спрашивает готовность раз в десять секунд, — так что в токенах сама съёмка стоит немного. Тарифы — на странице цен.
Частые вопросы
Какие нейросети снимают видео в Staqflow?
Пять провайдеров: OpenAI, Google Gemini, Qwen от Alibaba Cloud, xAI и OpenRouter с его каталогом моделей разных вендоров.
Можно ли оживить существующую фотографию?
Да, это и есть стартовый кадр: картинка берётся из бинарного поля или по ссылке. У Qwen для этого отдельные модели с i2v в имени — без картинки они не работают.
Сколько длится ролик?
От 1 до 60 секунд, по умолчанию пять. Реальная длительность зависит от модели: что она умеет, то и снимет, а фактическое значение вернётся в поле durationSec.
Почему процесс долго не отвечает?
Видео рендерится минутами. Узел ставит задачу и опрашивает её раз в десять секунд, пока не дождётся; по умолчанию ждёт четыре минуты. Для тяжёлых моделей ожидание стоит поднять.
Можно ли смонтировать ролик из своего видео?
Нет. Узел снимает по тексту и картинке, исходного ролика ему взять неоткуда — поэтому редакторы видео в списке моделей и не показываются.
Можно ли сменить провайдера в готовом процессе?
Да, в этом смысл общей панели: пропорции, длительность и остальное переводятся под новую модель, а то, что она не приняла, честно возвращается полем ignored.
Данные уходят во внешний сервис?
В облачные — да, как при любом вызове чужого API: промпт и стартовый кадр отправляются провайдеру. Если так нельзя, генерацию видео стоит держать вне процессов с чувствительными данными — собственный контур закрывает текстовые модели, но видео у всех пятерых считается в облаке.
Попробуйте
- Создайте аккаунт — карта не нужна.
- Поставьте рядом два узла: генерация изображения и генерация видео со стартовым кадром от неё.
- Или опишите задачу ИИ-клиенту через MCP: «Для каждого нового товара сними пятисекундный ролик и положи в карточку».
Куда отправить готовый файл — смотрите в каталоге интеграций.
