§ БЛОГ

Генерация видео в workflow: новая нода Staqflow — ролик из описания или картинки

В Staqflow появился узел «Генерация видео»: на входе описание словами или картинка, на выходе готовый ролик. Пять провайдеров — OpenAI, Gemini, Qwen, xAI и OpenRouter, — пропорции 16:9 и 9:16, стартовый кадр для оживления фото, а файл сразу уходит в карточку товара, сторис или рассылку.

Генерация видео в workflow: новая нода Staqflow — ролик из описания или картинки

Видео просят везде: карточке товара — ролик вместо статичного фото, соцсетям — вертикальные сторис, рассылке — короткая анимация, объявлению — движение вместо картинки. Снять это руками — смена оператора, монтаж и правки на каждый вариант. Сделать десять версий под десять сегментов — десять смен.

В Staqflow появился узел «Генерация видео». На входе описание словами и, если нужно, картинка; на выходе готовый видеофайл, который следующий шаг отправляет в Telegram, кладёт в хранилище или прикладывает к карточке товара.

Генерация видео в workflow — это шаг процесса, который по текстовому описанию снимает короткий ролик и отдаёт его файлом дальше по цепочке. Картинку на входе он может оживить: она становится первым кадром, а модель достраивает движение.

Что умеет узел «Генерация видео»

  • Снимает по описанию. Промпт собирается из данных процесса: названия товара, темы поста, имени клиента.
  • Оживляет картинку. Стартовый кадр берётся из бинарного поля или по ссылке — например, прямо от узла генерации изображений.
  • Дожидается результата сам. Видео рендерится минутами: узел ставит задачу, опрашивает готовность и отдаёт файл, когда он готов.
  • Отдаёт готовый файл. Ролик лежит в бинарном поле элемента, и его принимает любой узел, работающий с файлами.
  • Не молчит про отказы. Что провайдер не принял, возвращается полем ignored.

Пять провайдеров в одной панели

ПровайдерЧем снимаетОсобенности
OpenAIвидеомодели аккаунтадлительность задаётся параметром
Google Geminiмодели Veoтолько 16:9 и 9:16, есть «чего избегать» и выбор разрешения
Qwen (Alibaba Cloud)семейство wan — отдельно текст в видео и картинка в видео«чего избегать», зерно для повторяемости
xAI (Grok)видеомодели Grokдлительность параметром
OpenRouterкаталог видеомоделей разных вендоровразрешение и зерно; редакторы видео в списке не показываются

Список моделей узел подтягивает сам, а у Qwen подставляет известный набор. Модели с i2v в имени оживляют картинку и без стартового кадра не работают — это видно по названию.

Как настроить

  1. Добавьте подключение к сервису в учётных данных пространства — то же, на котором работает языковая модель.
  2. Поставьте узел «Генерация видео» и выберите провайдера и модель.
  3. Опишите сцену в поле «Промпт». Здесь работают выражения: Медленный облёт вокруг {{ $json.title }} на белом фоне, мягкий свет.
  4. Выберите пропорции: горизонтальные 16:9, вертикальные 9:16 для сторис или квадрат 1:1. У Gemini квадрата нет.
  5. При необходимости задайте стартовый кадр — из бинарного поля или по ссылке.

Параметры

  • Длительность от 1 до 60 секунд, по умолчанию 5. Принимают все пятеро, но каждый округляет до того, что умеет его модель.
  • Чего избегать — то, чего не должно быть в кадре. Принимают Gemini и Qwen.
  • Разрешение 720p или 1080p — у Gemini и OpenRouter. Выше — чётче и дороже.
  • Зерно — одинаковое зерно и тот же промпт дают похожий результат. Есть у Qwen и OpenRouter.
  • Ждать готовности — по умолчанию 4 минуты, и спрашивать раз в 10 секунд. Это и есть механика: узел ставит задачу провайдеру и опрашивает её, пока ролик не готов.

Тяжёлые модели в минуту не укладываются — поднимайте ожидание, а не сокращайте ролик. Параметры показываются только тем провайдерам, которые их принимают.

Как описать сцену

Промпт для видео отличается от промпта для картинки одним: в нём нужно движение. Модель снимает не кадр, а несколько секунд, и если не сказать, что происходит, она придумает это сама.

  • Что в кадре: предмет, человек, обстановка. Конкретика лучше эпитетов.
  • Как движется камера: медленный облёт, наезд, проезд вдоль, статичный план. Статику тоже стоит указывать явно.
  • Что движется в кадре: пар над чашкой, страницы, ткань на ветру. Одно-два движения на пять секунд — больше модель смажет.
  • Свет и настроение: мягкий утренний, контровой, студийный.
  • Чего избегать — отдельным полем у Gemini и Qwen: текст на экране, люди в кадре, резкие склейки.

Короткие ролики дешевле, поэтому промпт отлаживают на пяти секундах и только потом ставят длительность и разрешение побольше. Одинаковое зерно у Qwen и OpenRouter помогает сравнивать правки промпта, а не случайность.

Что приходит на выход

  • provider и model — кто снимал и чем;
  • fileName, mimeType, bytes — имя файла, тип и размер;
  • durationSec — фактическая длительность, когда провайдер её называет;
  • ignored — параметры, которые провайдер не принял.

Сам файл лежит в бинарном поле data, имя поля меняется в параметрах.

Связка с соседними узлами

Отдельно взятая генерация видео — половина дела. В процессе она обычно стоит в середине:

Картинка → видео. Узел генерации изображений рисует кадр по описанию товара, узел видео берёт его стартовым кадром и добавляет движение. Так проще удержать нужный вид: композицию задаёт картинка, а не случайность модели.

Видео → озвучка. Ролик уходит в публикацию, а закадровый текст собирает языковая модель и озвучивает узел синтеза речи. Два файла делает один процесс.

Видео → рассылка. Готовый файл отправляется в Telegram, кладётся в хранилище или прикладывается к карточке на маркетплейсе — дальше работают обычные узлы интеграций.

Сценарии автоматизации

Ролики для карточек товара

Новый товар появился в учётной системе → описание собирается из характеристик → фото товара идёт стартовым кадром → получается короткий облёт вокруг предмета → файл уезжает в карточку и в папку с медиа.

Вертикальные сторис под соцсети

Тот же процесс с пропорциями 9:16 и другим промптом даёт вертикальную версию. Одна схема — два формата, руками ничего не переснимают.

Анонсы постов и рассылок

По заголовку статьи собирается пятисекундная заставка, ложится в рассылку и в чат редакции на согласование. Обложку к той же статье рисует соседний узел.

Персональные объявления

Для сегмента клиентов или конкретного города собирается свой ролик: летняя акция для одних, зимняя для других. Дальше рассылка или сообщение бота.

Оживление архива фотографий

Старые предметные фото по очереди уходят стартовыми кадрами, получая лёгкое движение, — каталог обновляется без новой съёмки.

Сколько это стоит

Видео — самая дорогая из ИИ-операций: провайдеры считают по секундам и по разрешению, и разница между 720p и 1080p заметна в счёте. Поэтому длительность и разрешение стоит подбирать осознанно, а промпт отлаживать на коротких роликах.

Считать удобно не за ролик, а за вариант: если процесс делает горизонтальную и вертикальную версии для каждого товара, счёт умножается на два. Поэтому вертикальную версию часто ставят на отдельную ветку с условием — и снимают её только для тех позиций, что действительно уходят в соцсети.

В Staqflow оплачивается только работа процесса: токены за CPU-секунды. Ожидание рендера процессор почти не грузит — узел просто спрашивает готовность раз в десять секунд, — так что в токенах сама съёмка стоит немного. Тарифы — на странице цен.

Частые вопросы

Какие нейросети снимают видео в Staqflow?

Пять провайдеров: OpenAI, Google Gemini, Qwen от Alibaba Cloud, xAI и OpenRouter с его каталогом моделей разных вендоров.

Можно ли оживить существующую фотографию?

Да, это и есть стартовый кадр: картинка берётся из бинарного поля или по ссылке. У Qwen для этого отдельные модели с i2v в имени — без картинки они не работают.

Сколько длится ролик?

От 1 до 60 секунд, по умолчанию пять. Реальная длительность зависит от модели: что она умеет, то и снимет, а фактическое значение вернётся в поле durationSec.

Почему процесс долго не отвечает?

Видео рендерится минутами. Узел ставит задачу и опрашивает её раз в десять секунд, пока не дождётся; по умолчанию ждёт четыре минуты. Для тяжёлых моделей ожидание стоит поднять.

Можно ли смонтировать ролик из своего видео?

Нет. Узел снимает по тексту и картинке, исходного ролика ему взять неоткуда — поэтому редакторы видео в списке моделей и не показываются.

Можно ли сменить провайдера в готовом процессе?

Да, в этом смысл общей панели: пропорции, длительность и остальное переводятся под новую модель, а то, что она не приняла, честно возвращается полем ignored.

Данные уходят во внешний сервис?

В облачные — да, как при любом вызове чужого API: промпт и стартовый кадр отправляются провайдеру. Если так нельзя, генерацию видео стоит держать вне процессов с чувствительными данными — собственный контур закрывает текстовые модели, но видео у всех пятерых считается в облаке.

Попробуйте

  1. Создайте аккаунт — карта не нужна.
  2. Поставьте рядом два узла: генерация изображения и генерация видео со стартовым кадром от неё.
  3. Или опишите задачу ИИ-клиенту через MCP: «Для каждого нового товара сними пятисекундный ролик и положи в карточку».

Куда отправить готовый файл — смотрите в каталоге интеграций.