§ БЛОГ

Генерация изображений в workflow: новая нода Staqflow с девятью провайдерами в одной панели

В Staqflow появился узел «Генерация изображения»: картинки рисуют модели OpenAI, Gemini, GigaChat, Yandex, Qwen, xAI, Mistral, OpenRouter или ваш сервер. Девять провайдеров и десятки моделей настраиваются одной панелью — референсы, пропорции, прозрачный фон, а готовые файлы сразу уходят в Telegram, на маркетплейс или в хранилище.

Генерация изображений в workflow: новая нода Staqflow с девятью провайдерами в одной панели

Картинки нужны почти каждому процессу: карточке товара — предметное фото, посту — обложка, рассылке — баннер под каждый сегмент, поддержке — иллюстрация к инструкции. Обычно это ручная работа дизайнера или самодельный скрипт вокруг API нейросети, который знает один сервис и ломается при первой же смене модели.

В Staqflow появился узел «Генерация изображения». Он рисует картинку по текстовому описанию и отдаёт готовый файл следующему шагу процесса: в Telegram, на маркетплейс, в хранилище или в письмо. Девять провайдеров — и все их рисующие модели — настраиваются одной и той же панелью, поэтому сменить нейросеть можно, не перестраивая workflow.

Что умеет узел «Генерация изображения»

  • Рисует по описанию. Промпт можно собрать из данных процесса: названия товара, темы статьи, имени клиента.
  • Работает с референсами. Картинки со входа можно изменить, объединить или взять из них стиль.
  • Отдаёт готовые файлы. Каждая картинка — отдельный элемент выхода с файлом в бинарном поле, поэтому её сразу принимает любой узел, который умеет работать с файлами.
  • Скрывает различия провайдеров. Пропорции, качество, фон и формат задаются одинаково, а перевод в параметры конкретного API узел берёт на себя.

Девять провайдеров в одной панели

Провайдер — это сервис, к которому вы подключаетесь ключом. Моделей внутри каждого гораздо больше, и выбираются они отдельным полем.

ПровайдерЧем рисуетРеференсы
OpenAIмодели GPT Image и DALL·Eдо 16
Google Geminiмодели Gemini, которые умеют рисоватьдо 14
xAI (Grok)рисующие модели Grokдо 5
Qwen (Alibaba Cloud)семейства qwen-imageдо 3
OpenRouterкаталог рисующих моделей разных вендоровзависит от модели
GigaChatчат-модель со встроенным инструментом рисованиянет, только текст
Mistralчат-модель со встроенным инструментом рисованиянет, только текст
Yandex CloudAlice AI ART (пришёл на смену YandexART)нет, только текст
Свой сервервсё, что говорит на протоколе OpenAIзависит от сервера

Список моделей узел подтягивает сам: у OpenRouter — из открытого каталога рисующих моделей, у остальных — из вашего аккаунта, и рисующие отбираются автоматически. Модель можно выбрать из списка или вписать её название руками, если она вышла только вчера.

Последняя строка таблицы важна для тех, кому нельзя отправлять данные во внешние сервисы: в собственном контуре к узлу подключается локальная модель, совместимая с протоколом OpenAI.

Как настроить

  1. Добавьте подключение к нужному сервису в учётных данных пространства: ключ API, у Yandex Cloud ещё и каталог.
  2. Поставьте узел «Генерация изображения» на канву и выберите провайдера и модель. Провайдер выбирается прямо в узле, отдельного диалога для этого не нужно.
  3. Опишите картинку в поле «Что нарисовать». Здесь работают выражения: Предметное фото: {{ $json.title }} на белом фоне.
  4. Задайте форму кадра и количество. Пропорции: квадрат, 3:2, 2:3, 4:3, 3:4, 16:9 и 9:16 для сторис. Есть вариант «Авто» — тогда решает модель.

Пропорция переводится в то, что понимает конкретная модель: у моделей с фиксированной сеткой размеров берётся ближайший. Фактический размер приходит в ответе, поэтому следующий узел всегда знает, что именно получилось. GigaChat размер не принимает — там его выбирает сама модель.

Референсы: изменить, объединить, взять стиль

Картинки для референса берутся из бинарного поля входного элемента или по ссылке. Что с ними сделать, скажите в промпте: «замени фон на белый», «нарисуй в этом стиле», «собери коллаж из этих трёх фото». Если модель референсы не принимает или их больше, чем она берёт, узел скажет об этом до запуска, а не после оплаты запроса.

Отдельно для OpenAI есть маска: PNG, где прозрачные области будут перерисованы. Так меняют кусок картинки, не трогая остальное.

Дополнительные параметры

  • Чего избегать — то, чего не должно быть на картинке. Qwen принимает это отдельным полем, остальным провайдерам просьба дописывается в промпт.
  • Разрешение 1K, 2K или 4K. У xAI и Qwen — до 2K, у OpenAI выбор есть только у GPT Image 2 и новее.
  • Качество низкое, среднее или высокое: чем выше, тем дороже и дольше.
  • Фон — прозрачный или непрозрачный. Прозрачный работает с PNG и WebP: стикеры, логотипы, товар без фона.
  • Формат файла PNG, JPEG или WebP.
  • Seed — одинаковый seed и промпт дают похожую картинку там, где модель это умеет.
  • Улучшать промпт у Qwen: модель сама переписывает короткое описание в подробное. Выключите, если важна точная формулировка.
  • Таймаут — по умолчанию 5 минут. Высокое качество и несколько картинок рисуются минутами.

Параметры показываются только тем провайдерам, которые их принимают. А если модель что-то всё-таки проигнорировала, узел назовёт это в поле ignored в ответе, вместо того чтобы промолчать.

Что приходит на выход

Каждая картинка — отдельный элемент выхода. Это важно для следующего шага: узел Telegram отправит все четыре картинки, если это четыре элемента, и только первую, если бы они лежали в одном. Если модель рисует меньше картинок за запрос, чем вы попросили, узел просто сделает несколько запросов подряд.

Вместе с файлом в элементе приходят данные о нём:

  • provider и model — кто и чем рисовал;
  • fileName, mimeType, width, height — имя файла, тип и фактический размер;
  • revisedPrompt — как модель переформулировала описание, если она это делает;
  • ignored — параметры, которые модель не приняла;
  • usage — расход по данным провайдера, на весь запрос целиком.

Файл лежит в бинарном поле data, имя поля можно поменять в параметрах.

Сценарии автоматизации с генерацией картинок

Карточки товаров для маркетплейсов

Новый товар появился в учётной системе → узел берёт название и характеристики → рисует предметное фото на белом фоне в пропорции 1:1 → картинка уходит в карточку на Wildberries или Ozon, а заодно в папку с медиа. Прозрачный фон пригодится, если фото потом накладывают на фирменную подложку.

Обложки для постов и рассылок

Процесс берёт заголовок статьи из CMS, рисует обложку 16:9 и версию 9:16 для сторис, складывает файлы в хранилище и отправляет в чат редакции на согласование. Одобренный вариант публикуется, остальные удаляются.

Персональные картинки в письмах и ботах

Для сегмента подписчиков или конкретного клиента генерируется баннер с нужным сюжетом: летняя акция для одного города, зимняя — для другого. Дальше картинка уходит в рассылку или в сообщение Telegram-бота.

Картинки по фото клиента

Клиент присылает фото комнаты или товара в бот. Узел берёт его как референс и рисует вариант в другом стиле или с заменённым фоном. Ответ уходит обратно в чат тем же процессом.

Иллюстрации к документации и инструкциям

По тексту раздела процесс рисует схему или иллюстрацию в едином стиле, сохраняет в хранилище и подставляет ссылку в статью.

Сколько это стоит

Запросы к нейросети оплачиваются на стороне провайдера по вашему тарифу: OpenAI, Google, Сбер, Yandex Cloud, Alibaba Cloud или OpenRouter. Оплачивается каждая картинка, поэтому количество и качество стоит подбирать осознанно.

В Staqflow оплачивается только работа процесса: 1 токен = 1 CPU-секунда runtime. Ожидание ответа нейросети — это не нагрузка на процессор, поэтому сама генерация в токенах почти ничего не стоит. Тарифы — на странице цен.

Частые вопросы

Какие нейросети умеют рисовать в Staqflow?

Девять провайдеров: OpenAI, Google Gemini, xAI (Grok), Qwen от Alibaba Cloud, OpenRouter, GigaChat, Mistral, Yandex Cloud и любой сервер с протоколом OpenAI. Конкретных моделей внутри них гораздо больше, и список подтягивается из вашего аккаунта.

Можно ли рисовать российскими нейросетями?

Да. GigaChat рисует чат-моделью со встроенным инструментом, а в Yandex Cloud картинки рисует Alice AI ART, пришедший на смену YandexART.

Можно ли сменить провайдера или модель в готовом процессе?

Да, в этом и смысл общей панели. Пропорции, количество и остальные параметры переводятся под новую модель, а фактический размер возвращается в ответе.

Как отправить несколько картинок в Telegram?

Достаточно поставить узел Telegram следующим шагом: каждая картинка приходит отдельным элементом, поэтому отправятся все.

Можно ли редактировать существующую картинку?

Да. Передайте её референсом из бинарного поля или по ссылке и опишите в промпте, что изменить. У OpenAI можно добавить маску и перерисовать только выбранную область.

Что делать, если модель ответила текстом вместо картинки?

Так бывает, когда промпт звучит как вопрос. Узел сообщит об этом и покажет ответ модели — сформулируйте описание как просьбу нарисовать.

Почему провайдер не вернул ни одной картинки?

Обычно промпт не пропустила модерация. Узел в этом случае останавливает процесс с ошибкой, а не отправляет дальше пустой результат.

Попробуйте

  1. Создайте аккаунт — карта не нужна.
  2. Добавьте подключение к нейросети, которой пользуетесь.
  3. Поставьте узел «Генерация изображения» на канву или опишите задачу своему ИИ-клиенту через MCP: «Каждое утро бери новые товары и рисуй им обложки».

Остальные сервисы, которым можно передать готовую картинку, — в каталоге интеграций.