Промт «две девушки в бане» — типичный пример запроса, где нейросеть без детализации выдаёт случайный результат: неправильное число персонажей, смазанные лица или интерьер, похожий на что угодно, кроме бани. Причина почти всегда одна — модель получила слишком мало информации о сцене, освещении, позах и стиле, и достроила картинку по своему усмотрению. Чтобы получить предсказуемый результат, запрос нужно собирать из конкретных блоков: субъекты, окружение, свет, стиль и технические параметры.

В этом материале разберём, как структурировать такой промт для популярных генераторов изображений — Midjourney, Stable Diffusion и DALL-E, какие детали критичны именно для сцены в бане (пар, дерево, полотенца, веники) и какие ошибки чаще всего портят генерацию. Все примеры приведены для художественной, безопасной съёмки — в стиле lifestyle-фотографии или иллюстрации.

Из чего состоит рабочий промт для сцены в бане

Любой устойчивый промт строится по одной схеме: сначала главное, потом уточнения. Нейросети придают больший вес словам в начале запроса, поэтому субъекты и действие должны идти первыми, а стилистические уточнения — в конце.

  • 👥 Субъекты: «two young women» — сразу фиксируем количество, иначе модель может добавить третьего персонажа или потерять второго.
  • 🏠 Локация: «in a traditional wooden sauna» — слово sauna модели понимают стабильнее, чем «banya», но можно добавить «russian banya style» для аутентичности.
  • 💡 Освещение: «warm soft light, steam atmosphere» — пар и тёплый свет задают 80% атмосферы банной сцены.
  • 🎨 Стиль: «photorealistic» для фото-результата или «digital illustration» для арта.
  • 📷 Камера: для фотореализма добавляют «shot on 35mm lens, shallow depth of field».

Обратите внимание: пропуск любого блока не делает промт нерабочим, но передаёт контроль модели. Если не указать свет, получите плоское студийное освещение, которое разрушит атмосферу парной.

Готовые примеры промтов

Ниже — базовый шаблон, который можно адаптировать. Он написан на английском, потому что большинство моделей обучались преимущественно на англоязычных описаниях и понимают их точнее.

two young women relaxing in a traditional wooden sauna, wrapped in white towels, steam rising, warm golden light, wooden benches and birch brooms (venik), cozy atmosphere, photorealistic, soft focus, 35mm photography

Для иллюстративного стиля структура та же, меняется только хвост:

two girls in a russian banya, sitting on wooden bench, steam, warm ambient light, anime style, detailed background, soft colors
💡

Слова-маркеры «venik» (веник), «wooden bucket», «steam» резко повышают узнаваемость банной сцены — добавляйте минимум два таких атрибута.

Порядок слов внутри промта можно менять, но субъекты и локацию лучше держать в первой трети запроса. Длинные промты из 40+ слов модели типа Stable Diffusion начинают «переваривать» хуже — лишние детали размывают главное.

Негативный промт: что исключить из генерации

В Stable Diffusion и её интерфейсах (AUTOMATIC1111, ComfyUI) есть отдельное поле negative prompt — список того, чего на картинке быть не должно. Для сцен с людьми он особенно важен, потому что именно лица и руки чаще всего ломаются.

deformed hands, extra fingers, bad anatomy, blurry faces, extra people, watermark, text, low quality

В Midjourney отдельного поля нет — там используется параметр --no, например: --no text, watermark, extra people. В DALL-E негативные формулировки работают слабо, модель лучше реагирует на позитивное описание желаемого результата.

⚠️ Внимание: не перегружайте негативный промт. Список из 20+ запретов может ухудшить общее качество картинки — модель начинает «бояться» генерировать детали вообще. Достаточно 6–10 ключевых исключений.
📊 Какой генератор изображений вы используете чаще всего?
Midjourney
Stable Diffusion
DALL-E
Другой / только пробую

Настройки и параметры для разных моделей

Один и тот же промт в разных сервисах ведёт себя по-разному, потому что у них разные механизмы интерпретации и параметры. Соберём ключевые отличия в таблицу.

ПараметрMidjourneyStable DiffusionDALL-E 3
Язык промтаАнглийский предпочтителенАнглийскийПонимает русский
Негативный промтЧерез --noОтдельное полеНе поддерживается
Соотношение сторон--ar 16:9Размер в настройкахВыбор из пресетов
Контроль числа людейСреднийСлабый без ControlNetХороший
Стиль по умолчаниюХудожественныйЗависит от чекпоинтаФотореалистичный

Точное поведение зависит от версии модели и выбранного чекпоинта, поэтому перед серией генераций сделайте 2–3 тестовых прогона и сверьтесь с документацией вашего интерфейса. В Stable Diffusion на результат сильно влияют параметры CFG Scale (насколько строго модель следует промту) и число шагов сэмплирования — универсальных значений нет, их подбирают под конкретную модель.

Типичные ошибки и как их исправить

Самая частая жалоба — модель рисует одного персонажа вместо двух или «склеивает» фигуры. Возможная причина: недостаточно явное указание количества и разделения поз. Помогает формулировка «two women sitting side by side» — она фиксирует и число, и пространственное разделение.

  • 🔁 Лишние персонажи: добавьте «only two people» и «extra people» в негативный промт.
  • 🌫️ Слишком много пара: слово «steam» без уточнений может затопить весь кадр — используйте «light steam» или «subtle steam».
  • 🪵 Интерьер не похож на баню: усильте детали — «wooden walls, wooden benches, bucket and ladle».
  • 😶 Искажённые лица: добавьте «detailed face, symmetrical face», а в Stable Diffusion — включите восстановление лиц, если функция предусмотрена вашим интерфейсом.

☑️ Проверка промта перед генерацией

Выполнено: 0 / 6
⚠️ Внимание: сервисы генерации изображений имеют правила контента. Запросы с откровенными сценами блокируются фильтрами, а аккаунт может получить ограничения. Формулируйте промт в рамках художественной lifestyle-сцены — полотенца, пар, интерьер.

Как улучшать результат итерациями

Редко кто получает идеальную картинку с первого запроса — нормальный процесс выглядит так: генерация → анализ → точечная правка промта → повтор. Меняйте за одну итерацию один-два элемента, иначе не поймёте, что именно сработало.

В Midjourney полезна функция вариаций (кнопки V1–V4 под результатом): модель сохраняет композицию успешного варианта и перегенерирует детали. В Stable Diffusion аналогичную роль играет фиксация seed — можно менять промт, сохраняя базовую композицию кадра.

Продвинутый приём

веса слов:В Stable Diffusion можно усиливать значимость слова синтаксисом (word:1.3) — например, (steam:1.2) сделает пар заметнее, а (two women:1.4) повысит шанс корректного числа персонажей. В Midjourney веса задаются через двойное двоеточие: steam::1.2.

Если лицо второго персонажа стабильно ломается, не обязательно переписывать весь промт — в ряде интерфейсов есть инпейнтинг: выделяете проблемную область и перегенерируете только её. Это быстрее и сохраняет удачные части кадра.

💡

Формула стабильного промта: субъекты + действие → локация с атрибутами → свет и атмосфера → стиль → технические параметры. Пропуск блока = отдаёте решение модели.

FAQ: частые вопросы

Можно ли писать промт на русском языке?

В DALL-E 3 и некоторых новых моделях — да, русский понимается неплохо. Для Midjourney и Stable Diffusion английский даёт заметно более предсказуемый результат, так что русские описания лучше переводить.

Почему модель рисует одного человека вместо двух?

Генераторам сложно удерживать несколько персонажей. Помогает явное «two women», описание поз («sitting side by side») и веса слов в Stable Diffusion. Иногда проще сгенерировать сцену по одному персонажу и скомбинировать через инпейнтинг.

Как сделать пар реалистичным, а не молочным туманом?

Используйте уточнения «light steam», «wisps of steam», «soft haze» вместо просто «steam». Слишком сильное слово «fog» или «dense steam» обычно заливает весь кадр.

Какое соотношение сторон выбрать для такой сцены?

Для атмосферной сцены с интерьером удобны горизонтальные форматы вроде 16:9 или 3:2. Вертикальные (9:16, 2:3) лучше работают, если акцент на персонажах, а не на окружении.

Почему один и тот же промт даёт разные картинки?

Генерация стохастична: каждый запуск начинается со случайного шума. Чтобы воспроизвести результат, зафиксируйте параметр seed — он поддерживается в Stable Diffusion и Midjourney (команда для получения seed зависит от интерфейса).