Чаще всего генерация группы друзей-мужчин в нейросети ломается на одном и том же: модель «склеивает» лица, рисует лишние руки или делает всех персонажей близнецами. Причина почти всегда в самом промте — запрос «группа друзей» без деталей заставляет ИИ копировать один усреднённый образ несколько раз. Первое действие, которое стоит проверить, — описан ли каждый персонаж в запросе отдельно, с собственной внешностью, одеждой и позой.
В этой статье разберём, как составить промт для генерации друзей-мужчин в популярных нейросетях — Midjourney, Stable Diffusion, DALL-E, Kandinsky и Шедеврум. Вы получите готовые шаблоны запросов, таблицу ключевых параметров и разбор типичных ошибок, из-за которых результат выглядит неестественно.
Как нейросеть понимает запрос про группу людей
Генеративные модели обрабатывают текст как набор взвешенных признаков. Когда вы пишете «трое друзей», модель получает слабый сигнал о количестве и почти никакой информации о различиях между персонажами. В результате она берёт один наиболее вероятный «мужской» образ из обучающих данных и тиражирует его.
Чтобы этого избежать, запрос строится по принципу «общая сцена + индивидуальные описания». Сначала задаётся контекст — локация, освещение, стиль изображения. Затем каждый персонаж описывается отдельным блоком: возраст, телосложение, причёска, одежда, поза, эмоция.
Главное правило: каждый персонаж в промте должен иметь уникальное описание. Без этого нейросеть сгенерирует клонов одного «среднего» мужчины.
Обратите внимание: чем больше людей в кадре, тем выше риск артефактов. Реалистичнее всего модели справляются с двумя-тремя персонажами. Группы из пяти и более человек стабильно дают деформации лиц и конечностей, особенно в бесплатных версиях сервисов.
Структура эффективного промта
Рабочий промт для группы мужчин состоит из пяти логических блоков. Их порядок не критичен, но полнота — да.
- 📍 Сцена и локация: где происходит действие (бар, гараж, футбольное поле, поход, офис).
- 👤 Персонажи: отдельное описание каждого друга — возраст, стиль, внешность.
- 🎭 Эмоции и взаимодействие: смех, объятия, тост, дружеский жест — это «склеивает» группу в единую сцену.
- 📷 Камера и свет: тип кадра (крупный план, в полный рост), освещение (золотой час, неон, дневной свет).
- 🎨 Стиль: фотореализм, кинематографичный кадр, аниме, цифровая живопись.
Пример собранного промта на английском (большинство моделей понимают его лучше русского):
Three male friends in their 30s laughing together at a rooftop bar at sunset, one tall with a beard wearing a denim jacket, one with glasses and a hoodie, one bald in a leather jacket, candid photo style, golden hour lighting, shallow depth of field, photorealistic
Для русскоязычных сервисов вроде Kandinsky или Шедеврума тот же запрос переводится дословно — эти модели обучались в том числе на русских описаниях.
Пишите промт на английском даже для русскоязычных сервисов через переводчик — точность попадания в задумку обычно выше, так как большая часть обучающих данных моделей англоязычная.
Примеры промтов под разные сценарии
Ниже — готовые шаблоны, которые можно адаптировать под свою задачу. Заменяйте описания персонажей и локацию, сохраняя структуру.
| Сценарий | Ключевые слова в промте | Особенности |
|---|---|---|
| Друзья на природе | camping, campfire, hiking clothes, forest background | Указывайте время суток — костёр ночью даёт красивый контровый свет |
| Спортивная команда | football team, sportswear, stadium, dynamic pose | Добавьте «motion blur» для эффекта движения |
| Дружеская вечеринка | house party, toasting, casual clothes, warm indoor light | Избегайте более 4 персонажей — высок риск артефактов |
| Деловая команда | business casual, office, meeting, confident expressions | Уточняйте дресс-код, иначе получите одинаковые костюмы |
| Стиль аниме/комикс | anime style, group of male friends, detailed faces | Для Stable Diffusion используйте специализированные anime-модели |
Обратите внимание на колонку «Особенности» — это те нюансы, которые чаще всего упускают. Например, без указания времени суток модель выберет нейтральный дневной свет, и атмосфера сцены потеряется.
Пошаговая инструкция: от идеи до готового изображения
Начните с простого: сгенерируйте сцену с двумя персонажами, прежде чем переходить к большим группам. Так проще отладить промт и понять, как конкретная модель реагирует на ваши формулировки.
☑️ Проверка промта перед генерацией
Далее действуйте итеративно. Сгенерировали — посмотрели, что не так — уточнили один блок промта — сгенерировали снова. Не меняйте всё сразу: иначе вы не поймёте, какая правка сработала. Если лицо одного персонажа искажено, добавьте к его описанию детали (черты лица, выражение) или уменьшите число людей в кадре.
В Stable Diffusion дополнительно используйте негативный промт — поле, где перечисляется то, чего в картинке быть не должно:
deformed faces, extra limbs, extra fingers, cloned face, blurry, low quality
⚠️ Внимание: не все сервисы поддерживают негативные промты. В DALL-E и Шедевруме отдельного поля нет — там нежелательные элементы исключаются формулировками внутри основного запроса, например «each person has a distinct face».
Типичные ошибки и как их исправить
Самая частая жалоба — «все друзья получились на одно лицо». Это следствие отсутствия дифференцирующих признаков. Добавьте каждому персонажу минимум три уникальные черты: возраст, растительность на лице, очки, цвет волос, головной убор, заметно различающуюся одежду.
Вторая проблема — лишние пальцы и конечности при физическом контакте персонажей (объятия, рукопожатия, рука на плече). Чем теснее физический контакт между персонажами, тем выше вероятность деформации рук — это ограничение текущего поколения моделей, а не ошибка вашего промта. Смягчить проблему можно, описав позы проще: «standing side by side» вместо «hugging».
- 🚫 Слишком длинный промт — модель теряет ранние токены; держите запрос в пределах 60–80 слов.
- 🚫 Абстрактные эмоции без визуальной привязки — «дружеская атмосфера» модель не поймёт, замените на «laughing, relaxed poses».
- 🚫 Противоречия — «photorealistic anime» собьёт модель; выбирайте один стиль.
- 🚫 Более 4–5 персонажей — резкий рост артефактов, разбейте группу на несколько генераций.
Почему ИИ путается в руках и пальцах
Генеративные модели не «понимают» анатомию — они предсказывают вероятные пиксели. Руки в обучающих данных часто частично скрыты, находятся в сложных ракурсах и сильно варьируются, поэтому модель хуже всего воспроизводит именно их. Взаимодействие двух людей удваивает количество рук в кадре и резко повышает шанс ошибки.
Особенности популярных сервисов
Midjourney даёт наиболее художественные и «живые» групповые сцены, но требует подписки и работает через Discord или веб-интерфейс. Параметр --ar 16:9 задаёт горизонтальный кадр, удобный для группы.
Stable Diffusion — выбор для тех, кто хочет полный контроль: негативные промты, настройка сэмплеров, возможность запуска локально на своём ПК с подходящей видеокартой. Порог входа выше, зато нет ограничений на число генераций.
Kandinsky и Шедеврум удобны русскоязычным интерфейсом и бесплатным доступом. Качество лиц в групповых сценах уступает Midjourney, поэтому для них особенно важно ограничивать число персонажей двумя-тремя.
⚠️ Внимание: генерация изображений реальных людей без их согласия может нарушать правила сервисов и законодательство о защите персональных данных и изображений. Используйте нейросети для создания вымышленных персонажей или получите согласие людей, чьё сходство воспроизводите.
Сохраняйте удачные промты в отдельный файл с пометкой, какая модель и настройки использовались. Через месяц экспериментов у вас будет личная библиотека рабочих шаблонов.
FAQ: частые вопросы
На каком языке писать промт — русском или английском?
Английский предпочтительнее: большинство моделей обучались преимущественно на англоязычных парах «текст — изображение», поэтому точность интерпретации выше. Русскоязычные сервисы (Kandinsky, Шедеврум) корректно понимают и русский, но для сложных групповых сцен английский всё равно даёт более предсказуемый результат.
Почему все персонажи получаются похожими друг на друга?
Модель тиражирует один усреднённый образ, если персонажи не различены в тексте. Опишите каждого отдельно: возраст, телосложение, причёска, растительность на лице, одежда, аксессуары. Трёх-четырёх уникальных признаков на человека обычно достаточно.
Сколько людей можно разместить на одной генерации без артефактов?
Наиболее стабильный результат — два-три персонажа. Четыре уже заметно повышают риск деформаций лиц и рук, пять и более почти гарантированно дают артефакты. Если нужна большая группа, сгенерируйте сцену по частям и соберите в графическом редакторе.
Что такое негативный промт и где его вводить?
Это список того, чего на изображении быть не должно: деформации, лишние конечности, размытие. Поле для негативного промта есть в Stable Diffusion и ряде других интерфейсов. В сервисах без такого поля ограничения вписывают в основной запрос естественной фразой.
Можно ли сгенерировать фото с конкретными реальными друзьями?
Технически частично возможно через функции загрузки референса (если они предусмотрены сервисом), но точное сходство без специальных инструментов не гарантируется. Кроме того, использование изображений реальных людей требует их согласия — учитывайте правила сервиса и законодательные ограничения.