Промпт для ИИ фото: как писать запросы, которые дают результат с первого раза
Большинство людей открывают нейросеть, пишут «красивая девушка на закате» — и получают нечто среднее между стоковой фотографией и сном после пиццы. Потом разочарованно закрывают вкладку и решают, что «ИИ пока не умеет». На самом деле умеет. Просто промпт — это язык, и его нужно учить.
За последние два года я протестировал сотни запросов, разобрал механику работы диффузионных моделей и нашёл закономерности, которые работают стабильно. В этой статье — всё, что нужно знать, чтобы сгенерировать фото нейросетью по описанию так, чтобы результат можно было сразу публиковать или использовать в проекте.
🧠 Почему 90% промптов не работают: анатомия провала
Прежде чем писать «правильно», нужно понять, почему большинство запросов дают посредственный результат.
Нейросеть для генерации изображений не «понимает» текст так, как человек. Она сопоставляет слова с огромной базой визуальных паттернов. Чем точнее вы описываете визуальные характеристики, а не абстрактные концепции — тем лучше результат.
⚠️ Важно: Слова «красивый», «потрясающий», «реалистичный» почти ничего не добавляют к качеству. Вместо них нужны конкретные технические и стилистические дескрипторы.
Три главные ошибки начинающих:
- Слишком абстрактный запрос — «счастливый человек на природе» вместо конкретного описания сцены, освещения, угла съёмки
- Отсутствие технических параметров — не указан стиль, формат, освещение, камера
- Перегрузка противоречиями — когда в одном промпте смешаны несовместимые стили или слишком много объектов без иерархии
🏗️ Архитектура идеального промпта: 6 обязательных блоков
Хороший промпт для ИИ фото строится как режиссёрский сценарий. Есть структура, которая работает для большинства задач:
| Блок | Что описывать | Пример |
|---|---|---|
| Субъект | Кто/что в центре кадра | портрет женщины 30 лет, рыжие волосы |
| Действие/поза | Что делает субъект | смотрит в сторону, лёгкая улыбка |
| Среда/локация | Где происходит сцена | уличное кафе, Париж, брусчатка |
| Освещение | Тип и качество света | золотой час, мягкий боковой свет |
| Стиль/техника | Художественный стиль или техника съёмки | editorial photography, Hasselblad |
| Технические параметры | Разрешение, соотношение сторон, качество | 8K, sharp focus, photorealistic |
💡 Совет: Пишите блоки именно в этом порядке — от общего к частному. Нейросеть «читает» начало промпта с большим весом, поэтому самое важное должно быть в первых словах.
✍️ Примеры промптов: от слабых к профессиональным
Портретная фотография
❌ Слабый промпт:
Красивая девушка, реалистично
✅ Профессиональный промпт:
Close-up portrait of a 28-year-old woman, auburn wavy hair,
freckles, natural makeup, looking slightly off-camera,
soft golden hour light from the left, bokeh background,
shot on Sony A7III with 85mm f/1.4 lens, editorial fashion photography,
Vogue style, 8K, ultra-sharp, film grain texture
✅ Промпт на русском (для моделей с поддержкой русского):
Портрет молодой женщины, каштановые волосы, веснушки,
естественный макияж, мягкий золотой свет, размытый фон,
редакционная фотография, журнальный стиль, резкость в глазах
📊 Факт: По данным исследований сообщества Midjourney, промпты длиннее 20 токенов в среднем дают результаты на 40% ближе к задуманному по сравнению с короткими запросами.
Пейзаж и архитектурная фотография
Aerial view of a misty mountain valley at sunrise,
dense pine forest, winding river reflecting pink sky,
fog patches between hills, dramatic light rays,
shot with DJI drone, landscape photography,
National Geographic style, golden ratio composition, 16:9, 8K HDR
AI-портрет в историческом стиле
Renaissance oil painting portrait, young nobleman,
dark velvet clothing with gold embroidery,
rembrandt lighting, dark background,
detailed brushwork, museum quality,
style of Rembrandt van Rijn, 1650s Netherlands
🎨 Стилевые дескрипторы: шпаргалка для быстрого результата
Один из самых мощных инструментов — правильный стилевой тег. Вот проверенные дескрипторы по категориям:
Фотографические стили
editorial photography— журнальный, глянцевый видstreet photography— живой, документальный стильcinematic photography— кинематографическое освещение и цветfine art photography— художественная, галерейная эстетикаdocumentary photography— репортажный реализм
Художественные стили
oil painting, baroque style— классическая живописьwatercolor illustration— акварельная нежностьdigital art, concept art— игровая/фэнтези эстетикаukiyo-e woodblock print— японская гравюраart nouveau— орнаментальный стиль Климта/Мухи
Параметры освещения
golden hour lighting— тёплый закатный светrembrandt lighting— драматический портретный светneon lights, cyberpunk— неоновое городское освещениеsoft box studio lighting— студийный ровный светbacklit, silhouette— контровый свет, силуэт
🔄 Face Swap и AI-портреты: особенности промптинга
Если вы хотите сгенерировать фото с помощью ИИ с конкретным лицом — например, перенести своё лицо в исторический портрет или на обложку журнала — работа с промптом имеет свою специфику.
Ключевые принципы:
- Нейтральный фон и поза в референсном фото — чем проще исходник, тем точнее результат face swap
- Описывайте всё, кроме лица — стиль, одежду, фон, освещение. Лицо нейросеть возьмёт из референса
- Указывайте ракурс —
frontal face,3/4 view,side profileдля предсказуемого результата - Используйте
preserve facial featuresкак якорный тег при работе со стилизацией
3/4 portrait view, [reference person],
wearing 19th century aristocratic clothing,
Victorian era setting, oil painting style,
preserve facial features, detailed, museum quality
💡 Совет: Платформы вроде Creatorry позволяют комбинировать face swap с кастомными стилевыми пресетами — это даёт намного более стабильный результат, чем ручной промптинг для каждого кадра.
⚙️ Негативные промпты: то, о чём все забывают
Негативный промпт — это список того, чего не должно быть на изображении. Это один из самых недооценённых инструментов.
Универсальный негативный промпт для реалистичных фото:
negative prompt: blurry, out of focus, low quality, pixelated,
artifacts, watermark, text, logo, extra limbs, deformed hands,
unnatural skin texture, overexposed, underexposed,
cartoonish, anime style, painting style
Для портретов — добавьте:
asymmetrical face, crossed eyes, bad teeth, unnatural smile,
plastic skin, airbrushed, over-retouched
⚠️ Важно: Негативные промпты не работают как «фильтры» в прямом смысле — они снижают вероятность появления нежелательных элементов, но не исключают их полностью. При повторной генерации пробуйте разные формулировки.
📸 Технические параметры: таблица настроек
Чтобы сгенерировать фото нейросетью онлайн с максимальным качеством, используйте технические теги в конце промпта:
| Параметр | Теги для качества | Когда использовать |
|---|---|---|
| Резкость | sharp focus, tack sharp, 8K |
Всегда для реалистичных фото |
| Детализация | highly detailed, intricate details |
Портреты, текстуры |
| Соотношение сторон | 16:9, 1:1, 9:16, 4:5 |
Зависит от платформы |
| Зернистость/пленка | 35mm film grain, analog film |
Ретро-эстетика |
| Глубина резкости | shallow depth of field, f/1.8 |
Портреты с боке |
| Цветовая палитра | moody tones, warm palette, desaturated |
Mood и атмосфера |
🚀 Промпт-инжиниринг для разных платформ
Важный нюанс: сгенерировать фото по описанию ИИ на разных платформах — не одно и то же. Модели имеют разную «чувствительность» к тегам.
Midjourney
- Лучше работает с английским языком
- Поддерживает параметры
--ar(aspect ratio),--v(версия модели),--stylize - Хорошо реагирует на упоминания конкретных художников и фотографов
Stable Diffusion
- Максимальный контроль через CFG scale и seed
- Критически важны негативные промпты
- Поддерживает ControlNet для точного управления позой и композицией
DALL-E 3 / ChatGPT
- Лучше понимает развёрнутые описания на естественном языке
- Менее чувствителен к техническим тегам, больше к нарративу
- Хорошо работает с русскоязычными промптами
📊 Факт: DALL-E 3 показывает лучшие результаты при описании сцены как истории («молодой архитектор сидит за чертёжным столом при свете настольной лампы в 1960-х»), а Midjourney — при использовании технических дескрипторов через запятую.
🎯 Итерационный подход: как улучшать результат шаг за шагом
Даже опытные пользователи редко получают идеальный результат с первой попытки. Профессиональный подход — итерация:
- Первый промпт — базовый, проверяем общую концепцию и композицию
- Анализ результата — что получилось хорошо? Что нужно изменить?
- Корректировка — добавляем/убираем теги, уточняем описание
- Фиксируем seed — нашли удачный результат? Запоминаем seed-число для воспроизводимости
- Вариации — генерируем вариации от удачного результата
Чеклист перед финальной генерацией:
- Субъект чётко определён в начале промпта
- Указано освещение
- Указан стиль или техника
- Добавлены технические параметры качества
- Заполнен негативный промпт
- Соотношение сторон соответствует задаче
💡 Что стоит взять с собой
Промпт — это не магическое заклинание, а профессиональный инструмент. Вот главное:
- Структура важнее длины. Хорошо организованный промпт из 15 слов даст лучший результат, чем хаотичный из 50
- Конкретика бьёт абстракцию. «Боке f/1.4» лучше, чем «красиво размытый фон»
- Негативный промпт — ваш редактор. Используйте его всегда
- Тестируйте стили. Добавление одного стилевого тега может полностью изменить характер изображения
- Итерируйте. Три попытки с правками лучше, чем тридцать случайных генераций
- Учитывайте платформу. То, что работает в Midjourney, может не работать в DALL-E — и наоборот
Мастерство промпт-инжиниринга — это навык, который накапливается с практикой. Ведите личную библиотеку удачных промптов, экспериментируйте со стилями и не бойтесь сломать то, что работает — именно так находятся лучшие решения.
❓ FAQ: Частые вопросы о промптах для ИИ-фотографии
1. На каком языке лучше писать промпт для ИИ фото — на русском или английском?
Для большинства современных моделей английский язык даёт более стабильный и качественный результат. Это связано с тем, что обучающие датасеты преимущественно англоязычные, и связи между словами и визуальными паттернами там более богатые. Тем не менее DALL-E 3 и ряд других моделей хорошо работают с русскоязычными описаниями. Оптимальная стратегия: основное описание на английском, а для экспериментов с моделями на основе GPT-4 можно использовать русский.
2. Как сгенерировать фото нейросетью онлайн без установки программ?
Существует несколько удобных веб-сервисов: Midjourney (через Discord или веб-интерфейс), Adobe Firefly, Leonardo.ai, Ideogram, а также специализированные платформы для контент-криейторов. Большинство из них предлагают бесплатный тестовый доступ. Для начала достаточно браузера и базового понимания структуры промпта — именно с этого стоит начать, прежде чем переходить к локальным инструментам вроде Stable Diffusion.
3. Сколько слов должен содержать хороший промпт?
Оптимальная длина — от 20 до 60 токенов (примерно 15–50 слов). Слишком короткий промпт не даёт модели достаточно информации, слишком длинный создаёт противоречия и «размывает» внимание модели. Важнее структура и точность, чем объём. Если промпт превышает 70–80 слов, скорее всего, в нём есть лишнее — попробуйте убрать абстрактные определения и оставить только визуально значимые дескрипторы.
4. Почему ИИ генерирует деформированные руки и как это исправить?
Это классическая проблема диффузионных моделей — руки состоят из многих мелких деталей с нелинейной геометрией, что сложно для нейросетей. Решения: добавить в негативный промпт deformed hands, extra fingers, missing fingers, bad anatomy; использовать более новые версии моделей (Midjourney v6, SDXL показывают заметно лучшие результаты); скомпоновать сцену так, чтобы руки не были в фокусе; использовать ControlNet с skeleton-контролем для точного задания позы.
5. Как создать серию фотографий с одинаковым персонажем через промпты?
Это одна из главных сложностей текущего поколения моделей — консистентность персонажа. Лучшие подходы: зафиксировать seed удачного изображения и генерировать вариации от него; использовать инструменты IP-Adapter или Face ID в Stable Diffusion для «закрепления» внешности; описывать максимально специфичные и уникальные черты персонажа в каждом промпте (цвет глаз, форма лица, причёска, родинки); использовать специализированные инструменты для тренировки LoRA-модели на конкретном персонаже — это даёт наиболее стабильный результат при серийной генерации.