ИИ-фотосессия: как написать промпт и получить удачные фотографии
Разбираемся, как составить запрос для нейросети, подобрать исходное фото и добиться большего сходства.
Чтобы устроить фотосессию, больше не обязательно искать фотографа, студию и подходящую локацию — нейросеть может отправить вас хоть на обложку модного журнала, хоть на улицы Токио. Но получить красивый кадр, на котором вы ещё и похожи на себя, бывает сложнее, чем кажется: ИИ меняет черты лица, путается в деталях и порой слишком творчески интерпретирует даже подробные инструкции.
Как выбрать исходное фото, составить понятный промпт и управлять внешностью, светом, ракурсом и стилем ИИ-фотосессии, разбирались вместе с экспертом по нейросетям Александрой Дудиной и IT-специалистом, коллажистом и бильд-редактором Дмитрием Руденком.
Содержание:
- Как устроена ИИ-фотосессия
- Какие сервисы лучше подойдут для ИИ-фотосессии
- Как составить промпт для ИИ-фотосессии
- Как сохранить внешность человека с исходного фото
- Как настроить свет, ракурс, камеру и стиль
- Как правильно прописать в промпте ограничения и негативные инструкции
- Как выбрать исходное фото для обработки нейросетью
- Как адаптировать промпт под разные нейросети
- Почему результат генерации может получиться неудачным и как это исправить
Как устроена ИИ-фотосессия
ИИ-фотосессией обычно называют несколько разных способов работы с изображением. Разберёмся, чем они различаются и от чего зависит, насколько точно нейросеть сохранит внешность и детали исходника.

Дмитрий Руденок
IT-специалист, коллажист и бильд-редактор
— Сегодня создание промптов стало куда проще и даже новичок может легко научиться с ними работать. Современные ИИ-модели лучше понимают связные формулировки текста и воспринимают их как полноценное техническое задание, а не как набор ключевых тегов, перечисленных через запятую. Некоторые сервисы буквально превращаются в генеративные фоторедакторы с возможностью подкрутить параметры ползунками без написания промптов.

Есть три основных способа работать с фотографиями через нейросети: генерация изображения с нуля, генерация вариации по референсу и редактирование исходного кадра.
При генерации с нуля пользователь описывает будущий кадр текстом: внешность человека, одежду, позу, фон, освещение, стиль съёмки. Нейросеть создаёт изображение самостоятельно. Если нужно получить портрет конкретного человека, одного текстового описания обычно недостаточно — модели понадобятся фотографии персонажа, на которые она сможет опираться.

Создание вариации по референсу предполагает, что пользователь загружает исходное изображение, а нейросеть использует его как ориентир. Например, можно сохранить общие черты лица человека, но изменить одежду, позу, интерьер или стилистику съёмки. При этом результат не будет точной копией исходного кадра: при каждой генерации модель фактически создаёт новое изображение.

При редактировании готового фото нейросеть меняет отдельные элементы уже существующего изображения: убирает предмет из кадра, заменяет фон, корректирует одежду или причёску, расширяет изображение за пределы исходного кадра.

Результат ИИ-фотосессии зависит от выбранной модели, качества референсов и точности запроса. Разные модели неодинаково хорошо сохраняют лицо, пропорции тела, одежду и мелкие детали, поэтому готовые изображения стоит внимательно проверять на сходство и возможные артефакты.
Какие сервисы лучше подойдут для ИИ-фотосессии
Сгенерировать фотографии сегодня можно и в универсальных нейросетях, и в сервисах, которые специализируются на изображениях. Они по-разному работают с референсами, внешностью, позой и стилем персонажей, с разной точностью воспроизводят параметры исходной фотографии.

Александра Дудина
эксперт по работе с нейросетями
— Для того, чтобы сгенерировать ИИ-фотосессию, подойдут даже ChatGPT и Gemini. Однако они, с большей вероятностью, выдадут «любительский» результат. Основа будет сохранена, но вот 90-процентную точность (или выше) вы не получите. Тут лучше обратиться к сервисам, которые специализируются на таких задача — Midjourney, Stable Diffusion.
У Midjourney есть параметр Character Reference (--cref), который вы добавляете в конце запроса и прикрепляете ссылку на фото. Она отлично сохранит черты лица. В Stable Diffusion также есть расширение ControlNet, с помощью которого вы можете полностью контролировать позу человека и делать замену лица.

Дмитрий Руденок
IT-специалист, коллажист и бильд-редактор
— На стартовом уровне хорошо подойдут мультимодальные ИИ-сервисы, такие как Chat GPT с GPT Image 2.5, Gemini с Nano Banana, Grok с Grok Image.
Для более специализированной работы с генеративной фотографией и визуальным стилем можно попробовать Midjourney, Ideogram и Adobe Firefly.
Как составить промпт для ИИ-фотосессии
Хороший промпт зависит от нескольких параметров: что это за нейросеть, какая именно модель ИИ используется, опирается ли генерация на реальный исходник или нет.

Дмитрий Руденок
IT-специалист, коллажист и бильд-редактор
— Хороший промпт — это в первую очередь не жёсткий шаблон, подходящий на все случаи, а чек-лист, по которому удобнее двигаться «от главного к второстепенному». Начать стоит с описания объекта и его стилизации, затем позы или действия, окружения и локации, композицию кадра, потом описать свет, параметры камеры, цветовую гамму и желаемый стиль. В конце обязательно надо указать требования к детализации и ограничения (что сохранить, изменить или исключить).
Универсальная схема промпта для ИИ-фотосессии:
герой → внешность → образ → действие и поза → локация → композиция → кадр и ракурс → свет → цвет и стиль → настроение → важные детали → ограничения
Что именно описывать в каждом пункте промпта:
- Герой — кто изображён: женщина, мужчина, пара, ребёнок, персонаж.
- Внешность и ключевые черты — возраст, волосы, черты лица, телосложение. При работе с референсом в этом месте прописываем, какие детали особенно важно сохранить.
- Одежда и образ — одежда, обувь, аксессуары, макияж, причёска.
- Действие — что человек делает: идёт, сидит в кафе, держит цветы, смотрит в окно.
- Поза — положение тела, рук и головы, направление взгляда, эмоция.
- Локация — место съёмки, фон, интерьер, погода, предметы вокруг.
- Композиция — где расположен герой, сколько пространства вокруг него, симметричный или динамичный кадр.
- Кадр и ракурс — крупный портрет, по пояс, в полный рост, общий план; съёмка на уровне глаз, сверху, снизу, сбоку; фронтально или в три четверти.
- Свет — естественный или студийный, мягкий или контрастный, направление и время суток.
- Цвет и стиль — палитра, визуальная эстетика, фешен, кинематографичный стиль, журнальный.
- Настроение — спокойное, романтичное, драматичное, энергичное.
- Важные детали — фактура ткани, украшения, предметы в руках, особенности фона.
- Ограничения — что нельзя менять или добавлять: сохранить лицо, не менять цвет волос, без лишних предметов, без текста в кадре.

Изображение: GPT Image 2.5 / Open AI
Generate a photograph. A 40-year-old woman with soft pink hair, green eyes, soft facial features, and a full figure; she is wearing a black T-shirt with pink lettering «Редактирователь» and has multiple small silver earrings in her ears. Her hair is pulled back into a high ponytail, and she wears glasses with transparent pink frames and light, casual makeup. She is sitting at a desk in a cozy, bright room, engrossed in work on her MacBook; she looks intently at the screen with a slight smile, her hands resting on the keyboard. The room features a light color palette, with many cute photos and pictures on the wall behind her and a moderate number of houseplants. It is a waist-up portrait shot in natural daylight from a window on a sunny day. A ginger spaniel is standing on its hind legs with its front paws on the edge of the desk, peering at the laptop screen; the overall mood of the photo is calm and joyful.
Чтобы генерация получилась точнее, промпт лучше отдавать нейросети на английском. Если иностранные языки — на самая сильная ваша сторона, можно воспользоваться любым онлайн-переводчиком.

Александра Дудина
эксперт по работе с нейросетями
— Не обязательно каждый раз подробно описывать все пункты. Например, если вы загружаете фотографию человека, можно не расписывать его внешность, а сосредоточиться на том, что хотите изменить: одежду, позу, фон, освещение и композицию.
И не стремитесь к тому, чтобы создать запрос на несколько страниц. Если в промпте уже чётко написано, что вам нужна, например, ёлка на фоне, то повторять эту идею ещё несколько раз не нужно.
Как максимально сохранить внешность человека с исходного фото
Даже если загрузить собственную фотографию, нейросеть может изменить форму лица, возраст, пропорции или отдельные черты. Это происходит потому, что разные модели используют референс по-разному: для одних он становится источником внешности, а для других — только ориентиром по стилю и композиции.

Александра Дудина
эксперт по работе с нейросетями
— Главная проблема в том, что одним только текстом на 100% сохранить внешность не получится, увы. Для этого нужны специальные инструменты, например параметр (--cref) Midjourney. Чтобы аккуратно перенести лицо с вашей фотографии на ИИ-кадр, добавьте в самом конце запроса «--cref» и через пробел вставьте ссылку на исходный снимок. Нейросеть сама всё считает и сделает снимок. Если это другая нейросеть, то просто прикрепите исходник через загрузку фото.
В самом тексте достаточно указать базовые данные: пол, возраст, цвет волос, чтобы нейросеть не изменила их. А вот детально описывать, какие черты лица вы хотите получить, не нужно и даже вредно. ИИ начнёт конфликтовать сам с собой, будет пытаться угодить и вашему описанию, и исходному фото. В итоге получится этакий монстр Франкенштейна.

Дмитрий Руденок
IT-специалист, коллажист и бильд-редактор
— Сохранение внешности — одна из самых сложных частей в генерации, для которой нужно учитывать не только текст в промпте, но и специфику ИИ-модели, с которой вы работаете.
Есть ИИ-модели, где фото используется как общий стилистический референс (Text-to-Image), а не источник идентичности. В таких случаях никакой промпт не заставит модель сохранить ваши черты — здесь нужны специализированные решения для переноса лица.
Более подходящий нам вариант — генеративные модели с возможностью загрузки референсного фото (Image-to-Image), которое будет главным якорем для считывания идентичности. В этом случае логика выстраивается по шагам: «Сохрани → Измени → Запрети».
«Сохрани» — первый якорь для переноса уникальных черт идентичности с исходного фото. Например: форма лица, характерная линия носа, естественные поры, текстура кожи.
«Измени» — факторы, которые нейросети нужно будет изменить: новый фон, поза, освещение.
«Запрети» — ограничения для защиты от искажений внешности при переносе внешности. Например: не менять пропорции лица, цвет глаз, возраст.


Take the person from the attached reference photo and keep their face completely unchanged-preserve the exact same facial features, skin texture, expression, and head angle as in the original. Do not modify the face in any way. Apply only these changes: intense side lighting from the left with deep shadows covering the far side of the face, a smooth warm gradient background from burnt orange to dark red, and subtle motion blur effect on the hair only. Use an 85 mm portrait lens look with f/2.0 shallow depth of field, sharp focus on the eye, cinematic film grain, editorial fashion photography style. Photorealistic, 8k quality. Important: do not alter the person’s identity, skin tone, or facial structure. Keep the original expression exactly as it is.
Свет, ракурс, камера и стиль
Один и тот же герой может выглядеть совершенно по-разному в зависимости от ракурса, света и типа кадра. Эти параметры помогают не только задать настроение снимка, но и точнее управлять композицией, пропорциями и тем, насколько результат будет похож на настоящую фотографию.

Александра Дудина
эксперт по работе с нейросетями
— Чтобы получить хороший результат, обязательно нужно прописать близость к камере, объектив, резкость и свет.
Близость и ракурс: укажите дистанцию — лицо крупным планом, кадр по пояс, полный рост. Позицию: съёмка на уровне глаз или взгляд в камеру. Без этих ограничений нейросеть начнёт импровизировать.
Свет и цвет: прописывайте атмосферу, которую хочется получить. Например, золотой час, студийное освещение, холодный осенний день и прочие.
Оптика и резкость: чтобы пропорции лица не искажались, указывайте объектив 50 или 85 мм. Чтобы добавить объём, можно указать «размытый фон» или «малая глубина резкости».

Дмитрий Руденок
IT-специалист, коллажист и бильд-редактор
— Здесь стоит повториться: не нужно использовать все параметры как жёсткий шаблон, перенося его из промпта в промпт. Каждый из перечисленных параметров можно рассматривать как дополнительный инструмент для решения конкретных задач, возникающих в процессе генерации.
Так, к примеру, минимальный набор параметров можно использовать, чтобы заменить отдельные детали кадра — фон, одежду или освещение, — сохранив узнаваемость человека. Для этого в промпте описывается только то, что нужно заменить (одежда, локация, поза), и то, что нельзя трогать (лицо). Далее, исходя из своего набора данных, ИИ-модель самостоятельно достраивает ракурс, оптику и цветокоррекцию. Расписывать все параметры стоит, когда важно взять на себя полное «ручное» управление всем кадром целиком.

Фото: Raamin Ka / Unsplash / Krea Ai
Maintain the facial features and skin texture from the reference image. A woman in a gray wool coat stands against a concrete wall, hands in pockets, looking calmly into the camera. Soft daylight, gray-beige background. Don’t alter the facial proportions or add accessories.

Фото: Luke Thornton / Unsplash / Nano Banana / Google
Maintain the identity of the face from the reference photo: the shape of the cheekbones, the line of the nose, facial expression, natural pores, and eye color. A man in a worn leather jacket sits on a barstool, elbows on his knees, looking slightly away from the camera, with a pensive expression. Medium shot, cropped to the waist, from a slightly lower angle. A 1970s-style bar, a dim Edison bulb behind him, the wooden counter blurred into a round bokeh. Backlight from the lamp creates a warm edge along the contour of the hair, and the face is illuminated by reflected light from the counter. Shot at 85 mm, f/1.4. The color scheme is warm, the Kodak Portra 800 palette is dominated by amber, the shadows are deep, but not black. The skin has a natural texture, without retouching. Do not alter facial features, do not idealize the skin, do not add extraneous objects.
Ограничения и негативные инструкции
Иногда важно объяснить нейросети не только что нужно получить, но и какие детали нельзя менять или добавлять. Однако прямые запреты модель может интерпретировать непредсказуемо, поэтому ограничения лучше формулировать отдельно и не перегружать ими запрос.

Александра Дудина
эксперт по работе с нейросетями
— Главная ошибка тех, кто никогда не писал промпты, — использовать словосочетания «Не делай» или «Без чего-то». Если вы напишете «девушка без очков», ИИ с большой вероятностью увидит только «очки» и добавит их на фото.
Все ограничения лучше прописывать отдельно. В некоторых нейросетях есть окошки с названием «Негативный промпт» или «Что вы не хотите видеть», и вот именно там нужно добавить эту информацию. Просто пропишите через запятую, что вам не нужно на финальном фото, например очки, текст и водяные знаки.
Если такого поля нет, то сосредоточьтесь на том, что должно быть, без частицы «не».

Дмитрий Руденок
IT-специалист, коллажист и бильд-редактор
— Основное правило при указании ограничений — вместо жёстких запретов стараться описывать желаемый результат. Нейросеть может отреагировать на упоминание нежелательного объекта, поэтому формулировку «убери покраснение с лица» лучше заменить на «ровный здоровый тон кожи».
Лучше всего следовать уже знакомой нам логике: «Сохрани → Измени → Запрети». Такое перечисление позволит генеративной модели чётко понимать, какие элементы кадра сохранить, а какие нужно отредактировать.
Также стоит дозировать количество ограничений, так как длинный список запретов размывает приоритеты, и модель начинает игнорировать часть указаний.
Критичное требование (например, «сохранить лицо») стоит ставить в начало или в конец промпта, при необходимости дублируя его отдельной короткой фразой, чтобы оно не потерялось среди описаний.
Как выбрать исходное фото
Чем понятнее нейросети исходная внешность человека, тем проще ей сохранить её в новом кадре. Поэтому для референса лучше выбирать снимок, на котором хорошо видны лицо и естественные черты, а свет, ракурс и качество изображения не мешают нейросети их считать.

Александра Дудина
эксперт по работе с нейросетями
— Лучший исходник — это качественное фото с ровным светом. Вот на какие параметры стоит ориентироваться при выборе.
Свет: никаких резких теней на лице, только мягкий естественный свет. Можно и фото под лампой, но она, в зависимости от температуры, искажает цвет кожи.
Ракурс и мимика: лучше всего использовать фото, на котором вы смотрите прямо в камеру или с лёгким поворотом головы — то есть ¾ лица хорошо видны. Лучше не показывать никаких эмоций или просто легко улыбнуться, но не более (как если бы вы фотографировались на паспорт).
Близость к камере: лучше всего крупный план по плечи или портрет по пояс. То есть самое главное, чтобы лицо было чётким и занимало большую часть кадра.
Если вы хотите просто перенести своё лицо на готовую картинку, то хватит одного фото. Если нужно обучить нейросеть и создать модель, которая будет рисовать человека с нуля в разных позах, то потребуется до 30 фотографий с разными ракурсами, светом, отдалением и мимикой.

Дмитрий Руденок
IT-специалист, коллажист и бильд-редактор
— Выбирайте снимок без сильной ретуши, фильтров, размытия, артефактов и сжатия: чем естественнее кожа, тем точнее модель поймёт индивидуальные черты. Качество чем выше, тем лучше, но подойдёт и фото 512×512 px, если портрет крупным планом. Низкое разрешение само по себе не заставит ИИ-модель «додумать» внешность. Основное требования к фону — отсутствие посторонних людей в кадре, в остальном ИИ справляется отлично.

Фото: Juan Ordonez / Unsplash

Не все ИИ-сервисы позволяют загружать несколько изображений — в таких случаях всё упирается в один идеальный референс. Если сервис поддерживает загрузку нескольких референсов, оптимально загрузить 3–4 фото с разными ракурсами. Это помогает ИИ-модели уловить объём лица и не «сплющить» черты при генерации в непривычном ракурсе.
Как адаптировать промпт под ChatGPT, Gemini и другие нейросети
Универсальную схему промпта можно использовать почти в любой нейросети, но одинаковый запрос разные модели прочитают по-разному. Где-то лучше работают подробные естественные описания, где-то — короткие инструкции и отдельный негативный промпт, поэтому запрос стоит адаптировать под конкретный сервис.

Дмитрий Руденок
IT-специалист, коллажист и бильд-редактор
— Промпты для разных нейросетей различаются, хотя базовая логика остаётся общей: объект, внешность, одежда, поза, окружение, свет и другие параметры.
Главное различие — в том, как каждая отдельная ИИ-модель интерпретирует текст. Одни лучше понимают подробные естественные описания, другие короткие структурированные запросы. Но из-за постоянных обновлений сервисов уследить за всем сложно и особенно не нужно. На начальных этапах проще написать промпт и попросить любую мультимодальную нейросеть (Kimi, ChatGPT, «Алиса AI») адаптировать его под любой генеративный сервис.

Скриншот: Raamin Ka / Unsplash / Krea Ai / Skillbox Media

Скриншот: Raamin Ka / Unsplash / Grok / Skillbox Media

Александра Дудина
эксперт по работе с нейросетями
— В Midjourney, например, лучше использовать литературный, художественный язык. Нейросеть любит, когда вы эмоционально описываете сцены, даёте им окраску и потом сама придумывает детали отталкиваясь от вашего описания.
В тоже время Stable Diffusion любит чёткость, перечисление через запятую, большие негативные промпты. Если ему выдать эмоционально окрашенный текст, то он, скорее всего, вас не поймёт.
Почему результат получается неудачным
Даже подробный промпт не гарантирует удачный результат: нейросеть может потерять по дороге часть инструкций, смешать противоречащие друг другу требования, а референсы интерпретировать вообще не так, как вы планировали.

Дмитрий Руденок
IT-специалист, коллажист и бильд-редактор
— Я бы выделил четыре основные ошибки, которые обычно допускают в промптах для ИИ-фотосессий.
- Использование для промптов русского языка. Бесспорно, та же Nano Banana хорошо распознаёт промпты на разных языках, но большая часть моделей более корректно понимает запросы на английском.
- Противоречивые требования. Не стоит просить в одном промпте сделать «тёмное нуарное освещение в яркий солнечный день». В таком случае ИИ-модель выберет случайный параметр или смешает параметры вместе.
- Пытаться уместить всё в один промпт. Если требуется выполнить генерацию с учётом множества деталей, не стоит описывать их все в одном длинном промпте. ИИ начнёт игнорировать части запроса и пропускать детали. Лучший подход — разделить большую задачу на подзадачи: сначала описать базовые изменения кадра, в следующем промпте внести изменения для редактирования деталей.
- Бесконтрольное смешивание референсов. То есть загрузка фото разных людей для получения «улучшенной версии себя». Такие эксперименты вместе с короткими промптами «перенеси с фото на фото» приводят к усреднению внешности или артефактам. Чтобы такого избежать, стоит указывать хотя бы минимальный запрос на сохранение внешности с чёткими указаниями, что сохранить и что перенести из второго фото.


Изображение: Raamin Ka / Unsplash / Krea Ai

Главное об ИИ-фотосессиях
- ИИ-фотосессия может быть устроена по-разному: нейросеть способна создать изображение с нуля, сгенерировать новый кадр по референсу или отредактировать уже готовую фотографию. При работе с реальным человеком лучше использовать модель, которая умеет опираться на загруженное изображение, но даже в этом случае стопроцентного сходства ждать не стоит.
- Промпт удобнее строить от главного к второстепенному: герой → внешность → образ → действие и поза → локация → композиция → кадр и ракурс → свет → цвет и стиль → настроение → важные детали → ограничения. При этом не обязательно каждый раз заполнять все пункты: если нужно изменить только фон или одежду, достаточно описать изменения и указать, что должно остаться прежним.
- Чтобы сохранить внешность, важен не только текст запроса, но и способ работы модели с референсом. Полезно разделять инструкции на три части: что сохранить, что изменить и что нельзя искажать. Если сервис поддерживает несколько изображений, 3–4 фотографии с разных ракурсов помогают модели лучше считать объём и особенности лица.
- Хороший исходник — это чёткая фотография без сильной ретуши и фильтров, где лицо хорошо видно и на него не падают резкие тени. Для обычной генерации по референсу может быть достаточно одного снимка, а для обучения отдельной модели человека понадобится набор фотографий с разными ракурсами и выражениями лица.
- Свет, масштаб кадра, ракурс и оптика помогают управлять результатом, но перечислять все параметры стоит только тогда, когда нужен полный контроль над изображением. В простых задачах можно оставить модели больше свободы и задать только те характеристики, которые действительно важны.
- Ограничения лучше формулировать через желаемый результат. Вместо длинного списка «не делать» стоит описать, что должно остаться в кадре, а критически важное требование — например, сохранить лицо — выделить отдельно. Если в сервисе есть поле для негативного промпта, нежелательные объекты лучше перечислить там.
- Один и тот же промпт может по-разному работать в разных нейросетях. Одни модели лучше понимают подробные естественные описания, другие — короткие структурированные инструкции. Поэтому универсальную схему стоит воспринимать как основу, а готовый запрос при необходимости адаптировать под конкретный сервис.
- Если результат не получается, не стоит бесконечно удлинять один запрос. Лучше убрать противоречия, сократить количество требований, разделить сложную задачу на несколько этапов и внимательно проверить, какие референсы используются и что именно модель должна перенести из каждого.