Нейросети
Нейрофотосессия: как сделать по своим фото и почему исходники решают всё
Нейрофотосессия: как сделать её по своим 10–20 фото, требования к исходникам, сервисы и open-source (LoRA, InstantID, PuLID), где нейросеть ошибается, этика.

Коротко
- Нейрофотосессия — серия сгенерированных изображений с вашим лицом: модель дообучают на 10–20 ваших фото или подставляют лицо по одному-трём снимкам.
- Качество результата в первую очередь определяется исходниками: разные ракурсы, ровный свет, без фильтров и солнечных очков.
- Два пути: готовые сервисы и боты (быстро, без контроля) или открытые инструменты — LoRA на Stable Diffusion/FLUX, InstantID, PuLID, PhotoMaker (долго, с контролем).
- Слабые места: руки, текст, украшения, похожесть в профиль и при сильной мимике.
- Сгенерированное изображение — не фотография: для документов, резюме с проверкой и сайтов знакомств честнее настоящий портрет.
Нейрофотосессия — это серия изображений, которые генеративная модель рисует с вашим лицом в заданных образах: деловой портрет, студийный свет, костюм эпохи, пляж. Делается двумя способами. Первый — дообучение модели на 10–20 ваших фотографиях (так работает большинство сервисов и open-source-метод LoRA). Второй — подстановка лица по одному-трём снимкам без обучения (InstantID, PuLID, PhotoMaker). В обоих случаях результат в первую очередь определяется исходниками, и тут фотограф с камерой в выигрыше.
Если вам нужен разбор «аватар против настоящего портрета» для резюме и соцсетей — он есть в статье о нейросетях для аватаров и деловых портретов. Здесь — практикум: как подготовить материал, какие инструменты бывают и где они ломаются.
Что происходит «под капотом»
Генератор изображений вроде Stable Diffusion или FLUX умеет рисовать «человека вообще». Чтобы он рисовал именно вас, ему нужно показать ваше лицо.
Дообучение (DreamBooth, LoRA). Модель смотрит на ваши 10–20 фото и запоминает новое понятие — условное слово, обозначающее вас. LoRA — компактный «довесок» к модели размером в десятки мегабайт, который подключается при генерации. Обучение занимает от десятков минут до пары часов на видеокарте с 12–24 ГБ памяти; сервисы делают это на своих серверах.
Подстановка без обучения (InstantID, PuLID, PhotoMaker, IP-Adapter FaceID). Отдельная сеть извлекает признаки лица с одного-трёх снимков и подмешивает их в генерацию. Быстро, но похожесть ниже: черты «плавают» от кадра к кадру.
Как устроены диффузионные модели в целом, разобрано в словаре; локальная установка — в материале про Stable Diffusion и FLUX.
Как снять исходники: требования к 10–20 фото
Это самая важная часть, и именно её пропускают. Нейросеть не видит вас — она видит набор пикселей. Если все 15 кадров сняты фронтальной камерой телефона с вытянутой руки, модель выучит искажённое широкоугольником лицо с крупным носом.
| Параметр | Хорошо | Плохо |
|---|---|---|
| Количество | 12–20 разных кадров | 40 почти одинаковых селфи |
| Планы | 60 % крупных, 30 % поясных, 10 % в рост | Только лицо вплотную |
| Ракурсы | Фас, три четверти слева и справа, лёгкий профиль | Один ракурс |
| Свет | Ровный дневной у окна, облачная улица | Жёсткое солнце, вспышка в лоб, цветные лампы |
| Обработка | Без фильтров, без ретуши кожи | Бьюти-фильтры, «пластик» |
| Фон и одежда | Разные | Одна и та же футболка на всех кадрах |
| Лицо | Открыто, глаза видны | Очки от солнца, маска, рука у лица |
| Резкость | Глаза в фокусе | Шевелёнка, шум ночного режима |
Если у вас есть камера, снимите исходники за полчаса сами: фикс 50–85 мм, свет у окна, диафрагма f/2.8–f/4, чтобы всё лицо было резким. Объектив с умеренно длинным фокусным не искажает пропорции — это главная причина, почему исходники «с зеркалки» дают более похожий результат, чем селфи. Подробнее о свете — в статье про портретную съёмку.
Полевая деталь: если вы носите очки постоянно, добавьте пару кадров в очках и пару без. Иначе модель либо «приклеит» очки ко всем образам, либо забудет о них.
Сервисы или своя модель: развилка
| Готовый сервис или бот | Open-source на своём ПК | |
|---|---|---|
| Порог входа | Загрузить фото и оплатить | Видеокарта от 12 ГБ, вечер на настройку |
| Скорость | Минуты–часы | Часы на первую модель |
| Контроль | Набор готовых образов | Любой промпт, поза, свет |
| Приватность | Фото уходят на чужой сервер | Всё остаётся у вас |
| Похожесть | Средняя–хорошая | От плохой до отличной — зависит от вас |
Если нужно 10 картинок к выходным — сервис. Внимательно прочитайте условия: кому принадлежат загруженные фото, сколько их хранят и можно ли удалить модель. Это важнее цены.
Если хотите контроль и приватность — open-source. Связка выглядит так: базовая модель (SDXL или FLUX), обучение LoRA через kohya_ss или ai-toolkit, генерация в ComfyUI. Для быстрых проб без обучения в ComfyUI подключаются InstantID или PuLID.
Если вы фотограф и хотите продавать нейрофотосессии клиентам — подумайте дважды. Клиент платит за похожесть, а она нестабильна; плюс вы обрабатываете биометрические данные чужого человека.
Где получается плохо
Честная часть, которую сервисы не пишут на лендингах.
| Проблема | Почему | Что помогает |
|---|---|---|
| Лишние или сросшиеся пальцы | Руки — сложная анатомия, мало хороших примеров в обучающих данных | Кадры без рук в кадре, перегенерация, ретушь |
| Текст на одежде и вывесках | Модель рисует «похожие на буквы» формы | Убирать текст из промпта |
| Не похоже в профиль | В исходниках мало профилей | Добавить 2–3 кадра в профиль |
| Не похоже при улыбке | Исходники только с серьёзным лицом | Добавить разные выражения |
| Лицо «моложе и глаже» | Модель тянет к усреднённой красоте | Ниже сила стиля, кадры с фактурой кожи |
| Украшения, родинки «гуляют» | Мелкие детали учатся плохо | Проверять каждый кадр |
| Все кадры одинаковые | Переобучение на однообразных исходниках | Разнообразить набор, меньше шагов обучения |
Если сгенерированный кадр нужно доработать — увеличить, убрать шум, поправить кожу, — пригодятся ИИ-апскейлеры и приёмы ретуши без «пластика». Как зрители отличают генерацию от снимка — в чек-листе признаков ИИ-фото: именно по этим признакам вашу нейрофотосессию и узнают.
Этика и право: короткий список правил
- Только своё лицо или с письменного согласия. Изображение гражданина охраняется законом (ст. 152.1 ГК РФ). Генерация «фотосессии» бывшей коллеги или звезды — плохая идея юридически и по-человечески.
- Не выдавайте генерацию за фотографию там, где это важно: документы, сайты знакомств, профили с верификацией, портфолио фотографа.
- Маркируйте. Платформы всё чаще требуют помечать ИИ-контент, а стандарт C2PA закрепляет происхождение файла.
- Помните о правах на результат. Вопрос, кому принадлежит сгенерированное изображение, решён не везде одинаково — подробности в статье «ИИ и авторское право на фотографии».
Где проходят границы допустимого в целом — в разборе этики ИИ в фотографии.
Как оценить результат: чек-лист перед публикацией
Из 50 сгенерированных кадров публиковать стоит единицы. Перед тем как отправить картинку в соцсеть или на сайт, пройдитесь по списку.
- Похожесть. Покажите кадр близкому человеку, не говоря, что это генерация. Если он спрашивает «это ты?», кадр не годится.
- Руки и пальцы. Пересчитайте. Серьёзно.
- Уши, зубы, серьги. Асимметричные серьги и «лишние» зубы встречаются чаще, чем кажется.
- Фон. Ищите кривые линии там, где должны быть прямые: рамы окон, перила, полки.
- Свет. Тень от носа и блики в глазах должны указывать на один источник. Если свет на лице слева, а тени на фоне справа — зритель почувствует подвох, даже не поняв причину.
- Кожа. Фактура есть или «пластик»?
Свет — то место, где фотограф видит ошибки генератора лучше обычного зрителя. Если вы разбираетесь в свойствах света, используйте это: именно противоречивое освещение чаще всего выдаёт нейрофото.
Порядок действий: от исходников до результата
- Отберите или снимите 12–20 фото по таблице выше.
- Кадрируйте до квадрата 1024×1024 (для SDXL/FLUX) с лицом в центре; сервисы делают это сами.
- Удалите дубли и всё, где лицо закрыто.
- Обучите модель или загрузите фото в сервис.
- Начните с простых промптов: «студийный портрет, мягкий свет, серый фон». Стиль добавляйте постепенно — язык света в промпте работает лучше, чем «ультрареалистично, 8K».
- Сгенерируйте 30–50 вариантов, отберите 5–10. Нормальный выход — каждый пятый-десятый кадр.
Вопросы и ответы
Сколько фото нужно для нейрофотосессии?
Для дообучения (LoRA) обычно 10–20 снимков, иногда до 30. Важнее разнообразие, чем количество: разные ракурсы, фоны, одежда и выражения лица. Для методов без обучения (InstantID, PuLID) достаточно одного-трёх хороших портретов, но похожесть у них ниже.
Какие фото подходят для обучения нейросети?
Резкие, с хорошо видимым лицом, без фильтров и бьюти-обработки, снятые при ровном свете. Нужны крупные планы, поясные и пара снимков в полный рост, лицо в фас и в три четверти. Исключите групповые фото, солнечные очки, маски и кадры с рукой у лица.
Почему нейрофотосессия получается не похожей?
Чаще всего виноваты исходники: однообразные селфи с широкоугольной камеры телефона искажают пропорции лица, а фильтры стирают черты. Вторая причина — сильный стиль в запросе, который перетягивает модель. Третья — сравнение с привычным зеркальным отражением: себя мы помним «в зеркале».
Законно ли делать нейрофотосессию другого человека?
Использовать чужое лицо без согласия нельзя: в России изображение гражданина охраняется статьёй 152.1 ГК РФ, а публикация такого контента может нарушать и другие нормы. Делайте нейрофотосессии только себе или с письменного согласия человека.
Источники и что почитать
- DreamBooth fine-tuning with LoRA — Hugging Face
- Гражданский кодекс РФ, статья 152.1 «Охрана изображения гражданина»