canon-eos.ru

Нейросети

Нейрофотосессия: как сделать по своим фото и почему исходники решают всё

Нейрофотосессия: как сделать её по своим 10–20 фото, требования к исходникам, сервисы и open-source (LoRA, InstantID, PuLID), где нейросеть ошибается, этика.

⟳ 03.10.2026 ◔ 6 мин ✎ Андрей Климов
Нейрофотосессия: как сделать по своим фото и почему исходники решают всё

Коротко

  • Нейрофотосессия — серия сгенерированных изображений с вашим лицом: модель дообучают на 10–20 ваших фото или подставляют лицо по одному-трём снимкам.
  • Качество результата в первую очередь определяется исходниками: разные ракурсы, ровный свет, без фильтров и солнечных очков.
  • Два пути: готовые сервисы и боты (быстро, без контроля) или открытые инструменты — LoRA на Stable Diffusion/FLUX, InstantID, PuLID, PhotoMaker (долго, с контролем).
  • Слабые места: руки, текст, украшения, похожесть в профиль и при сильной мимике.
  • Сгенерированное изображение — не фотография: для документов, резюме с проверкой и сайтов знакомств честнее настоящий портрет.

Нейрофотосессия — это серия изображений, которые генеративная модель рисует с вашим лицом в заданных образах: деловой портрет, студийный свет, костюм эпохи, пляж. Делается двумя способами. Первый — дообучение модели на 10–20 ваших фотографиях (так работает большинство сервисов и open-source-метод LoRA). Второй — подстановка лица по одному-трём снимкам без обучения (InstantID, PuLID, PhotoMaker). В обоих случаях результат в первую очередь определяется исходниками, и тут фотограф с камерой в выигрыше.

Если вам нужен разбор «аватар против настоящего портрета» для резюме и соцсетей — он есть в статье о нейросетях для аватаров и деловых портретов. Здесь — практикум: как подготовить материал, какие инструменты бывают и где они ломаются.

Что происходит «под капотом»

Генератор изображений вроде Stable Diffusion или FLUX умеет рисовать «человека вообще». Чтобы он рисовал именно вас, ему нужно показать ваше лицо.

Дообучение (DreamBooth, LoRA). Модель смотрит на ваши 10–20 фото и запоминает новое понятие — условное слово, обозначающее вас. LoRA — компактный «довесок» к модели размером в десятки мегабайт, который подключается при генерации. Обучение занимает от десятков минут до пары часов на видеокарте с 12–24 ГБ памяти; сервисы делают это на своих серверах.

Подстановка без обучения (InstantID, PuLID, PhotoMaker, IP-Adapter FaceID). Отдельная сеть извлекает признаки лица с одного-трёх снимков и подмешивает их в генерацию. Быстро, но похожесть ниже: черты «плавают» от кадра к кадру.

Как устроены диффузионные модели в целом, разобрано в словаре; локальная установка — в материале про Stable Diffusion и FLUX.

Как снять исходники: требования к 10–20 фото

Это самая важная часть, и именно её пропускают. Нейросеть не видит вас — она видит набор пикселей. Если все 15 кадров сняты фронтальной камерой телефона с вытянутой руки, модель выучит искажённое широкоугольником лицо с крупным носом.

ПараметрХорошоПлохо
Количество12–20 разных кадров40 почти одинаковых селфи
Планы60 % крупных, 30 % поясных, 10 % в ростТолько лицо вплотную
РакурсыФас, три четверти слева и справа, лёгкий профильОдин ракурс
СветРовный дневной у окна, облачная улицаЖёсткое солнце, вспышка в лоб, цветные лампы
ОбработкаБез фильтров, без ретуши кожиБьюти-фильтры, «пластик»
Фон и одеждаРазныеОдна и та же футболка на всех кадрах
ЛицоОткрыто, глаза видныОчки от солнца, маска, рука у лица
РезкостьГлаза в фокусеШевелёнка, шум ночного режима

Если у вас есть камера, снимите исходники за полчаса сами: фикс 50–85 мм, свет у окна, диафрагма f/2.8–f/4, чтобы всё лицо было резким. Объектив с умеренно длинным фокусным не искажает пропорции — это главная причина, почему исходники «с зеркалки» дают более похожий результат, чем селфи. Подробнее о свете — в статье про портретную съёмку.

Полевая деталь: если вы носите очки постоянно, добавьте пару кадров в очках и пару без. Иначе модель либо «приклеит» очки ко всем образам, либо забудет о них.

Сервисы или своя модель: развилка

Готовый сервис или ботOpen-source на своём ПК
Порог входаЗагрузить фото и оплатитьВидеокарта от 12 ГБ, вечер на настройку
СкоростьМинуты–часыЧасы на первую модель
КонтрольНабор готовых образовЛюбой промпт, поза, свет
ПриватностьФото уходят на чужой серверВсё остаётся у вас
ПохожестьСредняя–хорошаяОт плохой до отличной — зависит от вас

Если нужно 10 картинок к выходным — сервис. Внимательно прочитайте условия: кому принадлежат загруженные фото, сколько их хранят и можно ли удалить модель. Это важнее цены.

Если хотите контроль и приватность — open-source. Связка выглядит так: базовая модель (SDXL или FLUX), обучение LoRA через kohya_ss или ai-toolkit, генерация в ComfyUI. Для быстрых проб без обучения в ComfyUI подключаются InstantID или PuLID.

Если вы фотограф и хотите продавать нейрофотосессии клиентам — подумайте дважды. Клиент платит за похожесть, а она нестабильна; плюс вы обрабатываете биометрические данные чужого человека.

Где получается плохо

Честная часть, которую сервисы не пишут на лендингах.

ПроблемаПочемуЧто помогает
Лишние или сросшиеся пальцыРуки — сложная анатомия, мало хороших примеров в обучающих данныхКадры без рук в кадре, перегенерация, ретушь
Текст на одежде и вывескахМодель рисует «похожие на буквы» формыУбирать текст из промпта
Не похоже в профильВ исходниках мало профилейДобавить 2–3 кадра в профиль
Не похоже при улыбкеИсходники только с серьёзным лицомДобавить разные выражения
Лицо «моложе и глаже»Модель тянет к усреднённой красотеНиже сила стиля, кадры с фактурой кожи
Украшения, родинки «гуляют»Мелкие детали учатся плохоПроверять каждый кадр
Все кадры одинаковыеПереобучение на однообразных исходникахРазнообразить набор, меньше шагов обучения

Если сгенерированный кадр нужно доработать — увеличить, убрать шум, поправить кожу, — пригодятся ИИ-апскейлеры и приёмы ретуши без «пластика». Как зрители отличают генерацию от снимка — в чек-листе признаков ИИ-фото: именно по этим признакам вашу нейрофотосессию и узнают.

Этика и право: короткий список правил

  1. Только своё лицо или с письменного согласия. Изображение гражданина охраняется законом (ст. 152.1 ГК РФ). Генерация «фотосессии» бывшей коллеги или звезды — плохая идея юридически и по-человечески.
  2. Не выдавайте генерацию за фотографию там, где это важно: документы, сайты знакомств, профили с верификацией, портфолио фотографа.
  3. Маркируйте. Платформы всё чаще требуют помечать ИИ-контент, а стандарт C2PA закрепляет происхождение файла.
  4. Помните о правах на результат. Вопрос, кому принадлежит сгенерированное изображение, решён не везде одинаково — подробности в статье «ИИ и авторское право на фотографии».

Где проходят границы допустимого в целом — в разборе этики ИИ в фотографии.

Как оценить результат: чек-лист перед публикацией

Из 50 сгенерированных кадров публиковать стоит единицы. Перед тем как отправить картинку в соцсеть или на сайт, пройдитесь по списку.

  • Похожесть. Покажите кадр близкому человеку, не говоря, что это генерация. Если он спрашивает «это ты?», кадр не годится.
  • Руки и пальцы. Пересчитайте. Серьёзно.
  • Уши, зубы, серьги. Асимметричные серьги и «лишние» зубы встречаются чаще, чем кажется.
  • Фон. Ищите кривые линии там, где должны быть прямые: рамы окон, перила, полки.
  • Свет. Тень от носа и блики в глазах должны указывать на один источник. Если свет на лице слева, а тени на фоне справа — зритель почувствует подвох, даже не поняв причину.
  • Кожа. Фактура есть или «пластик»?

Свет — то место, где фотограф видит ошибки генератора лучше обычного зрителя. Если вы разбираетесь в свойствах света, используйте это: именно противоречивое освещение чаще всего выдаёт нейрофото.

Порядок действий: от исходников до результата

  1. Отберите или снимите 12–20 фото по таблице выше.
  2. Кадрируйте до квадрата 1024×1024 (для SDXL/FLUX) с лицом в центре; сервисы делают это сами.
  3. Удалите дубли и всё, где лицо закрыто.
  4. Обучите модель или загрузите фото в сервис.
  5. Начните с простых промптов: «студийный портрет, мягкий свет, серый фон». Стиль добавляйте постепенно — язык света в промпте работает лучше, чем «ультрареалистично, 8K».
  6. Сгенерируйте 30–50 вариантов, отберите 5–10. Нормальный выход — каждый пятый-десятый кадр.

Вопросы и ответы

Сколько фото нужно для нейрофотосессии?

Для дообучения (LoRA) обычно 10–20 снимков, иногда до 30. Важнее разнообразие, чем количество: разные ракурсы, фоны, одежда и выражения лица. Для методов без обучения (InstantID, PuLID) достаточно одного-трёх хороших портретов, но похожесть у них ниже.

Какие фото подходят для обучения нейросети?

Резкие, с хорошо видимым лицом, без фильтров и бьюти-обработки, снятые при ровном свете. Нужны крупные планы, поясные и пара снимков в полный рост, лицо в фас и в три четверти. Исключите групповые фото, солнечные очки, маски и кадры с рукой у лица.

Почему нейрофотосессия получается не похожей?

Чаще всего виноваты исходники: однообразные селфи с широкоугольной камеры телефона искажают пропорции лица, а фильтры стирают черты. Вторая причина — сильный стиль в запросе, который перетягивает модель. Третья — сравнение с привычным зеркальным отражением: себя мы помним «в зеркале».

Законно ли делать нейрофотосессию другого человека?

Использовать чужое лицо без согласия нельзя: в России изображение гражданина охраняется статьёй 152.1 ГК РФ, а публикация такого контента может нарушать и другие нормы. Делайте нейрофотосессии только себе или с письменного согласия человека.

Источники и что почитать