Создание фоторобота по словесному описанию в ИИ

Содержание страницыList

У моей соседки сбежал кот. Взяла она питомца из приюта всего за пару дней до того, и даже не успела ни разу сфотографировать. И вот она пришла ко мне и спросила: мол, не сможешь ли с помощью «этих твоих компьютерных штучек» составить фоторобот беглеца по словесному описанию, а заодно и объявление напечатать. «А ведь смогу», — подумал я. Ведь нынешние нейросети действительно позволяют создать фоторобот онлайн, не важно, человека или животного.

Плакат с процессом создания фоторобота с помощью ИИ на основе словесного описания, сопровождаемый фотографиями и рисунками человека и кота.

Так и родилась идея этого гайда. В нем я подробно расскажу, из чего складывается словесный портрет, какими словами надо описывать черты лица, в каком стиле запрашивать результат и как довести черновик до узнаваемого сходства за несколько итераций. Плюс отдельно — как преобразовать фото в фоторобот, если исходный снимок все-таки есть.

Что такое ИИ-фоторобот и когда он нужен

Классический фоторобот, который вы могли видеть в теледетективах, собирают из готовых фрагментов: свидетель выбирает форму лица, потом глаза, нос, губы, и программа склеивает их в одно изображение. Результат узнаваем, но выглядит плоско и мертво.

Генеративная нейросеть работает иначе: она держит в голове всё лицо целиком и рисует его заново на каждой итерации. Поэтому портрет получается живым, а поправки в него вносятся обычными словами.

Ситуаций, где такой портрет реально выручает, значительно больше, чем кажется на первый взгляд.

  • Поиск пропавших животных, когда фотографий не осталось или они безнадежно смазаны — самый частый сценарий.
  • Объявления о пропаже людей для волонтерских чатов, если свежих снимков нет, а есть только описание одежды и примет на день исчезновения.
  • Восстановление портрета родственника по воспоминаниям семьи, когда фотоархив утрачен.
  • Персонаж для книги, игры или сценария — по сути та же задача: превратить текстовое описание внешности в лицо.
  • Стилизация имеющейся фотографии под карандашный портрет или скетч, когда нужна не фотография, а рисунок.

Сразу оговорю этические и правовые границы. Портрет, собранный нейросетью, — это визуализация чьих-то слов и памяти, а не документ и не результат экспертизы. Сходство он дает приблизительное (как и классический фоторобот). Узнаваемость достигается благодаря общему впечатлению, а не паспортным чертам.

И еще одна особенность, о которой подробнее скажу ниже: генеративные модели склонны незаметно приукрашивать человека, делая его симпатичнее и правильнее, чем описано. Их так учат. Возможно, наша цивилизация погибнет именно из-за этого, но это не точно.

Из чего складывается словесный портрет

Анкета для создания фоторобота кота с вопросами о поле, окрасе, типе шерсти, форме глаз и других особенностях с подсказками и примерами вариантов внешности котов.

Держите лайфхак: сразу приступать к генерации картинки нет смысла. Гораздо продуктивнее зайти издалека. Лично я открыл ChatGPT и дал запрос, одновременно тупой и умный:

Помоги составить фоторобот кота. Задавай наводящие вопросы, чтобы по ним можно было сгенерировать реалистичное изображение.
Copy

Бот повел себя как матерый следователь и засыпал меня вопросами о внешности пропавшего питомца соседки, начиная от телосложения и окраса и заканчивая формой глаз и ушей. Он задал в общей сложности 41 вопрос. Я и не подозревал, что во внешности кота столько деталей.

Мы с соседкой сидели за ноутбуком целый час, и в итоге получили максимально подробное описание, которое я загрузил в GPT Image 2.

А что касается людей?

Может, это кому-то покажется обидным, но параметры внешности человека принципиально не отличаются от параметров кота. Ну, разве что, хвоста нет.

Другое дело, что сегодня почти невозможно представить человека, который не оставил бы по себе целого вороха фотопортретов. Но допустим.

Итак, что делать, чтобы получился грамотный и похожий фоторобот человека?

Главная ошибка, которую допускают новички, — описывать внешность целиком и общими словами: «мужчина лет сорока, обычной внешности, лысоватый, с пивным животиком». Нейросеть на такой запрос нарисует среднестатистического скуфа, похожего одновременно на всех и ни на кого.

Гораздо продуктивнее другой подход: разложить внешность на зоны и по каждой дать одну-две конкретные детали.

Вот чек-лист признаков, который нейросеть будет использовать как каркас промпта:

  • Общие данные — пол, примерный возраст, телосложение, рост, осанка.
  • Форма лица — круглое, овальное, вытянутое, квадратное, треугольное; широкие или узкие скулы.
  • Волосы — длина, густота, цвет, структура, пробор, залысины, борода и усы.
  • Лоб и брови — высокий или низкий лоб, брови густые или редкие, прямые, дугой или вразлет, сросшиеся.
  • Глаза — цвет, разрез, посадка, размер, тяжелые или нависшие веки, мешки, морщины у внешних углов.
  • Нос — длина, ширина спинки, форма кончика, горбинка, крылья, размер ноздрей.
  • Рот и губы — ширина рта, толщина губ, опущенные или приподнятые уголки, носогубные складки.
  • Подбородок и челюсть — острый, круглый, массивный, скошенный, с ямочкой, двойной.
  • Уши — величина, оттопыренность, форма мочки, если они видны из-под волос.
  • Кожа и особые приметы — оттенок, веснушки, шрамы, родинки, татуировки, следы от угрей.
  • Выражение и мимика — привычное состояние лица: хмурое, усталое, приветливое, напряженное.

Описывать все зоны сразу не обязательно, а иногда и вредно. Если свидетель не помнит уши — так и оставьте. Пусть модель придумает нейтральный вариант, чем вы навяжете неверную деталь и собьете общее впечатление.

Инфографика, показывающая процесс создания фоторобота человека с помощью искусственного интеллекта по словесному описанию, включая этапы ввода описания, анализа, подбора признаков, компоновки лица, детализации и итогового результата.

Как подбирать слова, чтобы нейросеть поняла

Формулировки решают больше, чем количество деталей. Вот несколько правил, которые заметно повышают попадание:

  • Заменяйте термины сравнениями. «Нос с легкой горбинкой, как у профиля на римской монете» работает лучше, чем анатомически точное, но абстрактное описание.
  • Задавайте пропорции, а не размеры. «Глаза посажены близко, расстояние между ними меньше ширины одного глаза» — модель понимает соотношения куда точнее, чем миллиметры. Тем более, что расстояние в миллиметрах вы, скорее всего, не знаете.
  • Указывайте возраст лица, а не паспортный. «Выглядит на 45, лицо обветренное, кожа грубая» дает более верный результат, чем сухое «45 лет».
  • Добавляйте контекст, если он влияет на внешность. Работа на улице, курение, спорт, недосып — всё это читается в лице, и модель это отрабатывает.
  • Старайтесь давать не более одной детали в одном предложении. Длинные перечисления через запятую нейросеть частично проглатывает.

Если ищете животное

С котами, собаками, хомячками, выдрами и скунсами схема та же, но набор признаков другой. Для описания питомца обычно достаточно шести пунктов:

  • Порода или тип — конкретная порода либо «метис, похож на сиамского».
  • Окрас и рисунок — не просто «серый», а «серый полосатый с белой грудкой и белыми носочками».
  • Шерсть — длина, густота, есть ли воротник, пушистый хвост, колтуны.
  • Морда и глаза — форма морды, цвет глаз, форма и постав ушей.
  • Комплекция и возраст — котенок, подросток, взрослый, худой или упитанный.
  • Особые приметы — надорванное ухо, пятно необычной формы, ошейник, шрам, разный цвет глаз.

Как выбрать стиль изображения

Стиль результата влияет на узнаваемость не меньше, чем точность описания. Вот три проверенных варианта.

  • Фотореализм годится для объявлений о пропаже: человек скользит взглядом по листовке и цепляется за лицо, похожее на обычное фото.
  • Карандашный скетч честнее: сразу видно, что это рисунок по описанию, а не снимок. Он же лучше работает, когда часть деталей неизвестна — рисунок допускает недосказанность, фотография нет.
  • Черно-белая графика с четким контуром остается читаемой на дешевой печати и на смятом листе под дождем. Если объявление будете клеить на подъездные двери, это не эстетический выбор, а практический.

Что бы вы ни выбрали, три технических требования стоит прописывать всегда:

  • ракурс строго анфас или три четверти,
  • ровный рассеянный свет без теней на лице,
  • однотонный светлый фон.

Драматичное освещение и художественные ракурсы красивы, но работают против узнаваемости.

Создаем фоторобот с ИИ: четыре фазы вместо одной генерации

Собрать похожий портрет с первого запроса не получается почти никогда, но это нормально. Генерируйте, пока не получится как надо. Рабочая схема выглядит так:

  • Фаза 1. Черновик. Отдаете модели полное описание и получаете базовое лицо. Задача — попасть в общий типаж: возраст, форма лица, комплекция.
  • Фаза 2. Разбор по зонам. Показываете черновик человеку, который помнит оригинал, и просите его назвать несовпадения по одной зоне за раз: сначала лицо в целом, потом глаза, потом нос и так далее.
  • Фаза 3. Точечные правки. Каждая итерация меняет ровно один признак при сохранении всего остального. Правки пачкой модель выполняет выборочно и попутно ломает уже найденное сходство.
  • Фаза 4. Финальная сборка. Когда лицо утверждено, генерируете чистовой вариант в нужном ракурсе и формате, а при необходимости собираете из него макет объявления.

На практике фаз правок бывает от трех до десяти. У нас с соседкой кот получился с пятой попытки, зато попадание было почти полным.

Каждый удачный промежуточный результат сохраняйте отдельным файлом: модель иногда «заносит» в сторону. Возможность вернуться к предыдущей версии сэкономит вам время и нервы.

Как сделать фоторобот онлайн: готовые промты

Ниже — шесть шаблонов на все фазы работы. Квадратные скобки в них означают места, куда нужно подставить свои данные, сами скобки из промпта уберите.

1. Черновик портрета по описанию

Базовый запрос, с которого начинается работа. Заполняйте только те поля, по которым есть внятная информация, остальные удаляйте.

Создай реалистичный портрет человека по словесному описанию. Пол и возраст: [мужчина, на вид около 40 лет]. Телосложение: [плотное, широкие плечи, короткая шея]. Форма лица: [широкое, квадратное, тяжелая нижняя челюсть]. Волосы: [темно-русые, короткие, залысины над висками, седина на висках]. Лоб и брови: [низкий лоб, брови густые, прямые, сросшиеся у переносицы]. Глаза: [серые, небольшие, глубоко посаженные, нависшие веки]. Нос: [крупный, широкая спинка, легкая горбинка, мясистый кончик]. Рот и губы: [рот широкий, губы тонкие, уголки опущены]. Подбородок: [массивный, с ямочкой]. Кожа и приметы: [обветренная, крупные поры, вертикальный шрам на левой брови]. Выражение лица: [спокойное, чуть хмурое]. Ракурс — строго анфас, портрет по плечи, лицо занимает большую часть кадра. Свет ровный, рассеянный, без резких теней. Фон однотонный светло-серый. Стиль — реалистичный портрет, похожий на фотографию на документы, без художественной обработки и ретуши. Не добавляй головные уборы, очки, украшения и надписи, если они не указаны выше. Не приукрашивай внешность. Соотношение сторон 3:4.
Copy

Следите только, чтобы в итоге не получился портрет с эффектом «зловещей долины». Или, как у меня, двоюродный брат жены.

Портрет взрослого мужчины с короткими темными волосами на сером фоне.

2. Точечная правка одной детали

Главный промпт всего процесса — именно он превращает похожего человека в того самого. Используйте его столько раз, сколько потребуется, каждый раз меняя ровно одну деталь.

Сохрани лицо с предыдущего изображения полностью и внеси только одно изменение: [сделай нос короче, а спинку носа шире]. Все остальные черты, прическу, ракурс, свет, фон и стиль оставь без изменений. Не меняй возраст и выражение лица. Верни один вариант.
Copy

3. Лист вариантов для выбора

Прием для ситуаций, когда свидетель не может сформулировать, что не так, но узнает нужное, когда увидит. Модель рисует несколько версий одной черты, человек показывает пальцем.

Собери на одном изображении сетку 2 на 2 из четырех портретов одного и того же человека с одинаковыми чертами лица: [краткое описание из черновика]. Между вариантами меняй только [форму носа]: вариант 1 — [прямой узкий], вариант 2 — [с горбинкой], вариант 3 — [короткий, вздернутый], вариант 4 — [широкий, с мясистым кончиком]. Ракурс анфас, свет, фон и все прочие черты одинаковые во всех четырех клетках. Подпиши клетки цифрами от 1 до 4 в левом верхнем углу. Стиль реалистичный, фон светло-серый.
Copy

4. Как преобразовать фото в фоторобот

Обратная задача: снимок есть, но нужен именно рисунок — например, чтобы объявление не выглядело как чужая личная фотография. Не забудьте прикрепить к запросу исходное фото.

Преобразуй прикрепленную фотографию в черно-белый карандашный портрет в стиле рисунка по описанию свидетеля. Полностью сохрани сходство: пропорции лица, форму носа, разрез глаз, линию челюсти, прическу. Убери фон и замени его на чистый белый лист. Убери цвет, макияж, украшения и посторонние предметы. Ракурс и выражение лица не меняй. Проработай мягкую карандашную штриховку, акцент на форме лица, глазах и линии носа. Без надписей, рамок и подписи автора.
Copy

5. Портрет пропавшего животного

Тот самый промпт, с которого началась история про кота. Логика та же, что и с человеком: конкретика по каждому признаку и никакой художественности.

Создай фотореалистичный портрет [кота] для объявления о пропаже. Порода и тип: [метис, короткошерстный, некрупный]. Окрас: [серый полосатый табби, белая грудка и белые лапы, темные кольца на хвосте]. Шерсть: [короткая, гладкая, без подшерстка]. Морда и глаза: [морда округлая, глаза желто-зеленые, уши стоячие, на левом ухе небольшая отметина]. Комплекция и возраст: [около года, худощавый, длинные лапы]. Поза: [сидит анфас, видны морда целиком и передние лапы]. Свет ровный дневной, фон однотонный белый. Стиль — обычная любительская фотография питомца, без художественной обработки, без размытия фона и без надписей. Соотношение сторон 3:4.
Copy

Можно, конечно, пойти моим путем, то есть более длинным — создавать промпт с нуля поэтапно через диалог с нейросетью. Но если нужно срочно, годится и этот вариант. Вряд ли у вас в районе в данный момент блуждает несколько одинаковых «потеряшек», а значит, даже общего сходства будет достаточно.

Сидящая полосатая кошка с белой грудкой и белыми лапами на светлом фоне

6. Макет объявления с готовым портретом

Финальный шаг, когда внешность утверждена. Изготовляем объявление для распечатки. GPT Image 2 особенно качественно пишет русский текст на картинке, так что рекомендую воспользоваться именно этой нейросетью.

На основе прикрепленного портрета собери макет объявления вертикального формата А4. Сверху крупная надпись на русском языке: [ПРОПАЛ КОТ]. По центру — портрет без изменений, максимально крупно. Под портретом оставь пустое место для трех строк текста и отдельную полосу внизу для номера телефона. Фон белый, шрифт черный, рубленый, очень крупный и читаемый с расстояния. Без декоративных элементов, рамок, теней и водяных знаков.
Copy

Референсы: когда слов не хватает

Самый быстрый способ объяснить нейросети внешность — показать. Референс не обязан изображать нужного человека, он задает направление, а описание уточняет детали. Работают три приема.

  • Референс типажа. Найдите фото постороннего человека, похожего на искомого хотя бы отдаленно, и приложите к запросу с формулировкой: возьми за основу общий типаж и форму лица с этого фото, дальше следуй описанию. Модель подхватит пропорции, которые словами передать почти невозможно.
  • Сборка из нескольких источников. Приложите два-три снимка и распределите роли явно: форма лица с первого, прическа со второго, разрез глаз с третьего. GPT Image 2 и Nano Banana понимают такие инструкции.
  • Референс породы или возраста. Для животных проще всего взять фотографию типичного представителя нужной породы и окраса, а описанием довести до конкретного питомца — приметы, комплекцию, постав ушей.

Одна оговорка про этику: не берите в качестве референса фотографии реальных знакомых, если результат будет опубликован. Сходство может оказаться сильнее, чем вы рассчитывали, и человек узнает себя на листовке. Может случиться скандал.

Типичные ошибки

Разберу те, что встречаются чаще всего и стоят больше всего времени:

  • Пачка правок в одном запросе. Модель выполнит две из пяти, остальное проигнорирует и заодно перерисует лицо. Одна итерация — одно изменение.
  • Оценочные слова вместо признаков. «Неприятное лицо», «бандитская внешность», «типичный работяга» нейросеть трактует по своим стереотипам, а не по вашей памяти.
  • Красивый свет и художественный ракурс. Боковое освещение и поворот головы делают картинку эффектной и нераспознаваемой.
  • Молчаливое приукрашивание. Модели по умолчанию делают лица симметричнее, кожу чище, а фигуру стройнее. Если этого не запретить прямым указанием, сходство поплывет.
  • Работа без сохранения промежуточных версий. Через десять итераций вернуться к удачному варианту будет уже нельзя.
  • Проверка сходства самим составителем. Оценивать результат должен тот, кто видел оригинал, а не тот, кто пишет промпт.

Где составить фоторобот онлайн: 5 сервисов

Для создания фоторобота с помощью ИИ подойдет не любой генератор картинок. Два главных требования:

  • модель должна уметь точно следовать длинному описанию,
  • должна быть возможность править готовое изображение, не теряя уже найденное сходство.

На сегодня с этим лучше всего справляются GPT Image 2 и линейка Nano Banana — их и стоит искать в каталогах сервисов. Все площадки ниже работают в России без VPN, на русском языке и принимают оплату картами российских банков.

1. Study24 — GPT Image 2 без VPN и зарубежных карт

Официальный сайт: study24.ai

Агрегатор с каталогом из более чем 90 нейросетей и, на мой взгляд, самый удобный вход в тему. Ключевой инструмент для нашей задачи — GPT Image 2, та самая модель OpenAI, что рисует картинки внутри ChatGPT. Она понимает подробные русские промпты без перевода, аккуратно держит лицо при редактировании и позволяет прикладывать референсы.

2. AIgrator — видно цену каждой генерации до запуска

Официальный сайт: aigrator.ai

Молодой российский агрегатор с редкой для рынка честностью в ценах: внутренних токенов нет, рубль пополнения равен рублю расхода, а стоимость запроса показывается под окном чата еще до отправки и пересчитывается при смене модели или разрешения. Для фоторобота это приятно: вы заранее видите, во сколько обойдется очередная итерация правок. Из генераторов изображений доступны Nano Banana 2 и GPT Image 2 с выдачей до 4K, работают референсы.

3. Syntx AI — веб и Telegram в одной подписке

Официальный сайт: syntx.ai

Платформа с каталогом более чем на сотню моделей и одной общей подпиской на всё. Ценна прежде всего связкой веб-версии и Telegram-бота: черновик портрета можно собрать за компьютером, а показывать его свидетелю и править — прямо в мессенджере с телефона, что для поисков по району оказывается решающим. Для портретов здесь есть Nano Banana и Seedream, а если потребуется видео — Kling и Sora.

4. Маша GPT — русский интерфейс и подборка генераторов

Официальный сайт: mashagpt.ru

Российский агрегатор с отдельным разделом для изображений, где в одном окне лежат GPT Image 2, Flux 2, Nano Banana Pro, Seedream, Grok Imagine и Z-Image. Очень удобно, если нужен именно фоторобот: когда одна модель упрямо рисует не то лицо, можно переключиться на соседнюю с тем же промптом, не оформляя новую подписку. Есть проекты с сохранением контекста — вся серия правок по одному портрету остается в одном месте.

5. GPTunnel — оплата за фактические генерации

Официальный сайт: gptunnel.ru

Крупный агрегатор с большим каталогом моделей и оплатой по факту. Обязательной подписки нет, деньги списываются за конкретные генерации. Вариант для тех, кому нужен портрет просто здесь и сейчас, и кто не собирается платить за месяц вперед. Модели для изображений — свежие и актуальные, включая линейку Nano Banana с редактированием по текстовой инструкции. По промокоду AIMARKETCAP10 действует скидка 10% на пополнение счета.

Что делать с готовым портретом

Для поиска животного схема отработанная: печатаете объявления и расклеиваете в радиусе двух-трех кварталов, дублируете пост в районные чаты, группы во ВКонтакте и Telegram, отправляете картинку в ближайшие приюты, ветклиники и волонтерам. К изображению всегда добавляйте честную подпись вроде «портрет составлен по описанию, возможны отличия» — это снимает лишние ложные звонки и, наоборот, добавляет доверия.

Про людей скажу кратко, только основное. Сгенерированный портрет уместен как ориентир для волонтерских поисков. Но он не может считаться уликой или основанием для подозрения кого-либо в чем-либо. Публиковать изображение с подписью, обвиняющей конкретного человека, нельзя — это прямой путь в суд, где виноватым скорее всего окажетесь вы. Если речь о происшествии, портрет стоит передать в компетентные органы, а не сбрасывать в социальные сети.

Заключение

Объявление о пропавшем коте мы расклеили в тот же вечер. На следующий день его поймали подростки в соседнем дворе и вернули обрадованной хозяйке. В общем, при написании данного материала ни одно животное не пострадало, если не считать стресса от двухсуточного мотания по дворам и подвалам. Сейчас питомец в полном порядке, чего и вам желает.

А если серьезно — нейросети действительно позволяют нарисовать фоторобот человека или животного, причем очень быстро и качественно. Используйте советы из этого гайда, или просите ИИ самому быть вашим гидом. Иногда от точности и оперативности вашей совместной работы может зависеть чья-то жизнь и безопасность.

Часто задаваемые вопросы

Есть ли фоторобот онлайн бесплатно на русском? Toggle
Да, стартовых бесплатных лимитов у российских агрегаторов обычно хватает на несколько генераций. Полный цикл из восьми-десяти правок уже потребует пополнения баланса, но речь о десятках рублей.
Насколько точным получается сходство? Toggle
Портрет передает общее впечатление и характерные приметы, а не точные черты. Этого достаточно, чтобы человека или животное узнали на улице, но недостаточно для формального опознания.
Можно ли фоторобот создать по фотографии плохого качества? Toggle
Да, размытый или мелкий кадр можно приложить как референс и дополнить описанием по памяти. Для чистой реставрации снимка лучше сначала прогнать его через инструмент улучшения качества фото.
Как преобразовать фото в фоторобот в виде карандашного рисунка? Toggle
Приложите снимок к запросу и попросите модель сделать черно-белый карандашный портрет с сохранением всех пропорций лица и белым фоном. Готовый промпт есть в разделе с шаблонами выше.
Какая нейросеть лучше держит лицо при правках? Toggle
GPT Image 2 и Nano Banana Pro — обе модели сохраняют внешность персонажа между итерациями и понимают инструкции вроде «измени только нос».
Имеет ли такой портрет юридическую силу? Toggle
Нет. Это визуализация чьих-то слов, а не документ и не результат экспертизы, поэтому использовать его как доказательство или обвинение нельзя.