Как превратить фотографию в винтажную игрушку PEZ с помощью ИИ: промпт и инструкция

2026-08-18 12:00:57 Время чтения 12 мин 52

Есть промпты, которые просто меняют стиль фотографии. А есть такие, где нейросеть начинает собирать вокруг человека целый предметный мир.

В этом эксперименте задача простая: взять фотографию человека и превратить его в винтажный диспенсер PEZ — с характерной большой головой, пластиковым корпусом, упаковкой конфет и полкой магазина игрушек в эстетике конца 1990-х — начала 2000-х.

Причём важно не просто получить «человека в виде игрушки». Хороший результат должен выглядеть так, будто этот диспенсер действительно когда-то выпускался серийно.

Я протестировал такой подход на фотографиях известных людей. Ниже — сам промпт, инструкция по работе с референсом и несколько дополнительных команд, которые помогают исправить типичные ошибки генерации.

Для тестов я использовал единый интерфейс, который работает в России и без всяких обходов, где доступны Seedance 2.5, GPT Image 2, Claude, Nano Banana Pro и другие модели в одном месте. 

Воспользовался токенами для теста и так же пользовался через интерфейс бота с телефона.  Изображение можно сделать через одну из этих моделей. Я использовал GPT Image 2

Почему нейросеть не делает нормальную игрушку по одной фразе

Если написать:

«Преврати человека на фотографии в игрушку PEZ».

модель, скорее всего, поймёт общую идею. Но результат может оказаться довольно далёким от задачи.

Она может сохранить лицо, но сделать обычную пластиковую фигурку.

Или создать диспенсер, но потерять сходство с человеком.

Или сделать красивый фон, упаковку и магазин, но саму игрушку отправить куда-то на второй план.

Поэтому в таком запросе нужно отдельно описать несколько уровней изображения:

  1. внешность человека;
  2. конструкцию самой игрушки;
  3. материал;
  4. окружение;
  5. эпоху;
  6. композицию;
  7. характер съёмки.

Получается уже не просто запрос на стилизацию фотографии, а небольшое техническое задание для генератора.

Что понадобится

Для первого теста достаточно:

  1. Хорошего портрета человека.
  2. GPT Image 2.
  3. Вертикального формата.
  4. Одного подробного промпта.

Лучше всего работает портрет анфас или в три четверти, где хорошо видны лицо, волосы и характерные аксессуары.

Не стоит брать фотографию, на которой человек находится далеко от камеры, закрывает лицо рукой или стоит в компании из нескольких людей.

Чем больше модель видит исходных визуальных деталей, тем меньше ей приходится додумывать.

Главный промпт

Используй референсное изображение как источник внешности персонажа. Преврати изображённого человека в винтажный коллекционный диспенсер PEZ, сохранив его узнаваемый образ.Сохрани ключевые черты лица, форму лица, причёску, выражение, аксессуары и характерную цветовую палитру. Переосмысли эти особенности в дизайне головы коллекционной игрушки.Голова изготовлена из глянцевого литого пластика. Поверхность гладкая, с реалистичными отражениями, небольшими деталями пресс-формы и естественными пластиковыми швами. Пропорции слегка стилизованы под коллекционную игрушку.Используй характерную конструкцию диспенсера PEZ: увеличенная голова персонажа соединена с классическим прямоугольным корпусом диспенсера.Игрушка должна выглядеть как настоящий серийный коллекционный диспенсер конца 1990-х или начала 2000-х годов, а не как современный 3D-рендер или самодельная фигурка.Рядом находится запечатанная упаковка конфет PEZ.Покажи весь диспенсер целиком, от головы до основания. Игрушка является главным объектом изображения и занимает большую часть кадра.Диспенсер стоит на полке настоящего магазина игрушек конца 1990-х или начала 2000-х годов. Вокруг находятся разноцветные стеллажи, коробки с игрушками, упаковки товаров и характерные магазинные вывески того периода. Фон слегка размыт и не конкурирует с главным объектом.Освещение яркое и естественное, как в большом магазине игрушек. Ностальгическая цветовая палитра, реалистичные материалы, небольшое плёночное зерно.Коммерческая предметная фотография коллекционной игрушки. Чёткий главный объект, малая глубина резкости, естественные отражения на пластике, мягкая тень под диспенсером.Центральная композиция. Диспенсер слегка повёрнут под углом.Не добавляй современный дизайн упаковки, футуристические элементы, лишние персонажи или дополнительные предметы на переднем плане.

Здесь принципиально важно, что мы не пытаемся одним предложением объяснить нейросети всю картинку.

Сначала даём ей человека.

Потом — конструкцию.

Потом — материал.

После этого — эпоху и окружение.

И только в конце — требования к фотографии.

Так генератору проще удерживать приоритеты.

Как сохранить сходство с человеком

Это самая сложная часть подобных генераций.

Нейросеть легко превращает фотографию в «человека, похожего на исходного». Но нам нужен персонаж, которого можно узнать сразу.

Если лицо слишком сильно изменилось, добавьте в конец промпта:

Сохрани точную форму глаз, бровей, носа, губ, линии челюсти и причёску человека с референсного изображения. Несмотря на игрушечную стилизацию, персонаж должен оставаться узнаваемым с первого взгляда.

Если модель начинает слишком сильно стилизовать лицо, наоборот, стоит уменьшить количество декоративных характеристик и оставить больше прямых указаний на сохранение исходной внешности.

Если диспенсер обрезается

Это одна из самых частых проблем.

Нейросеть может сделать красивую голову, но нижнюю часть корпуса обрезать краем изображения.

В таком случае добавьте:

В кадре обязательно полностью виден весь диспенсер, включая основание корпуса. Между игрушкой и краями изображения остаётся свободное пространство.

Также помогает вертикальный формат.

Для такого объекта он естественнее: голова, корпус и основание помещаются в одну композицию без необходимости сильно уменьшать фигурку.

Если фон начинает конкурировать с игрушкой

Иногда генератор слишком увлекается магазином.

Вместо одной игрушки получается полноценная сцена, где сам диспенсер приходится искать среди коробок.

Тогда добавьте:

Диспенсер занимает большую часть кадра и является единственным главным объектом. Фон остаётся второстепенным, слегка размытым и не отвлекает внимание.

Это простое ограничение заметно меняет композицию.

Почему вообще работает такой промпт

Здесь есть несколько важных приёмов, которые можно использовать и в других генерациях.

1. Отдельно задаём человека

Фотография отвечает за внешность.

Не нужно переписывать словами причёску, форму носа, цвет глаз и другие детали, если генератор уже видит их на референсе.

2. Отдельно задаём объект

Фраза «сделай игрушку» слишком общая.

Мы указываем конкретную конструкцию, материал, форму корпуса и характерные детали.

3. Отдельно задаём эпоху

«Винтажный магазин» тоже довольно расплывчатое понятие.

Гораздо точнее работают конкретные временные рамки:

конец 1990-х — начало 2000-х.

После этого можно добавить упаковку, стеллажи, вывески и характер освещения.

4. Отдельно задаём съёмку

Коммерческая предметная фотография, малая глубина резкости, мягкая тень и отражения на пластике заставляют модель думать уже не просто о картинке, а о фотографии товара.

Именно это помогает уйти от ощущения обычного AI-рендера.

Почему стоит прогнать один промпт через несколько моделей

Здесь есть интересный эксперимент.

Не нужно каждый раз переписывать запрос.

Берём:

один референс → один промпт → несколько моделей.

А потом сравниваем:

  1. где лучше сохранилось лицо;
  2. где реалистичнее пластик;
  3. где лучше получился корпус;
  4. где убедительнее магазин;
  5. где меньше артефактов;
  6. где композиция ближе к настоящей предметной фотографии.

Для этого удобно использовать единый интерфейс: не приходится собирать отдельные сервисы для каждого эксперимента.

И это как раз тот случай, когда агрегатор полезнее, чем просто «ещё один генератор». Ты сравниваешь не разные настройки одной модели, а разные способы решения одной и той же задачи.

Что делать после первой генерации

Не нужно сразу переписывать весь промпт.

Сначала найдите главную ошибку.

Например, лицо получилось отлично, но корпус обрезался.

Исправляем только корпус.

Если лицо не похоже, работаем только с референсом и сохранением внешности.

Если игрушка хорошая, но магазин выглядит современным — добавляем ограничения для эпохи.

Это намного эффективнее, чем каждый раз генерировать совершенно новый запрос.

Можно даже использовать отдельные короткие команды.

Исправить сходство

Сохрани внешность человека максимально близко к исходному референсу. Не изменяй форму глаз, носа, губ, бровей, подбородка и причёску. Игрушечная стилизация не должна мешать узнаваемости персонажа.

Исправить композицию

Увеличь размер диспенсера в кадре. Игрушка должна занимать большую часть изображения. Полностью покажи голову, корпус и основание. Фон оставь второстепенным и слегка размытым.

Исправить эпоху

Усиль визуальные признаки конца 1990-х — начала 2000-х годов: дизайн упаковок, цвета пластиковых стеллажей, вывески магазина, освещение и оформление полки должны соответствовать этому периоду. Не добавляй современные элементы.

А можно сделать такую игрушку из собственной фотографии?

Да. И именно здесь формат становится интереснее обычного эксперимента со знаменитостями.

Возьмите свой портрет и попробуйте сделать собственную коллекционную серию.

Хорошо работают визуальные признаки, по которым человека легко узнать:

  1. характерные очки;
  2. необычная причёска;
  3. борода или усы;
  4. привычная одежда;
  5. яркий аксессуар;
  6. специфическая мимика.

Причём необязательно делать только PEZ.

Тот же принцип можно перенести на:

фигурку в блистере, коллекционную игрушку, виниловую фигурку, игрушку из автомата, ретро-упаковку или рекламный макет товара.

Меняется объект и визуальный контекст, а логика промпта остаётся той же.

Что в итоге действительно влияет на результат

Самая полезная мысль из этого эксперимента довольно простая.

Нейросети не обязательно давать длинный художественный текст. Ей нужно разложить задачу на визуальные слои.

Сначала — кто или что находится на исходном изображении.

Потом — во что мы это превращаем.

Дальше — материал и конструкция.

После этого — окружение и эпоха.

И в конце — камера, свет и ограничения.

Получается универсальная схема:

референс → объект → материал → окружение → эпоха → композиция → съёмка → ограничения.

Её можно использовать далеко за пределами игрушек.

Например, чтобы превратить фотографию человека в упаковку коллекционной фигурки, сделать ретро-рекламу собственного продукта или представить, как выглядел бы бренд в определённую эпоху.

А PEZ — просто хороший пример, потому что здесь сразу видно, насколько сильно меняется результат, когда нейросети дают не абстрактное «сделай красиво», а нормальное техническое задание.

Теги: нейросетинейросети для фотолучшие нейросети для фотогенерация фотолучшие нейросети для фото 2026нейросети для реставрации фототренды нейросетей 2026изменить фон с фотокак сделать фотосессию через AIкак сделать фото через иинейросети для фото и видеокак изменить фото иинейросети для фото 2026ГенерацияФотокак сделать фото через нейросетьнейросети для фото онлайнГенерация фотографийнейросеть генерация фотокак сделать фото с собой через нейросетьгенерация фото со своим лицомизменить возраст на фотоИзменить взгляд на фотоизменить позу на фотогенерация фото в нейросетигенерация фото бесплатногенерация образа по фотодоступные нейросети в РФнейросети для создания роликовкак написать промт для нейросетинейросети искусственный интеллект AI-бюджет агрегаторы нейросетей стоимость токенов маркетинговый бюджет агентства автоматизациянейросети обучение курсынейросети обучение с нуляигрушка PEZPEZКак превратить фотографиюизменить фототренды нейросетей