У меня в телефоне сотни фотографий, но ситуация знакомая: когда срочно нужна нормальная фотография для аватарки, поста или просто хочется обновить соцсети, выбирать почему-то не из чего. На одном снимке не нравится фон, на другом — одежда, третий сделан вечером при странном освещении, а четвертый вообще хороший, но ему уже несколько лет.
Раньше решение было понятным: найти фотографа, выбрать студию, придумать образ, договориться о времени и потратить несколько часов на съемку. Сейчас появился другой вариант — нейросеть для фото, которая может взять обычный исходный снимок и собрать на его основе совершенно новую сцену.
Я решила проверить это на ИИшенке. Здесь как раз можно использовать нейросеть не только для абстрактных картинок, но и для обычных развлечений со своими фотографиями: менять образы, создавать новые локации, экспериментировать со стилями и превращать статичные фото в более необычный контент.
Начала я с самого простого — обычного портрета из телефона. Никакой студии, профессионального света и камеры за несколько сотен тысяч рублей. И оказалось, что именно с такого исходника можно сделать довольно много.
Когда говорят «нейросеть фото», многие до сих пор представляют генератор, которому нужно написать длинный запрос и ждать, какую случайную картинку он нарисует. Но работа с фотографией устроена немного иначе. Уже есть человек, его лицо, внешность и исходный кадр, а нейросеть должна построить вокруг этого новую историю.
Например, можно оставить человека и поменять локацию. Обычная фотография возле стены превращается в кадр из кофейни в Париже, прогулку по ночному городу или съемку на берегу моря. При этом можно менять одежду, освещение, настроение фотографии и даже время года.
Именно поэтому мне больше нравится относиться к таким генерациям как к виртуальной фотосессии. Ты не просишь нейросеть нарисовать случайного персонажа — ты примерно представляешь, какой кадр хочешь получить, и постепенно собираешь его из деталей.
В ИИшенке этот формат особенно удобен тем, что не обязательно сразу разбираться во всех технических терминах. Можно начать с понятной идеи, а дальше уже смотреть, насколько далеко хочется зайти в экспериментах.
Для первого теста я специально не брала идеальный портрет. Хотелось понять, может ли нейросеть вытянуть обычное фото из галереи, а не только качественный студийный исходник.
На фотографии был нормальный свет, хорошо видно лицо, но фон совершенно обычный. В реальной жизни я бы такой кадр, скорее всего, просто оставила в телефоне.
Для нейросети этого оказалось достаточно.
Первый сценарий был максимально простой: сделать более аккуратный портрет, поменять окружение и сохранить естественную внешность. Без фантастической одежды, замков на фоне и прочих вещей, которые очень любят показывать в демонстрациях возможностей AI.
Получившийся результат оказался интересен именно своей обычностью. Это выглядело не как «посмотрите, что нарисовала нейросеть», а скорее как фотография, которую действительно можно было бы сделать на нормальной съемке.
И вот здесь я поняла, зачем вообще людям нужна нейросеть для фото.
Не обязательно ради чего-то невероятного. Иногда хочется просто получить еще один хороший снимок себя.
После первого результата появляется желание сразу переделать всё: добавить другую прическу, сменить одежду, отправиться в Нью-Йорк, сделать ночь вместо дня и заодно поставить рядом старый кабриолет.
Но с нейросетью, как оказалось, лучше работает немного другой подход.
Я начала менять по одной-две вещи.
Сначала оставила человека и поменяла только фон. Потом изменила одежду. Затем попробовала другой свет. После этого взяла тот же исходник, но сделала совсем другое настроение кадра.
Так гораздо легче понять, что именно улучшает фотографию, а что превращает ее в перегруженную AI-генерацию.
Например, для обычного портрета можно дать такой запрос:
«Естественная фотография девушки в уютной кофейне, мягкий дневной свет из окна, спокойный образ, нейтральная одежда, реалистичная кожа, небольшая глубина резкости».
Здесь нет огромного списка технических параметров. Но нейросеть уже понимает, какого результата мы хотим.
Разумеется, долго удержаться от экспериментов с локациями я не смогла.
Одно из самых очевидных развлечений — отправить себя туда, где в реальности ты сейчас не находишься. Париж, Италия, океан, горы, Нью-Йорк, старый европейский город — вариантов практически бесконечное количество.
Я попробовала сделать несколько фотографий в одной стилистике: утреннее кафе, прогулка по улице и вечерний кадр возле старого здания.
И вот тут особенно заметно, насколько нейросеть для фото отличается от обычного фильтра. Фильтр может поменять цвет или добавить эффект. Нейросеть полностью перестраивает сцену: создает освещение, фон, одежду и взаимодействие человека с пространством.
Главное — не пытаться засунуть в один запрос все идеи одновременно.
Вместо «Париж, Эйфелева башня, цветы, дождь, кафе, красное платье, велосипед, закат и кинематографичная съемка» лучше выбрать одну сцену.
Например:
«Утренняя улица Парижа, небольшое кафе, девушка сидит за столиком у окна, светлое пальто, естественный дневной свет, спокойная lifestyle-фотография».
Так результат обычно выглядит намного натуральнее.
Вот это, пожалуй, оказалось интереснее одной красивой фотографии.
Если использовать один и тот же образ и последовательно менять только сцену, можно попробовать собрать небольшую историю. Не пять случайных фотографий, а условную виртуальную фотосессию.
Например, тема «Один день в Италии».
Первое фото — утреннее кафе.
Второе — прогулка по старой улице.
Третье — рынок с фруктами и цветами.
Четвертое — берег моря ближе к закату.
Пятое — вечерняя терраса ресторана.
В ИИшенке такие эксперименты становятся особенно залипательными, потому что после удачного первого результата хочется сразу посмотреть продолжение. А что будет, если оставить тот же образ, но поменять время суток? А если вместо Италии сделать старый Париж? А если вообще перенести все это в 1960-е?
В какой-то момент нейросеть превращается уже не в редактор фото, а в конструктор небольших визуальных историй.
Здесь никакого волшебства нет. Если загрузить фотографию, где лицо занимает десять пикселей, половину человека закрывает другой человек, а сверху наложен очень тяжелый фильтр, даже хорошей модели придется слишком многое додумывать.
Лучше всего у меня работали фотографии, где лицо четко видно, есть нормальное освещение и внешность не изменена масками или агрессивной ретушью.
Особенно это важно, если хочется сохранить узнаваемость.
И еще я бы не стала сразу брать групповые фотографии. Чем проще исходный кадр, тем легче нейросети понять, с кем именно она работает.
Поэтому иногда пять минут на поиск нормального исходника экономят гораздо больше времени, чем бесконечное переписывание промта.
Это отдельное развлечение, которое мне понравилось даже больше смены локаций.
Можно взять одну фотографию и посмотреть на себя в совершенно разных стилях: деловом, винтажном, вечернем, спортивном или вообще фантастическом.
В реальной жизни ради такого эксперимента никто не будет покупать пять комплектов одежды и арендовать несколько студий. А с нейросетью сама идея «интересно, как это будет выглядеть» уже достаточная причина попробовать.
Особенно забавно делать противоположные образы.
Например, сначала строгая деловая съемка: темный костюм, современный офис, минимализм. Затем тот же человек — летний курорт, легкая одежда и солнечная набережная. А после этого — винтажный портрет в стилистике старого кино.
Никакой практической цели здесь может вообще не быть. Просто интересно посмотреть.
И мне кажется, именно поэтому такие сценарии постепенно становятся массовыми.
Самая логичная мысль после хорошей генерации: а что, если теперь сделать из нее видео?
Именно поэтому современные сервисы постепенно перестают делиться строго на «нейросеть для фото» и «нейросеть для видео». Одно становится продолжением другого.
Сначала создаешь кадр. Потом добавляешь движение камеры, волос, одежды или самого человека.
Если исходное изображение уже выглядит естественно, короткое видео иногда получается особенно удачным. Например, человек слегка поворачивает голову, ветер двигает волосы, камера плавно приближается.
При этом я бы не пыталась сразу заставить персонажа исполнить сложный танец. Чем спокойнее движение, тем меньше вероятность, что нейросеть решит добавить что-нибудь от себя.
Сценариев на самом деле больше, чем кажется.
Самое очевидное — социальные сети. Можно обновить аватарку, сделать несколько фотографий для постов или просто собрать небольшую серию в одном стиле.
Еще интереснее использовать нейросеть для идей. Например, перед настоящей фотосессией можно заранее проверить разные сочетания одежды, фона и света. Это не даст точную копию будущего кадра, но поможет понять направление.
Можно делать необычные поздравления, картинки для Telegram, обложки, аватары, визуалы для небольших личных проектов.
А можно вообще ничего не публиковать.
Иногда весь смысл в том, чтобы вечером сделать десять странных генераций, выбрать самую смешную и отправить ее друзьям.
Нейросеть вполне имеет право быть просто развлечением.
После нескольких вечеров с генерациями возникает неожиданная проблема: возможностей много, а ты уже не знаешь, что написать нейросети следующим.
Поэтому интересные идеи для фото, готовые промты, сценарии генераций и мои следующие эксперименты я собираю отдельно в своем канале. Туда удобнее добавлять небольшие находки, которые не требуют отдельной большой статьи.
Иногда достаточно увидеть один чужой пример, чтобы сразу придумать пять собственных вариантов.
После всех экспериментов с ИИшенкой я поняла простую вещь: мне гораздо интереснее использовать нейросеть не для создания случайных изображений, а для работы со своими фотографиями.
Потому что тогда появляется личный элемент.
Можно посмотреть на себя в совершенно другом образе, собрать виртуальную поездку, попробовать фотосессию, которую в реальной жизни пока не хочется организовывать, или сделать из обычного снимка несколько секунд видео.
Да, нейросеть всё еще иногда ошибается. Может странно придумать детали, неудачно обработать руку или решить, что прическе срочно требуется собственная творческая концепция. Поэтому результат приходится выбирать и иногда переделывать.
Но сам процесс стал настолько простым, что для него уже не нужен особый повод.
Берешь фото из галереи, придумываешь сцену и смотришь, что из этого получится.
А дальше обычно начинается знакомое: «Ладно, еще одну генерацию — и всё».