Я протестировала инструменты в Маша GPT, которые меняют подход к оживлению фото. Вместо банальных улыбок и поворотов головы нейросети создают 13-секундные ролики с озвучкой и даже позволяют заменять героев на готовом видео. Рассказываю, как это работает на практике и где пригодится в ежедневной работе с контентом.
В разделе «Приложения» выбираем модель Kling V1 Avatar Pro. Для работы нужно загрузить три элемента: фото, аудио до 12 секунд и текстовый сценарий. Я взяла портрет ближнего плана, где девушка смотрит прямо в камеру и позирует на фоне пустыни, добавила звук ветра и описала действие простыми словами: «поворачивает голову влево и смотрит вдаль». Генерация заняла три минуты. На выходе — короткое видео, где героиня поворачивает голову в такт звуку.
Вторая модель — Wan 2.2 Animate Replace — работает иначе. Она не создает видео с нуля, а подменяет героя на уже готовом ролике. Фон, движение и звук остаются неизменными. Я загрузила видео с девушкой на фоне пустыни и фото другой девушки — через пять минут получила тот же сюжет, но с новым персонажем. Это удобно для быстрого тестирования образов без пересъемки.
Честно скажу, что визуал пока неидеален. К концу ролика лица иногда «плывут», а в режиме замены могут искажаться пропорции тела. Функция новая — висит значок NEW, и разработчики ее активно дорабатывают. Но скорость впечатляет — 3-5 минут на генерацию это очень быстро для таких задач.
Оба режима помогают превращать статичные кадры в живой и привлекающий внимание материал. Например:
Если планируете использовать инструмент регулярно, учитывайте несколько моментов. Качество пока нестабильное — для важных проектов делайте несколько дублей. Аудио ограничено 12 секундами, поэтому длинные записи придется обрезать. Сценарий описывайте максимально конкретно: «идет влево» сработает лучше, чем «двигается грациозно». Бесплатно дается 5 генераций в день — этого хватит для экспериментов и черновой работы.