ИИ-танец по фото: как сделать вирусное видео, если вообще не умеешь танцевать

2026-08-14 15:25:26 Время чтения 8 мин 46

Сижу вечером, проверяю тетради у восьмиклассников, подходит Анюта с телефоном в руках: «Слушай, ну сколько можно, опять три лайка». У неё обычная личная страничка — фото из поездок, будничные мелочи, ничего особенного. Подруга посоветовала снять рилс с трендовым танцем — тогда, мол, и охват другой будет. Анюта морщится: танцевать не умеет и на камеру ради этого выступать не собирается.

Я не сразу понял, о чём вообще речь — кто танцует, если она сама отказалась? «Это, наверное, что-то из серии ии-танец по фото», — говорю наугад, лишь бы не выглядеть совсем не в теме. Анюта пожимает плечами: без понятия, подруга просто скинула ссылку.

Полез разбираться сам — хотя вообще-то сам всегда говорю ученикам «не гугли, пока не понял вопрос»

Вбил в поиск «ии танец по фото» — и оказалось, тема реально массовая: ролики, где статичное фото вдруг начинает двигаться под музыку, сейчас заполонили тик ток, шортсы и рилс, причём далеко не только у блогеров-миллионников. Никто из них правда не танцует — просто загружаешь фото, добавляешь видео-референс с чужой хореографией, а нейросеть переносит движения на изображение, сохраняя лицо и пропорции.

За большинством таких роликов сейчас стоит модель Seedance 2.0 от ByteDance (той же компании, что делает тик ток, что забавно само по себе) — она переносит движение с видео на фото, сама добавляет звук и держит лицо на месте даже при активной хореографии. Нашёл её в Study AI — она уже встроена в общий интерфейс, не пришлось отдельно регистрироваться и разбираться, где на неё оформлять доступ.

Попробовал на своём фото — стыдно, но покажу

Взял фото у себя дома, в комнате, где обычно готовлюсь к занятиям кружка — на стене как раз висят медали и грамоты ребят с олимпиад по робототехнике, приятно, что хоть в кадр попали. Встал ровно, в полный рост, ничего специально не подгонял. Референсом, не мудрствуя, выбрал первое, что пришло в голову из детства — «Танец маленьких утят»: движения там несложные, думал, идеально для теста.

Результат вышел, мягко говоря, специфический: приседаю, руки согнуты в стороны и хлопают, как утиные крылья, — хореография перенеслась один в один, — а лицо при этом сохраняет самое серьёзное учительское выражение, будто я не танцую, а объясняю у доски правило. Жутковато и смешно одновременно.

Показал Анюте — она смеялась минут пять, потом посмотрела ещё раз, уже внимательнее, и сказала: «А если я нормальное фото возьму, а не эти твои утиные пляски?»

Почему движение в кадре вообще так важно

Если по-простому — соцсети сейчас реально отдают предпочтение видео с движением, а не статике. Причём неважно, снято оно профессионально или нет — важно, что оно живое, есть ритм, есть динамика. Поэтому тренд «ии танцы» и «видео танец ии» так разросся — он даёт охват тем, кто:

  1. стесняется камеры;
  2. не умеет двигаться;
  3. не готов выкладывать себя в таком виде вживую.

Технология эту проблему снимает — танцуешь не ты, а перенесённое на тебя движение.

Для Анюты это оказалось ровно тем, что нужно: контент для страницы, где не надо ни петь, ни двигаться, ни ловить нужный ракурс камеры вживую — только выбрать подходящее фото и референс.

Что важно учитывать, чтобы не вышло криво — тут я набил шишек сам

После своего не самого удачного первого опыта я позже разобрался, от чего на самом деле зависит результат:

  1. Исходное фото. Лучше всего работает чёткий портрет анфас или почти анфас, во весь рост, без резких углов и без сильного обрезания по краям кадра. Собственно, по этой же причине моё домашнее фото и сработало прилично — встал ровно, ничего в кадре не обрезано, поэтому хореография перенеслась чисто, без «плывущих» стыков.
  2. Видео-референс. А вот тут я в самый первый раз, ещё до утят, взял ролик с очень резкой хореографией и постоянной сменой ракурса — получилась откровенная каша, лицо теряло форму на каждом рывке. Работает куда стабильнее, если движения плавные, без слишком быстрых переходов и без скачков камеры — «Танец маленьких утят» в этом смысле оказался удачным выбором чисто случайно.

Отдельно скажу про сам запрос к нейросети — если сервис позволяет его уточнять, не стоит ограничиваться коротким «оживи фото». Я не сразу это понял и в первый раз обошёлся парой слов — результат был так себе. Во второй раз расписал куда подробнее, и разница оказалась заметной:

Оживи фото по видео-референсу. Сохрани черты лица, причёску и пропорции тела без искажений. Одежду и фон оставь как на исходном фото, не меняй освещение и цветовую гамму. Движения — плавные, без резких рывков и без смены ракурса камеры, темп как в референсе. Если лицо на каком-то кадре теряет резкость — сделай его чуть более стабильным, не размывай черты. Формат вертикальный, 9:16.

Звучит длинно, но именно такие уточнения — про сохранение лица, фона и плавность — и решают, будет результат смотреться нормально или как моя первая неудачная попытка.

Как это выглядит теперь

Мне не пришлось разбираться в десятке разных сервисов ради одной задачи — тем более, что нейросетей для видео сейчас развелось столько, что уже не поймёшь, какая из них подойдёт именно для переноса движений. А тут всё оказалось в одном месте, и разбираться пришлось один раз.

Анюта, кстати, теперь делает так время от времени для своей страницы — берёт удачное фото, подбирает референс поспокойнее (без утят, надеюсь) и получает то самое «видео танец ии», из-за которого весь разговор и начался.

Так танцевать я и не научился

Учитель информатики так и не научился танцевать — ни сам, ни, честно говоря, через нейросеть тоже: то, что получилось на моём фото, к танцам имеет весьма отдалённое отношение. Но, кажется, это и не обязательно. Иногда достаточно один раз понять, как штука работает — а дальше уже сама разберётся, что с ней делать, даже если это не ты.