Как я делаю ИИ-видео с девушкой и своей машиной: повторяю тренд с прыгающим автомобилем через Pauk AI, а для персональной версии использую фото и видео-референсы.
В этом тренде меня цепляет не сам прыжок автомобиля, а реакция героини. Девушка спокойно сидит перед камерой, поправляет волосы или делает щелчок пальцами, а далеко за её спиной машина вылетает из-за холма. Она даже не оборачивается. Именно на таком контрасте и держится тренд с машиной и девушкой: впереди почти ничего не происходит, а сзади внезапно начинается маленькая экшен-сцена.
Если мне нужно просто повторить базовый тренд с прыгающей машиной, я бы не начинал с длинного промпта. В Pauk AI уже есть готовый «Тренд с машиной»: достаточно одного фото человека, чтобы получить ИИ видео с машиной без ручного монтажа и выбора отдельной модели. А вот если я хочу поставить в кадр свою машину, сохранить конкретную одежду или повторить движение из чужого ролика, тогда уже перехожу к референсам и более точным промтам для ИИ с машиной.
В базовой версии Pauk AI как раз позволяет начать с готового сценария и одной фотографии.
Для меня здесь важнее сначала понять композицию. Героиня должна оставаться крупной на переднем плане, а автомобиль — находиться заметно дальше. Если машина становится главным объектом кадра, весь эффект теряется: вместо ИИ девушки и машины получается просто автомобильный ролик.
Поэтому в базовой версии я оставляю сцену простой: девушка смотрит в камеру, сидит спокойно или делает щелчок, а прыжок автомобиля занимает буквально короткий момент. Чем меньше героиня реагирует на происходящее, тем сильнее выглядит контраст. В исходной статье этот принцип уже заложен: человек остаётся главным объектом, а машина работает как внезапный визуальный эффект. Вставленный Markdown
Такой подход ещё и помогает понять, как создать ИИ видео с машиной без перегенераций. Если нужен стандартный сценарий, я использую готовый тренд. Если нужна своя машина, другой образ или точное повторение исходного движения, тогда уже разделяю задачу на референсы: человек отдельно, автомобиль отдельно, а видео отвечает только за движение и камеру.
Если мне нужен классический тренд с машиной и девушкой, я не начинаю со стартового кадра, длинного промпта и выбора между несколькими видеомоделями. В Pauk AI эта сцена уже собрана в разделе «Тренды»: мне достаточно загрузить одну фотографию человека и запустить генерацию.
Для меня это самый короткий ответ на вопрос, как создать ИИ видео с машиной без перегенераций из-за неправильно описанной траектории или камеры. В базовом сценарии эти детали уже заданы заранее.
Сначала я открываю Pauk AI:
Если мне нужен именно готовый эффект, я не выбираю отдельно Kling, Seedance или другую модель. Сначала проверяю более простой путь через готовый сценарий.
В меню открываю раздел «Тренды». Здесь уже собрана последовательность будущего ролика, поэтому мне не приходится отдельно объяснять нейросети, где находится героиня, когда она должна щёлкнуть пальцами и откуда должен появиться автомобиль.
Это особенно удобно для первого ролика: вместо технического задания на несколько абзацев я выбираю уже настроенную механику.
Дальше нахожу «Тренд с машиной».
Сцена строится вокруг одного момента: человек находится на переднем плане, делает щелчок, а через мгновение машина вылетает из-за холма и проходит в воздухе за его спиной. Так получается готовая основа для ИИ видео с машиной, где мне не нужно вручную выставлять тайминг каждого действия.
Для этой версии мне достаточно одной фотографии человека. Я бы выбирал снимок, где лицо хорошо видно, нет сильного размытия, а волосы, руки или другие предметы не перекрывают основные черты.
Отдельное фото машины, пустыни или стула здесь не требуется. Это важно: если я просто хочу повторить тренд, мне нет смысла усложнять генерацию лишними референсами.
После загрузки фотографии я запускаю генерацию. На выходе получаю вертикальное ИИ видео с машиной: герой оказывается в готовой сцене, делает характерный жест, а автомобиль совершает прыжок на заднем плане.
Поэтому базовую версию я бы всегда начинал именно так. А уже если мне нужна собственная машина, конкретная одежда или точное повторение чужого ролика, я перехожу к двум фото, видео-референсу и ручным промтам для ИИ с машиной.
В готовом сценарии Pauk AI промпт мне не нужен. Но если я хочу изменить исходную идею — например, перенести действие из пустыни на горную дорогу, поменять положение героини или самостоятельно задать траекторию автомобиля, — тогда уже собираю сцену через отдельную видеомодель.
Для тренда с прыгающей машиной я бы начал с такого варианта:
A calm woman sits on a folding chair in the foreground of a wide desert road, looking directly at the camera. She wears sunglasses and remains relaxed. Far behind her, a large off-road pickup accelerates toward a low hill, suddenly launches from behind the crest and flies through the air across the background. A dense cloud of dust follows the vehicle. Realistic wheel rotation, suspension movement and vehicle physics. THE WOMAN REMAINS CALM, DOES NOT TURN AROUND AND DOES NOT REACT TO THE VEHICLE. CAMERA: static medium shot. The woman remains large in the foreground; the pickup stays smaller and clearly separated in the distant background. LIGHT: bright cinematic desert daylight. Vertical 9:16. No logos, no readable license plates, no distorted text.
Что я здесь фиксирую. Я специально разделяю героиню и автомобиль. Для девушки задаю положение, взгляд и отсутствие реакции, а для машины — отдельную точку старта, прыжок и траекторию. Так модели проще понять, что это два независимых действия в одной сцене.
Как я меняю сцену. Вместо пустыни можно поставить горную трассу, морское побережье, ночную парковку или городскую дорогу. Стул можно заменить шезлонгом, парапетом или капотом, но я бы не менял слишком много элементов одновременно.
Где у меня был бы главный риск. Если убрать фразу о спокойной реакции, персонаж может начать оборачиваться вслед за автомобилем — и исчезнет весь контраст. Вторая типичная проблема — слишком близкая машина: она перекрывает героиню, становится главным объектом и ломает композицию тренда с машиной и девушкой.
Когда мне уже мало готового шаблона, я перехожу к ручной генерации. Здесь главное — не пытаться одним абзацем описать одновременно девушку, автомобиль, камеру и физику. Я разделяю сцену на роли: человек отвечает за передний план, машина — за экшен, а камера остаётся максимально предсказуемой.
Для классической версии я оставляю девушку крупно в кадре, а автомобиль отправляю далеко назад.
A calm young woman sits on a folding chair in the foreground of a desert landscape, looking directly at the camera. Far behind her, an off-road pickup accelerates toward a low hill, launches into the air and crosses the background. Large dust cloud, realistic suspension and wheel motion. The woman remains completely calm and does not turn around. Static medium shot, vertical 9:16. No logos or readable license plates.
Так сохраняется главное правило тренда: машина впечатляет, но не перетягивает внимание с героини.
Если хочется более экстремального варианта, я бы поднял траекторию выше и сделал автомобиль визуально ближе.
A woman relaxes on a sun lounger on an empty desert road, looking at her phone. A large off-road pickup jumps from a ramp in the background and flies in a high arc above and behind her. She does not react. Dust, realistic vehicle physics, cinematic daylight, vertical 9:16.
Сцену «машина над головой» я бы использовал осторожно: если автомобиль поставить слишком близко, нейросеть может начать смешивать его с человеком или закрыть половину кадра.
Иногда мне сначала нужен не ролик, а хороший стартовый кадр для видео с машиной. Тогда я собираю статичную сцену по фотографии человека.
Используй загруженную фотографию девушки как главный референс внешности. Точно сохрани лицо, возраст, форму лица, цвет глаз, причёску и волосы. Девушка стоит рядом с тёмным спортивным автомобилем на пустой дороге после дождя. Ночной город, отражения неона на мокром асфальте и кузове, реалистичная фотография, 35 mm. Не меняй внешность девушки.
Такое ИИ фото с машиной по своему лицу можно использовать как самостоятельную картинку или как первый кадр для дальнейшей анимации.
Для обложки я бы не перегружал сцену движением. Здесь важнее лицо, автомобиль и свет.
Use the uploaded woman as the identity reference. Preserve her exact face, apparent age and hairstyle. She sits casually on the hood of a convertible near the sea at sunset. Elegant light-colored outfit, warm backlight, soft wind in her hair, glossy vehicle paint, realistic fashion photography, cinematic composition. No readable logos or license plates.
Так получается фотосессия у машины для обложки, которая визуально связана с роликом, но не пытается повторить сам прыжок.
Если мне нужно видео с машиной по двум фото, я жёстко разделяю источники:
Самая важная часть промпта для меня выглядит так:
Attachment 1 = character identity, appearance and outfit only. Attachment 2 = vehicle identity only. Original video = motion, timing, camera movement and choreography only. Strictly preserve the face, gender, apparent age, hairstyle, body proportions, clothing and shoes from Attachment 1. Strictly preserve the body type, color, proportions, design and approximate real-world size of the car from Attachment 2. Do not blend references. Do not redesign the person or vehicle.
Именно так я бы решал задачу как вставить свою машину в ИИ видео, не позволяя модели брать её характеристики из исходного ролика.
Для меня это один из самых интересных вариантов тренда. Если уже есть хороший исходный ролик, не обязательно заново описывать момент щелчка, камеру и прыжок автомобиля. Видео можно использовать только как источник движения.
Сильная сторона. Исходник задаёт тайминг, жест героя, положение камеры и траекторию автомобиля. Поэтому проще перенести движение машины из видео на свои фото, чем пытаться воспроизвести его словами.
Ограничение. Нужен сам видео-референс. Чем сильнее новая машина отличается по размерам и кузову от исходной, тем больше шанс, что во время прыжка появятся деформации.
Промт:
Use the original reference video only for motion, timing, camera movement, composition and choreography. Replace the original person with the person from Attachment 1. Strictly preserve their exact face, gender, apparent age, hairstyle, body proportions, clothing and shoes. Replace the original vehicle with the exact car from Attachment 2. Preserve its body type, proportions, color, wheel design and approximate real-world size. Keep the original finger snap, character pose, vehicle jump timing, flight trajectory and camera movement unchanged. Attachment 1 defines the character only. Attachment 2 defines the vehicle only. The reference video defines motion only. No face blending, no clothing redesign, no vehicle redesign, no change of car color or body type.
Так я бы решал задачу заменить человека и машину в видео одновременно, а не пытался исправлять результат после генерации.
Если видео-референса нет, я бы использовал Kling для ручной постановки сцены.
Сильная сторона. Здесь можно подробно описать движение автомобиля, расстояние до девушки и момент прыжка.
Ограничение. Чем сложнее движение, тем важнее хороший стартовый кадр для видео с машиной. Фразы вроде «машина эффектно прыгает рядом» слишком расплывчаты.
Промт:
A calm woman sits on a folding chair in the foreground, looking directly at the camera. Far behind her, an off-road pickup accelerates up a low desert hill, launches into the air and crosses the background from left to right. Realistic suspension, wheel rotation and vehicle physics. Large dust trail. The woman remains still and never looks back. Static medium shot, cinematic daylight, vertical 9:16.
Veo я бы рассматривал для версии, где хочется усилить атмосферу: пыль, свет, масштаб сцены, движение камеры и звук, если выбранный режим его поддерживает.
Сильная сторона. Подходит для более постановочного ИИ видео с машиной и звуком мотора.
Ограничение. Если приоритет №1 — точное лицо конкретного человека, я бы обязательно проверял результат именно на своём референсе.
Промт:
Cinematic desert road at golden hour. A calm woman sits in the foreground and looks directly at the camera. She snaps her fingers. Far behind her, a large off-road pickup suddenly launches from behind a dusty hill and flies through the frame. Massive sand cloud, realistic vehicle physics, dramatic sunlight. The woman never turns around. Loud engine acceleration and deep off-road engine sound. Vertical social-video composition.
Seedance я бы выбирал, если основная задача — девушка и машина в одном кадре по двум отдельным изображениям.
Сильная сторона. Удобно разделять человека и автомобиль по референсам.
Ограничение. Я бы обязательно прямо писал, что первое изображение отвечает только за человека, а второе — только за автомобиль. Иначе модель может начать менять цвет, кузов или внешность.
Промт:
Image 1 is the identity and outfit reference for the woman. Preserve her face, apparent age, hairstyle, body proportions, clothing and shoes. Image 2 is the vehicle reference. Preserve its exact body type, color, proportions and approximate size. The woman sits calmly on a folding chair on a dusty desert road. Far behind her, the exact car from image 2 launches from behind a hill and flies through the air. She never turns around. Large dust cloud, realistic motion, cinematic daylight, vertical 9:16.
Такой подход я бы использовал, когда особенно важно сохранить лицо девушки в ИИ видео и одновременно не потерять конкретный автомобиль.
Если ручная видеогенерация плохо понимает композицию, я бы сначала собрал статичную картинку. Это помогает заранее зафиксировать, где находится девушка, как она выглядит и какое место занимает машина.
Сильная сторона. Можно подготовить ИИ фото с машиной по своему лицу, а уже затем оживлять готовую композицию.
Ограничение. Это только изображение — сам прыжок создаётся уже в видеомодели.
Промт:
Используй загруженную фотографию девушки как главный референс внешности. Максимально точно сохрани лицо, возраст, форму лица, причёску, волосы и основные черты. Девушка спокойно сидит на складном стуле на пустынной дороге. Она занимает большую часть переднего плана. Позади неё на большом расстоянии находится внедорожный пикап. Яркий дневной свет, сухой пейзаж, реалистичная фотография, кинематографичная композиция. Не меняй внешность девушки.
Одна из самых неприятных проблем возникает, когда загружаешь конкретный автомобиль, а в ролике появляется что-то лишь отдалённо похожее. Меняется кузов, исчезают характерные колёса, другой оттенок краски — а иногда машина ещё и внезапно становится больше.
Поэтому на запрос как заменить машину в видео через ИИ я бы не ограничивался фразой use the car from image 2. Я отдельно закрепляю:
Для меня хорошая формула выглядит так:
Strictly preserve the exact vehicle identity from Attachment 2: body type, exterior proportions, paint color, wheel design and approximate real-world size. Do not redesign, restyle or replace the vehicle with a similar car.
Так у модели гораздо меньше свободы «улучшать» машину по своему вкусу.
Здесь работает тот же принцип: чем меньше противоречивых инструкций, тем лучше. Я использую чёткую фотографию лица, отдельно закрепляю внешность и не заставляю модель одновременно менять возраст, причёску, одежду и позу.
Для тренда с машиной и девушкой я бы придерживался четырёх правил:
Если используется Motion Control, я прямо пишу: reference video defines motion only. Это помогает не смешивать внешность оригинального героя с новым человеком.
Я бы не искал одну универсальную нейросеть на все случаи. Для меня выбор зависит от того, что именно хочется изменить.
Для меня эта логика проще, чем выбирать модель только по названию: сначала решаю, что именно должен контролировать ИИ, а уже потом выбираю инструмент.