Google выкатил замену Veo 3.1. Новая нейросеть для создания и редактирования видео - Gemini Omni Flash. Главная фишка инструмента кроется не в генерации с нуля, а в диалоговом редактировании. Вы загружаете ролик, просите поменять фон, и нейросеть пересобирает кадр. Без сложных масок и трекинга.
Официально Google AI Studio и Gemini API в России не работают. Прямая оплата не проходит. Ниже разбираем реальные возможности модели, её косяки и рабочий способ запуска через агрегаторы нейросетей.
ИИ действительно поражает возможностями, попробуйте сделать ролик в Gemini Omni Flash или внести изменения в готовой. В панели управления можно выбрать режим работы и установить тайминг в видео для внесения изменений.
Gemini Omni Flash — мультимодальная модель. Она переваривает текст, картинки и видео, выдавая на выходе готовый MP4-ролик со звуком. В API она маркируется как gemini-omni-flash-preview.
Базовые сценарии работы
Забудьте про нативные 4K. Текущая версия модели имеет жесткие лимиты. Это инструмент для быстрых креативов, а не для кинотеатрального проката.
Google планомерно заменяет Veo 3.1 на Omni Flash внутри приложения Gemini. Причина проста. Veo 3.1 — это классический генератор. Omni Flash — это генератор и редактор в одном флаконе.
Omni принимает существующее видео и меняет его по команде. Она лучше справляется с последовательными задачами. Создали ролик. Поменяли свет. Заменили куртку на персонаже. Veo 3.1 так не умеет. Зато у старой Veo пока остались козыри в виде продолжения сцены (Scene Extension) и интерполяции между первым и последним кадром. Если вам нужны именно эти функции, ищите сервисы, где Veo 3.1 еще поддерживается.
Прямой путь закрыт. При попытке открыть Google AI Studio с российского IP вы увидите заглушку. Смена региона аккаунта не решает проблему оплаты — российские карты Google не принимает. Использовать зарубежные виртуалки ради пары тестов дорого и неудобно.
Адекватный выход — использовать агрегатор нейросетей. Вы получаете доступ к официальному API модели через единый русскоязычный интерфейс с оплатой картами МИР или по СБП.
Алгоритм действий
Агрегатор берет на себя маршрутизацию запроса к серверам Google и возвращает вам готовый MP4. Учитывайте тарификацию. В официальном API 10-секундный ролик стоит 1 доллар. В агрегаторах цена конвертируется во внутренние кредиты или рубли. Каждая правка готового видео — это новая генерация, которая спишет баланс.
Модель любит конкретику. Абстрактные запросы выдают мыло и галлюцинации.
Формат кадра → объект → действие → окружение → камера → освещение → стиль → звук.
Пример рабочего промпта
Один непрерывный кадр без склеек. Молодой бариста наливает латте в черную кружку. Современная кофейня, кирпичные стены. Медленный наезд камеры. Мягкий утренний свет из окна, кинематографичный стиль. Слышен шум кофемашины и тихий джаз на фоне.
Что изменить → как это должно выглядеть → что сохранить.
Пример команды для правки
Надень на баристу красный фартук. Сохрани лицо, фон, движение камеры и освещение без изменений.
Лайфхак. Всегда добавляйте фразу про сохранение остальных элементов. Иначе нейросеть может перерисовать половину кадра по своему усмотрению.
Киллер-фича Omni Flash — контекстная память. Вы общаетесь с видео как с чат-ботом. Загрузили ролик с идущей девушкой. Пишете «сделай фон ночным городом». Получаете результат. Следом пишете «добавь дождь». Модель понимает, что нужно наложить дождь на ночной город из предыдущего шага.
С референсами тоже стало проще. Можно загрузить фото человека (тег объекта) и картинку в стиле киберпанк (тег стиля). Нейросеть скрестит их в одном видео. Идентичность лица сохраняется неплохо, но при резких поворотах головы возможны искажения.
Omni Flash генерирует аудиодорожку нативно. Никаких сторонних костылей. В промпте можно прямо заказывать скрип тормозов, шум ветра или диалог. Если звук не нужен, обязательно пропишите это текстом.
С генерацией надписей ситуация двоякая. Английский текст на вывесках и футболках модель пишет почти без ошибок. С кириллицей в 2026 году всё еще случаются опечатки. Проверяйте результат на коротких тестовых генерациях.
Идеальных нейросетей не бывает. Omni Flash имеет жесткие технические рамки.
Все ролики помечаются невидимым водяным знаком SynthID. Агрегаторы его не удаляют, так как метка вшита на уровне пикселей самой моделью.
Это мощный инструмент для SMM-специалистов, маркетологов и креаторов. Модель идеально закрывает задачи по созданию вертикальных роликов, оживлению фотографий и локальной замене объектов на готовых видео. Возможность вносить правки текстом экономит часы работы в After Effects.
Если вам нужны длинные сцены, 4K-разрешение или сложный морфинг между кадрами — смотрите в сторону других инструментов. Для всего остального Omni Flash через агрегатор — самый быстрый и рабочий вариант на сегодняшний день.