● ByteDance официально запустила SeeDance 2.5 — новую модель для генерации видео с синхронным звуком, представленную 23 июня 2026 года и полностью доступную с 31 июля 2026
● Главное новшество: цельный 30-секундный видеоролик за одну генерацию — без склейки коротких клипов, с возможностью дополнительного продления сцены
● Модель принимает до 50 референсов одновременно (изображения, видео, аудио) и удерживает единый стиль, персонажей и освещение на протяжении всего ролика
● Видео генерируется сразу с синхронизированным звуком — голосом, музыкой и липсинком на 10+ языках
● Предыдущая версия, SeeDance 2.0, занимала первое место в независимом рейтинге Artificial Analysis, опережая Veo 3.1 и Kling 3.0 — SeeDance 2.5 претендует на то же лидерство
● Попробовать SeeDance 2.5 в России можно без VPN и иностранной карты — через Study AI, с оплатой в рублях
Рынок нейросетей для видео меняется каждые несколько месяцев, но некоторые релизы всё равно умудряются взбудоражить индустрию сильнее остальных. SeeDance 2.5 — как раз такой случай. Ещё до официального анонса о модели говорили как о самом ожидаемом обновлении 2026 года: предыдущая версия, SeeDance 2.0, успела занять первое место в независимом рейтинге Artificial Analysis Video Arena, обойдя таких тяжеловесов, как Google Veo 3.1 и Kling 3.0 Pro. Планка была задана высокая, и разработчикам из ByteDance предстояло не просто улучшить существующую модель, а сделать качественный скачок.
23 июня 2026 года на конференции Volcano Engine FORCE в Пекине компания ByteDance представила SeeDance 2.5 — и не как рядовое обновление, а как принципиально новый этап в развитии линейки. Разработчики сознательно пропустили промежуточные версии 2.1–2.4, чтобы подчеркнуть: это не точечная доработка, а генерационный скачок. Через месяц, 31 июля 2026 года, модель стала доступна широкой аудитории.
Главная идея SeeDance 2.5 — превратить процесс генерации видео из создания отдельных коротких клипов в создание завершённого творческого продукта. Если раньше пользователям приходилось генерировать несколько 5–15-секундных отрывков и вручную склеивать их между собой (получая заметные «швы» — скачки освещения, смену черт лица, разрывы движения), то теперь модель способна выстроить связную 30-секундную историю за одну генерацию: с завязкой, развитием, кульминацией и разрешением. Разберём, что именно изменилось, чем это полезно на практике и как попробовать модель, не выходя из России.
>>> Зарегистрироваться бесплатно и получить доступ
SeeDance 2.5 — это новая модель для генерации видео от ByteDance, точнее от исследовательского подразделения Seed (ByteDance Seed), которое также стоит за линейкой моделей для генерации изображений SeeDream. В Китае продукт продвигается под брендом Doubao (豆包) и интегрирован в такие сервисы компании, как Jimeng AI и Doubao Pro.
Модель построена на той же унифицированной архитектуре совместной генерации аудио и видео (audio-video joint generation), что и SeeDance 2.0 — то есть звук и изображение создаются не отдельными этапами, а одним процессом, что и обеспечивает точную синхронизацию голоса, музыки и движения губ персонажей. SeeDance 2.5 не переписывает эту архитектуру с нуля, а масштабирует и дорабатывает её: увеличивает длину генерируемого ролика, расширяет возможности по работе с референсами и добавляет более тонкий контроль над монтажом.
По сути, разработчики сфокусировались на двух направлениях: базовой генерации (foundation generation) — то есть создании видео с нуля по текстовому описанию, и референс-генерации (reference-based generation) — создании видео на основе загруженных пользователем изображений, видео- и аудиофайлов. Именно на стыке этих двух направлений и появились главные новые возможности модели, о которых — в следующем блоке.
Официальный анонс состоялся 23 июня 2026 года на конференции Volcano Engine FORCE в Пекине, а с 31 июля 2026 года модель официально запущена и постепенно раскатывается через продукты ByteDance — Jimeng AI, Doubao Pro и другие, с последующим открытием API-доступа через BytePlus ModelArk.
Цельное 30-секундное видео за один проход
Главное нововведение SeeDance 2.5 — генерация полноценного 30-секундного ролика за одну генерацию, без склейки нескольких коротких клипов. Большинство конкурирующих моделей ограничены 5–15 секундами на один проход, из-за чего создателям приходится нарезать длинную историю на фрагменты и сшивать их вручную — а на стыках почти всегда заметны артефакты: лицо персонажа чуть смещается, освещение скачет, движение камеры дёргается. SeeDance 2.5 удерживает персонажей, освещение сцены и движение камеры стабильными от первого кадра до последнего.
Если истории требуется больше времени, ролик можно продлить — модель поддерживает до двух дополнительных раундов расширения, а для команд, тестирующих ещё более длинную непрерывность, доступен бета-режим до 180 секунд.
До 50 мультимодальных референсов
SeeDance 2.5 принимает до 50 референсных файлов в одной генерации — это могут быть изображения, видео и аудио в любой комбинации (по данным разных источников, до 30 изображений, 10 видео и 10 аудиофайлов). Такой режим называется Multi-Reference или R2V (reference-to-video). На практике это значит, что можно загрузить сразу референс-лист персонажа, фото продукта, палитру бренд-цветов, референс движения камеры и звуковую дорожку — и модель воспримет всё это как единое техническое задание, а не будет додумывать недостающие детали самостоятельно.
Разрешение до 4K и стабильное качество картинки
Модель генерирует видео в разрешении вплоть до 4K с 10-битным цветом — это даёт больше свободы при цветокоррекции в шадоу и хайлайтах, если ролик дальше уходит в профессиональный монтаж, а не сразу публикуется в соцсети. Отдельно разработчики отметили улучшенную стабильность: SeeDance 2.5 реже добавляет случайные субтитры или посторонний фоновый звук, которые встречались у предыдущих моделей.
Встроенный синхронный звук и липсинк
Как и SeeDance 2.0, новая версия генерирует звук — голос, музыку, звуковые эффекты — одновременно с видео, а не отдельным этапом. Липсинк поддерживается для 10+ языков, включая русский, английский, китайский, испанский, арабский, португальский, японский, корейский и другие — это открывает возможность создавать ролики с персонажами, говорящими на разных языках, без отдельной студии озвучки.
Точный монтаж и покадровое редактирование
SeeDance 2.5 добавляет таймкод-уровневый контроль — то есть можно точечно редактировать конкретный отрезок аудио или видео, не перегенерируя весь ролик заново. Также усилены отдельные инструменты монтажа: хромакей (зелёный экран), управление ракурсом камеры и редактирование по референсу — то есть замена части кадра на основе загруженного изображения. Это ориентировано на профессиональные сценарии — рекламу, кино, сложные многосценные проекты.
● Длительность ролика. SeeDance 2.0 генерировала клипы длиной до 15 секунд за один проход. SeeDance 2.5 удвоила этот показатель — до 30 секунд, плюс добавила возможность продления и бета-режим до 180 секунд.
● Референсы. В SeeDance 2.0 модель тоже умела работать с референс-файлами, но SeeDance 2.5 расширила лимит до 50 объединённых входов (изображения, видео, аудио) и добавила отдельный режим R2V для более точного контроля над персонажами, продуктами и стилем.
● Разрешение и цвет. SeeDance 2.0 предлагала нативное 2K-разрешение. SeeDance 2.5 подняла планку до 4K с 10-битным цветом — заметный шаг вперёд для профессионального постпродакшена.
● Монтаж. В SeeDance 2.0 базовые инструменты редактирования уже присутствовали, но SeeDance 2.5 добавила покадровый, таймкод-уровневый контроль — точечное редактирование отдельного фрагмента без перегенерации всего ролика, а также улучшенный хромакей и управление ракурсом.
● Стабильность генерации. SeeDance 2.5 заметно реже добавляет случайные субтитры или посторонний фоновый звук — проблему, которая иногда возникала у предыдущей версии.
● Многоязычный липсинк. Обе модели поддерживают синхронизацию губ, но в 2.5 заявлена более точная синхронизация на 10+ языках, что расширяет применимость для мультиязычного контента.
В сумме апгрейд получился не косметическим: ByteDance сознательно пропустила версии 2.1–2.4, чтобы подчеркнуть — это не точечное улучшение, а следующее поколение модели.
Важная оговорка сразу: независимых бенчмарков именно для SeeDance 2.5 на момент написания статьи ещё нет — все данные о качестве генерации пока опираются на заявления самой ByteDance и демонстрации на презентации. Но у нас есть надёжный ориентир — позиции предыдущей версии, SeeDance 2.0, в независимом рейтинге Artificial Analysis Video Arena, где модель занимала первое место как в текстовых (text-to-video), так и в графических (image-to-video) генерациях, опережая Google Veo 3.1 и Kling 3.0 Pro — причём по более низкой цене за минуту готового видео. SeeDance 2.5 стартует с этой позиции и должна её только упрочить.
Если сравнивать модели по сильным сторонам:
● Google Veo 3.1 остаётся эталоном кинематографичности — стабильная частота кадров, профессиональная цветокоррекция, качество, которое выглядит «готовым к эфиру». Плюс — официальный API-доступ для разработчиков и встроенный звук.
● OpenAI Sora 2 дольше всех держал репутацию лидера по физической достоверности — как объекты двигаются, взаимодействуют друг с другом, ведут себя под действием гравитации и инерции. Но у модели ограниченный доступ к референсам персонажей, а сам OpenAI объявил о постепенном сворачивании поддержки Sora 2.
● Kling 3.0 — выбор тех, кому нужен качественный результат без сложной настройки референсов: модель хорошо работает «из коробки» по простому текстовому промпту, поддерживает нативное высокое разрешение и предлагает бесплатный тариф для теста.
● SeeDance 2.5 выигрывает там, где важны длительность (30 секунд против 5–15 у конкурентов), количество и гибкость референсов (до 50 файлов — рекорд в категории) и согласованность бренд-элементов на протяжении всего ролика. Это делает модель особенно сильной для рекламных роликов, сторителлинга с постоянными персонажами и сложных многосценных брифов.
Итог простой: если задача — снять цельную мини-историю с удержанием персонажей и стиля на 30 секунд, SeeDance 2.5 на сегодня один из немногих инструментов, который делает это без склейки. Если нужна максимальная физическая достоверность движения объектов или кинематографичная цветокоррекция «из коробки» — есть смысл присмотреться к Sora 2 или Veo 3.1 соответственно.
Официальные каналы
Разработчик — ByteDance Seed — раскатывает SeeDance 2.5 через собственную экосистему: модель встраивается в потребительские продукты компании (Jimeng AI, Doubao Pro), а для разработчиков открывается API-доступ через Volcano Engine и BytePlus ModelArk. Проблема в том, что напрямую из России воспользоваться этими каналами сложно: сервисы ByteDance ориентированы в первую очередь на китайский и международный (не-СНГ) рынок, требуют привязку иностранной карты или VPN, а официальной поддержки оплаты в рублях нет. В обход этой проблемы на рынке уже появляются посредники и агрегаторы, перепродающие доступ к моделям ByteDance с оплатой через российские платёжные системы — но это неофициальные каналы без прямых договорных отношений с вендором, и пользоваться ими стоит с осторожностью.
Доступ через Study AI
Проще всего попробовать SeeDance 2.5 из России — через Study AI. Платформа уже интегрировала модель в свою линейку инструментов для генерации видео, поэтому не нужно ни оформлять VPN, ни искать способ оплатить иностранный сервис: доступ открыт напрямую, с оплатой в рублях через привычные способы (карты российских банков, СБП) и без каких-либо гео-ограничений.
Через Study AI доступны все ключевые возможности SeeDance 2.5 — генерация 30-секундных роликов, загрузка референсов (изображений, видео, аудио), встроенный синхронный звук с липсинком. Это особенно удобно тем, кто хочет протестировать модель без сложной настройки собственного API-интеграции: интерфейс на русском языке, а результат генерации доступен для скачивания сразу после обработки запроса.
Шаг 1. Зайдите в раздел генерации видео
Откройте Study AI и выберите инструмент для генерации видео. В списке доступных моделей найдите SeeDance 2.5 — она отмечена как новая модель с поддержкой длинных роликов и синхронного звука.
Шаг 2. Опишите сцену текстовым промптом
Сформулируйте, что должно происходить в ролике: кто в кадре, где разворачивается действие, какая атмосфера и стиль съёмки нужны. Чем подробнее и структурированнее промпт — тем точнее результат. Полезно сразу указывать движение камеры (наезд, панорама, статичный план) и развитие сюжета по времени (что происходит в начале, середине и в конце 30-секундного ролика).
Шаг 3. Загрузите референсы (по желанию)
Если нужен конкретный персонаж, продукт или стиль — прикрепите референсные файлы: фото, короткое видео или аудиодорожку. SeeDance 2.5 принимает до 50 файлов одновременно, поэтому можно скомбинировать, например, портрет персонажа, референс движения камеры и трек для фоновой музыки — модель учтёт всё сразу.
Шаг 4. Настройте параметры генерации
Выберите длительность ролика (до 30 секунд), разрешение и, если нужно, язык озвучки — модель поддерживает липсинк на 10+ языках, включая русский.
Шаг 5. Запустите генерацию и дождитесь результата
Отправьте запрос — обработка занимает некоторое время, так как модель одновременно рендерит видео и синхронизированный звук. Готовый ролик появится в интерфейсе для просмотра и скачивания.
Шаг 6. При необходимости доработайте ролик
Если нужно поправить только часть кадра или конкретный отрезок звука — используйте функцию точечного редактирования, чтобы не перегенерировать весь ролик заново.
Рекламный ролик для бренда
Промпт:
Рекламный ролик 30 секунд для бренда кофе. Начало: крупный план зёрен кофе, падающих в прозрачную ёмкость, мягкий утренний свет. Середина: бариста готовит капучино, пар поднимается над чашкой, камера плавно облетает по дуге. Финал: готовая чашка на деревянном столе у окна, логотип бренда появляется в углу кадра. Тёплая цветовая палитра, кинематографичное освещение, лёгкая фоновая музыка без слов.
Для этого сценария можно дополнительно загрузить референс-фото упаковки бренда и палитру фирменных цветов — модель встроит их в кадр без искажений.
Сторителлинг с постоянным персонажем
Промпт:
История о путешественнице, исследующей горную тропу. Начало: она поднимается по каменистой тропе в тумане, рюкзак за плечами. Середина: останавливается на вершине, туман расходится, открывается панорама долины. Финал: она садится на камень, смотрит на закат, лёгкая улыбка. Естественное освещение, документальный стиль съёмки, звук ветра и шагов по камням.
Здесь пригодится референс-лист персонажа (несколько фото лица и фигуры) — SeeDance 2.5 удержит внешность героини стабильной на протяжении всех 30 секунд.
Продуктовое видео
Промпт:
Демонстрация беспроводных наушников. Начало: наушники в кейсе на белом фоне, крышка открывается. Середина: рука берёт наушник, надевает на ухо крупным планом. Финал: человек идёт по улице в наушниках, город на фоне, лёгкая динамичная музыка синхронизирована с движением. Чистый минималистичный стиль, студийное освещение в первой части, естественный свет на улице во второй.
Ролик для соцсетей с озвучкой
Промпт:
Короткий влог о завтраке. Персонаж на кухне готовит смузи, обращается к камере и рассказывает о рецепте на русском языке. Динамичная смена ракурсов, естественное дневное освещение, фоновая лёгкая музыка, чёткая синхронизация губ с речью.
Для этого сценария стоит явно указать нужный язык озвучки в настройках — модель сгенерирует синхронизированную речь персонажа автоматически.
● Малый и средний бизнес. Рекламные ролики, презентации товаров и услуг без съёмочной группы, аренды студии и монтажёра — от идеи до готового 30-секундного видео за один запрос.
● Маркетологи и SMM-специалисты. Быстрое производство контента для соцсетей: продуктовые демо, тизеры, брендированные ролики с сохранением фирменного стиля и цветовой палитры на протяжении всего видео.
● Блогеры и контент-мейкеры. Влоги, сторителлинг с постоянным персонажем, ролики с озвучкой на разных языках — без необходимости в отдельной студии записи звука.
● Агентства и продакшен-команды. Быстрые черновики и прототипы сцен перед полноценной съёмкой, тестирование раскадровок, работа со сложными многосценными брифами благодаря поддержке до 50 референсов одновременно.
● Создатели образовательного и презентационного контента. Ролики с объяснениями, демонстрации процессов, обучающие видео с чёткой структурой (завязка — развитие — вывод) в рамках одного 30-секундного клипа.
● Разработчики и стартапы. После открытия официального API модель можно встроить в собственные продукты — от генераторов рекламы до платформ автоматизации контента.
Главное преимущество модели — она снимает необходимость в ручной склейке коротких клипов и сложном постпродакшене, поэтому особенно ценна там, где нужен готовый результат быстро и без профессиональной съёмочной команды.
Что такое SeeDance 2.5?
Это новая модель для генерации видео от ByteDance (подразделение Seed), которая создаёт цельные 30-секундные ролики с синхронным звуком за одну генерацию, без склейки коротких клипов.
Чем SeeDance 2.5 отличается от SeeDance 2.0?
Главные отличия — вдвое увеличенная длительность ролика (30 секунд против 15), поддержка до 50 референсов вместо меньшего лимита, разрешение до 4K вместо 2K и более точный покадровый монтаж.
Сколько может длиться видео, созданное в SeeDance 2.5?
До 30 секунд за одну генерацию, с возможностью продления ещё на два раунда. Также доступен бета-режим до 180 секунд для более длинных сценариев.
Какое максимальное разрешение поддерживает модель?
До 4K с 10-битным цветом — это подходит как для публикации в соцсетях, так и для профессиональной цветокоррекции.
Умеет ли SeeDance 2.5 генерировать звук?
Да, звук — голос, музыка, звуковые эффекты — создаётся одновременно с видео, включая липсинк на 10+ языках, в том числе на русском.
Сколько референсов можно загрузить одновременно?
До 50 файлов в одной генерации — изображения, видео и аудио в любой комбинации.
Есть ли бесплатный доступ к SeeDance 2.5?
Официальный API ByteDance не предполагает бесплатной квоты. Проще и доступнее протестировать модель через Study AI, где доступна оплата в рублях без необходимости в VPN или иностранной карте.
Можно ли пользоваться SeeDance 2.5 из России?
Напрямую через официальные каналы ByteDance — сложно из-за отсутствия поддержки российских способов оплаты. Через Study AI доступ открыт без ограничений.
Для каких задач лучше всего подходит SeeDance 2.5?
Для рекламных роликов, продуктовых демо, сторителлинга с постоянными персонажами, контента для соцсетей и черновых прототипов сцен перед полноценной съёмкой.
SeeDance 2.5 — это не просто очередное обновление модели, а заметный шаг вперёд для всей категории ИИ-видео. Возможность собрать цельную 30-секундную историю за одну генерацию, без ручной склейки и заметных «швов» между сценами, решает одну из главных болей, с которыми сталкивались создатели контента при работе с нейросетями для видео. Добавьте к этому поддержку до 50 референсов, разрешение до 4K и встроенный синхронный звук с липсинком на десятке языков — и становится понятно, почему модель уже сейчас называют одним из главных релизов года в этой категории.
При этом SeeDance 2.5 остаётся достаточно простым инструментом для практического применения: чтобы получить готовый рекламный ролик, продуктовое демо или сторителлинг с персонажем, не нужны ни съёмочная группа, ни монтажёр, ни отдельная студия озвучки — достаточно точного текстового промпта и, при необходимости, нескольких референсных файлов.
Попробовать SeeDance 2.5 на практике проще всего через Study AI — без VPN, иностранной карты и гео-ограничений, с оплатой в рублях и интерфейсом на русском языке. Заходите, выбирайте модель в разделе генерации видео и создавайте свой первый 30-секундный ролик уже сегодня.