31 июля ByteDance выпустила Seedance 2.5 — новое поколение своей флагманской видеомодели. Пока модель доступна в китайских продуктах компании — веб-версии Jimeng AI и Pro-подписке Doubao, — а API на платформе Volcano Engine Ark открывается в первых числах августа. Как только модель станет доступна по API, добавим её в GPTunneL. Разбираем, что уже известно, и показываем официальные демо.
Хронология релиза
Модель анонсировали 23 июня на конференции Volcano Engine FORCE в Пекине — тогда она была в закрытой корпоративной бете. В начале июля прошло ограниченное публичное тестирование, а 31 июля состоялся консьюмерский запуск — в первую очередь для китайского рынка. Одновременно Seedance 2.0 получила выход в 4K.
Главное: one-take видео до 30 секунд со звуком
Ключевое отличие от Seedance 2.0 — длительность. Модель генерирует непрерывный ролик до 30 секунд за один проход, без склейки коротких фрагментов, причём звук создаётся вместе с видео в одном проходе, а не накладывается поверх готового ролика. Для сравнения: большинство конкурентов выдают 8–15 секунд за генерацию.
Флагманское демо — one-take на 30 секунд, где персонаж в чёрном пальто проходит через шесть связанных комнат, и каждая меняет стиль и настроение кадра. Ещё один пример — музыкальный клип с одним исполнителем, собранный из одного промпта по референсам внешности и гардероба, без таймлайна и кейфреймов. А целиком возможности модели ByteDance показала короткометражкой «The Missing Pair», снятой полностью в Seedance 2.5.
Мультираундовое «дорасширение» позволяет доращивать ролик с сохранением персонажей, окружения и темпа, а в приложении Jimeng замечен бета-режим Ultra-Long Video до 180 секунд.
Вот как это выглядит на официальных демо. Танец у стены огня — один непрерывный кадр с генерацией музыки и движения в одном проходе:
А это 30-секундная мини-история о путешествии чемодана по аэропорту — камера, свет и «актёры» меняются, но объект остаётся консистентным весь ролик:
До 50 референсов на одну генерацию
Seedance 2.5 принимает до 50 мультимодальных входов: 30 изображений, 10 видео и 10 аудио. Из необычного:
- clay-render референсы (white-model control) — бестекстурный 3D-блокинг сцены, которым задают позы, траектории движения и ракурсы камеры; по данным ByteDance, модель сама достраивает физически корректный свет — направление, цветовую температуру, тени;
- аудио как референс — модель умеет ориентироваться на загруженную звуковую дорожку, подстраивая под неё темп и движение.
По замерам Artificial Analysis, ещё Seedance 2.0 возглавляла рейтинг image-to-video среди моделей со звуком — 2.5 строится на этой базе.
Монтаж без пересъёмки
Вторая большая тема релиза — редактирование готовых роликов:
- правки по таймкодам — «замени фон с 12-й по 18-ю секунду»;
- green-screen замена фона с адаптацией физики и света на субъекте;
- пересъёмка движения камеры на уже готовом клипе;
- локальные правки области кадра по референсу — без регенерации всего видео.
Заявлен и заметный рост реализма: текстуры, кожа, свет и мимика в кадре ощутимо «дороже», чем у 2.0. Судите сами — сцена в барбершопе с двумя персонажами и зеркалом (зеркала — классический провал видеомоделей):
Честности ради, ByteDance сама признаёт: сложные движения и сцены с плотным взаимодействием нескольких персонажей всё ещё даются модели с трудом.
Как Seedance 2.5 выглядит на фоне конкурентов
- Sora 2 фактически выбыла из гонки: OpenAI закрыла приложение и веб-версию Sora ещё 26 апреля, а API отключит 24 сентября 2026-го.
- Kling 3.0 — нативный 4K при 60 fps, но до 15 секунд за проход.
- Veo 3.1 — лучший синхронный звук с диалогами, но 8 секунд за генерацию.
Сила Seedance 2.5 — длительность, контроль через референсы и монтаж без пересъёмки. Это заявка не на «самый красивый ролик», а на рабочий инструмент для продакшена. Масштаб сцен при этом тоже впечатляет:
Когда и почём API
Volcano Engine уже опубликовала тарифы: около ¥70 за миллион токенов при генерации без видео-входа и ¥42 — с видео-входом; на международной BytePlus — $10,7 и $6,4 соответственно. В пересчёте на ролики это примерно $0,7–1,8 за 30 секунд в базовом разрешении; 4K обойдётся в разы дороже. Точные цены в GPTunneL появятся вместе с моделью.
Пока ждём — попробуй Seedance 2
Seedance 2 уже доступна в GPTunneL — вот пример того, что она умеет:
Генерировать можно прямо в лаборатории — без VPN и с оплатой в рублях. А как только Seedance 2.5 станет доступна по API, модель появится у нас: следи за новостями в блоге и телеграм-канале.
