ByteDance выпустила Seedance 2.5 — обновление своей модели генерации видео. Главное изменение: модель создает видеоряд и звук в одном проходе, а не на этапе постобработки. Пользователи могут получить ролик длиной до 30 секунд, который затем многократно продлевать. В Google Gemini Omni Flash аналогичный предел составляет около 10 секунд.
Для работы с моделью можно загрузить до 30 изображений, 10 видеоклипов и 10 аудиофайлов в качестве референсов. Это позволяет строить сцены с несколькими персонажами и разными ракурсами камеры. По заявлению ByteDance, улучшились текстуры, освещение и детализация кожи.
| Параметр | Значение |
|---|---|
| Максимальная длина ролика | до 30 секунд, можно многократно продлевать |
| Входные данные | до 30 изображений, 10 видео, 10 аудиофайлов |
| Доступность | Jimeng AI, Doubao Pro |
| API | BytePlus ModelArk (позже) |
Seedance 2.5 уже доступна в приложениях Jimeng ИИ и Doubao Pro. Позже появится доступ через API на платформе BytePlus ModelArk. Предыдущая версия Seedance 2.0 возглавляет рейтинг image-to-video моделей с аудио по версии Artificial Analysis. На ней режиссер Нил Бломкамп создал 13-минутный короткометражный фильм Nightborne. Для новой версии ByteDance выпустила собственный короткий метр The Missing Pair, полностью сгенерированный моделью, и использует его для демонстрации возможностей Seedance 2.5.
Модель принимает до 30 изображений, 10 видео и 10 аудиофайлов для построения сцен с несколькими персонажами.
С практической точки зрения это упрощает производство рекламы и визуального контента: командам не нужно собирать ролик из отдельных фрагментов и синхронизировать звук вручную. Весь производственный цикл — от референсов до финального ролика со звуком — может проходить в одном пайплайне. Для индустрии это еще один шаг к тому, чтобы ИИ-видео стало инструментом массового производства, а не экспериментальной технологией.


