Seedance 2.5: публичный API ByteDance для генерации 30‑секундных 4K‑видеороликов

ByteDance через Volcano Engine объявила открытый API Seedance 2.5, позволяющий создавать 30‑секундные видеоролики в 4K с синхронным стереозвуком и поддержкой до 50 референсов. Ранее модель была доступна только внутри потребительских приложений, а теперь её можно использовать напрямую.
Единый проход без склейки сегментов
В отличие от предыдущих генераторов, которые выдавали короткие фрагменты по 5‑8 секунд и требовали ручной сборки, Seedance 2.5 генерирует целый ролик за один проход. Это обеспечивает непрерывный сюжет и удерживает персонажей на протяжении всей длительности, что важно для киноискательных и рекламных сценариев.
Поддержка до 50 референсов и точное редактирование
На вход модель принимает до 50 изображений или видеоклипов, которые фиксируют внешность персонажей, предметы, локации и стиль сцены. Функция Intelligent Edit Mode позволяет корректировать отдельные части кадра без повторной генерации всего ролика, экономя время на мелкие правки.
Звук и камера задаются в одном описании
Стереозвук генерируется одновременно с видеокадром, а не накладывается после. Управление камерой – панорма, наезд, обзор – задаётся в промпте, и модель исполняет его как режиссёрскую инструкцию, что повышает синхронность аудио и визуального контента.
Ценообразование на токенах
Платформенный расчёт осуществляется не в секундах, а в токенах. Seedance 2.5 стоит 10,7 USD за миллион токенов без входного видео и 6,4 USD за миллион токенов, если запрос уже содержит видеоматериал. Это отличает её от конкурентов, которые обычно берут плату по секунде.
Широкий доступ и скидки на предыдущие версии
API доступна на шести сторонних площадках, а компания предоставляет скидки для пользователей, переходящих с Seedance 2.0: минимум 40 % тариф и 75 % для fast‑режима до 7 сентября. Несмотря на это, цена всё ещё зависит от длины, количества референсов и выбранного разрешения, что делает точный бюджет предсказуемым только после расчёта.
Преимущество перед конкурентами
Ролики продолжительностью до 30 секунд превышают типичные ограничения моделей Kling (15 секунд) и Google Veo, позволяя создавать более развернутые истории. При этом использование токенной модели требует оценки реального расхода токенов, поэтому сравнение стоимости лучше проводить на конкретных примерах.
Текущие ограничения и дальнейшее распространение
Публичный релиз выполнен без масштабного пресс‑анонса; официальных материалов на английском языке нет. Документацию продолжают обновлять, а международная версия BytePlus ModelArk пока не полностью синхронизирована с внутренней системой. Независимые тесты качества пока отсутствуют, но ожидается, что при полном выравнивании платформы появятся первые пользовательские ролики.
