• Виктор
  • Блог
  • 2 мин. чтения

ByteDance открыла публичный API Seedance 2.5


7 августа Volcano Engine открыла публичный API Seedance 2.5 – видеомодели ByteDance, которая одним проходом собирает 30-секундный ролик в 4K с синхронным стереозвуком и до 50 референсов. Раньше, с 31 июля, модель работала только в потребительских приложениях.

ByteDance открыла публичный API Seedance 2.5

Seedance – линейка видеомоделей ByteDance, которую компания показала 23 июня на конференции Volcano Engine FORCE и запустила 31 июля сразу в нескольких своих приложениях. Тогда API оставался закрытым, а официальный анонс называл доступ к нему «скоро». Неделю спустя, 7 августа, Volcano Engine выпустила Seedance 2.5 в виде публичного сервиса и теперь модель можно подключить напрямую, а не только через готовые интерфейсы.

Единый проход – 30 секунд без склейки

Прежние генераторы видео выдавали ролик короткими кусками по 5–8 секунд, которые потом сшивались вручную или отдельным инструментом. Seedance 2.5 генерирует 30 секунд за один проход, без монтажной склейки между сегментами. ByteDance подаёт это как шаг к киношному повествованию: модель держит сюжет и персонажей на всей длине ролика, а не собирает их заново в каждом фрагменте.

Пятьдесят референсов и точечные правки

На вход Seedance принимает до 50 изображений и видеофрагментов одновременно, ими закрепляют внешность персонажей, товары, локации и общий стиль сцены. Отдельная функция, Intelligent Edit Mode, позволяет поправить конкретный участок кадра или отрезок времени, не пересчитывая ролик заново. Для рекламных и товарных роликов, где меняется одна деталь, а остальное должно остаться прежним, это экономит именно то время, которое раньше уходило на повторные генерации.

Звук и камера в одном проходе

Стереозвук у Seedance 2.5 рождается вместе с картинкой, а не накладывается поверх готового видео: шаги, фоновый шум и другие эффекты синхронны с действием на экране автоматически. Управление камерой – наезд, панорама, облёт – задаётся прямо в описании сцены, и модель выполняет команду как режиссёрскую инструкцию, а не как общее пожелание. По сравнению с Seedance 2.0 ByteDance заявляет об улучшениях в точности следования инструкциям, реалистичности и качестве связки звука с изображением, плюс поддержку более десяти языков.

Цена в токенах, не в секундах

Модель считает работу не по секундам, а по токенам, что для видеогенерации пока редкость. Большинство конкурентов берут плату посекундно. Seedance 2.5 стоит 10,7 доллара за миллион токенов без видео на входе и 6,4 доллара за миллион, если в запросе уже есть видеоматериал. Точный пересчёт в стоимость одного ролика зависит от длины, референсов и разрешения, и без калькулятора на стороне разработчика оценить бюджет заранее сложно.

Шесть площадок и скидка на 2.0

Помимо API, Volcano Engine синхронно вывела Seedance 2.5 на шесть сторонних сервисов. Заодно компания подсластила переход для тех, кто пока остаётся на прошлой версии. С 7 августа по 7 сентября Seedance 2.0 mini считается по 40% от обычного тарифа, а Seedance 2.0 fast по 75%. Разработчиков подталкивают опробовать новую модель, но не отрезают от старой резким скачком цены.

Дольше, чем у Veo и Kling

Большинство закрытых видеомоделей ограничивают одну генерацию 8–15 секундами. Так, у Kling ролик длится до 15 секунд, у Google Veo счёт также идёт на секунды в этом диапазоне. Тридцать секунд за один проход – заявка на более длинную единицу повествования, а не просто увеличение цифры в характеристиках. Показательно и то, что ByteDance выпускает Seedance 2.5 без пресс-шума, поскольку ни международного анонса на английском, ни материалов для западной прессы не было, только запись в блоге Volcano Engine и синхронный релиз на китайских площадках.

Что это даёт авторам роликов

Для рекламных и товарных сценариев главный выигрыш – не длина сама по себе, а точечное редактирование без пересчёта всей сцены и держание персонажа на протяжении получаса вместо восьми секунд. Тем, кто уже работает с Kling или MiniMax H3, имеет смысл прогнать один и тот же сценарий через Seedance 2.5 и сравнить не заявленную цену, а реальный счёт за конкретный ролик – токенная модель считается иначе, чем посекундная, и на бумаге выигрыш не всегда подтверждается на практике.

Ark всё ещё раскатывается по частям

Модельный идентификатор и параметры доступа Volcano Engine пока стоит проверять непосредственно в консоли перед интеграцией – документация обновляется на ходу, а международная версия платформы, BytePlus ModelArk, синхронизирована с внутренней Volcengine Ark не полностью. Независимых тестов качества и сравнений с конкурентами на момент запуска нет – только собственные примеры ByteDance. Ближайшая проверочная точка – когда доступ выровняется на всех региональных версиях платформы и в сети появятся первые ролики пользователей, а не демонстрационные материалы компании.



Источник

Где попробовать
Claude, GPT, Gemini и ещё 300 моделей — в одном окне
Умка даёт доступ к нейросетям на русском и за рубли: без VPN и зарубежных карт. Текст, картинки, видео и музыка — в одном интерфейсе. На пробу 60 токенов, карта не нужна.
Открыть Умку бесплатно
Межтекстовые Отзывы
Посмотреть все комментарии
guest

Apple ведёт переговоры с издателями о выплатах за актуальные новости для Siri

Согласно информации The Wall Street Journal, Apple ведёт переговоры о выплатах издателям за использование их контента для работы будущего...

Промты для новогодней ИИ-фотосессии, +подходящие нейросети

Как говорят, готовь сани зимой, а промты для новогодних ИИ-фотосессий — в ноябре. Картинки можно публиковать уже сейчас...

Google показала проекты на Gemini 3.8 Flash

Google показала четыре проекта, собранных разработчиками на Gemini 3.8 Flash. Модель вышла в начале сентября и, по заявлению...

Лучшие агрегаторы нейросетей в России — 11 сервисов для генерации изображений, видео, текста

Агрегаторы ИИ в России позволяют получить доступ к ChatGPT, Claude, Gemini, Grok, Midjourney, Seedance, Kling и другим зарубежным...

Wan3.0 от Alibaba превращает презентации и отчёты в 30-секундные ролики

Alibaba официально запустила Wan3.0 - видеомодель, которая делает ролик длиной до 30 секунд из текста, картинок, аудио и...

Вышла нейросеть Suno 5.5 — ИИ генерирует треки с вашим голосом

Suno AI выпустила модель v5.5 и вместе с ней набор функций, которые меняют логику сервиса. Теперь это не...

OpenAI стандартизировала отчёты об отклонениях и скрытом поведении ИИ-моделей

OpenAI представила фреймворк для отчётов о рассогласовании моделей (Model Misalignment Reporting Framework). Компания стандартизировала сбор данных об опасных...

Kling запустила IMAGE O1 — новую ИИ-модель для генерации и редактирования изображений

Kling представила «IMAGE O1» — это обновлённая модель для генерации и редактирования изображений. Она работает и с текстом,...

Kling представил VIDEO 2.6 — ИИ-модель, которая генерирует видео и звук за один прогон

Kling запустил модель VIDEO 2.6 — свой первый генератор, который создаёт картинку и звук одновременно. Один запрос превращается...

Luma Labs представила модель Uni-1 которая думает и рисует одновременно

Luma Labs представила Uni-1 - первую генеративную модель, которая объединяет мышление и создание изображений в одном процессе. Система...

Нейросеть Sora 2: как пользоваться, где взять инвайт, возможности, как скачать

OpenAI представила Sora 2 — новую версию своей видеомодели, которая автоматически генерирует короткие ролики со звуком и синхронной...

OpenAI выпустила ChatGPT Images 2.5 — генерация стала быстрее, а изображения можно точечно доработать

OpenAI выпустила ChatGPT Images 2.5 — обновлённую модель для генерации и редактирования изображений в ChatGPT. Компания заявляет, что...

Midjourney запустила V8 Alpha с ускоренной генерацией и улучшенным пониманием запросов

Midjourney открыла доступ к альфа-версии V8 - новой модели генерации изображений, которая работает в несколько раз быстрее и...

DeepSeek выпустила Harness v0.2 — приложение для macOS и Windows

У ИИ-агента DeepSeek Harness появилась настольная версия. Теперь его можно установить как обычную программу и поручать ему работу...

⚔️ Тестиум: ChatGPT или DeepSeek — кто лучше пишет тексты?

Привет! Меня зовут Анатолий Чупин. Я редактор сайта Postium, исследователь ИИ и автор Telegram-канала «Промты — и точка»....

OpenAI покажет человекоподобного робота в 2027 году

OpenAI планирует создать собственного человекоподобного робота. Об этом глава компании Сэм Альтман рассказал в начале сентября. Ранее Альтман...

Яндекс сводит аналитику данных в одну платформу

Yandex B2B Tech анонсировала DataLens Platform, платформу для работы с корпоративными данными от загрузки и хранения до отчётов...

Alibaba сообщила о падении прибыли на 75% из-за крупных инвестиций в ИИ-инфраструктуру

Китайский технологический гигант Alibaba в четверг сообщил о падении прибыли за последний квартал на 75% на фоне крупных...

Нейросеть Veo 3.1: как пользоваться и создавать видео бесплатно

Google обновила свою модель для генерации видео — Veo 3.1, и теперь создание роликов со звуком и озвучкой...

История Starbucks: кто основал компанию, как появился логотип и кому принадлежит бренд

Сегодня Starbucks — одна из самых узнаваемых кофейных сетей мира: зелёную сирену знают даже те, кто ни разу...