Назад к моделям

Doubao Seedance 2.0

doubaodoubao/doubao-seedance-2-0

Doubao SeedDance 2.0 — text/image-to-video generation, flagship quality tier.

Doubao Seedance 2.0 — флагманская мультимодальная модель генерации видео от ByteDance, разработанная командой Seed и доступная через платформу Volcengine Ark. В отличие от моделей, принимающих только текстовые промпты, Seedance 2.0 поддерживает одновременный ввод текста, изображений, аудио и видео — до 12 референсных файлов за запрос — используя Dual-Branch Diffusion Transformer, который генерирует синхронизированное видео и аудио параллельно.

Модель превосходит в генерации сложных движений с реалистичной физикой, нативной синхронизации аудио и видео (диалоги, звуковые эффекты, окружающий звук и музыка), управлении начальным и конечным кадром, а также в режиме режиссёра (Director Mode) для контроля траектории камеры и освещения на естественном языке. Максимальная длительность — 15 секунд, разрешение до 2K, 24 кадра/с, соотношения сторон от 1:1 до 21:9. API использует асинхронный паттерн «отправка → опрос → скачивание», типичный для генерации видео.

Когда выбирать
  • • Короткие видео — клипы для соцсетей, реклама и промо-ролики с нативным аудио
  • • Прототипирование раскадровок и пре-визуализация — анимация от начального к конечному кадру с кинематографическим движением камеры
  • • Мультимодальные видео с персонажами — объединение портретов, референсов движения и фоновых изображений в одном запросе
  • • Говорящие головы с синхронизацией губ на 8+ языках — генерация диалогов с нативным аудио
Когда не выбирать
  • • Длинные нарративные видео (более 15 секунд) — склейте несколько клипов Seedance или используйте специализированный пайплайн
  • • Интерактивная генерация видео в реальном времени — задержка Seedance 30–120 секунд; используйте модель real-time
  • • Массовая генерация миниатюр или коротких GIF с низкой стоимостью — специализированные модели изображений (напр. doubao/doubao-seedream-4-5) дешевле за единицу
Размер контекста
--
Максимальный вывод
--
Цена Видеоза секунду видео
$0.162за секунду

Модальности

ТекстИзображение→Видео

Возможности

ЗрениеТекст в видеоИзображение в видео

Возможности генерации медиа

video_generation
sizes
  • 1280x720
  • 720x1280
durations_seconds
  • 5
  • 10
defaults
size
1280x720
duration_seconds
5

Разбивка цен

ТипСтавка
Видео$0.162 за секунду

request is price per second for 720x1280 or 1280x720 outputs — the vendor's own per-second rate for this catalog configuration

Поддерживаемые параметры

promptimage_urlsecondssizeaspect_ratio

Характеристики

Дата релиза2026-02-10 (потребительский); 2026-04-02 (GA API через Volcengine Ark)apidog.com ↗проверено
АрхитектураDual-Branch Diffusion Transformer (совместная генерация аудио и видео)seed.bytedance.com ↗к проверке
Макс. длительность15 секундapidog.com ↗проверено
Макс. разрешение2K (2560×1440)www.nxcode.io ↗проверено
Частота кадров24 кадра/сapidog.com ↗проверено
Модальности вводаТекст, изображения (до 9), видео (до 3 клипов), аудио (до 3 файлов)apidog.com ↗проверено
Выходное аудиоНативное — диалоги, звуковые эффекты, окружающий звук, музыка; синхронизировано с видеоseed.bytedance.com ↗проверено
ЯзыкиМногоязычная (китайский + английский нативно), синхронизация губ на 8+ языкахapidog.com ↗проверено
Версия моделиdoubao-seedance-2-0-260128apidog.com ↗проверено
ЛицензияКоммерческое использование через Volcengine Ark / TheRouter APIvolcengine.com ↗к проверке

Бенчмарки

BenchmarkDistributionScoreSource
SeedVideoBench-2.0 (internal)
Внутренний бенчмарк ByteDance SeedVideoBench-2.0 оценивает стабильность движения, соответствие промпту, временну́ю согласованность и синхронизацию аудио/видео. Seedance 2.0 показывает SOTA-результаты. Сторонних аудитов нет.
SOTA (internal benchmark)seed.bytedance.com ↗
Vbench
Сторонние обзоры (evoLink, WaveSpeed) высоко оценивают Seedance 2.0 по естественности движений и синхронизации аудио, сравнивая по общему качеству с Kling 3.0 и Sora 2.
4.2+/5.0 (third-party estimate)evolink.ai ↗

Примеры API

Для новых интеграций используйте глобальный endpoint api.therouter.ai из примеров ниже; старый China accelerated endpoint выведен из эксплуатации.

cURL
curl https://api.therouter.ai/v1/videos   -H "Content-Type: application/json"   -H "Authorization: Bearer $THE_ROUTER_API_KEY"   -d '{
    "model": "doubao/doubao-seedance-2-0",
    "prompt": "A slow tracking shot through a neon-lit city street",
    "duration": 8
  }'

Гид по API

Генерация видео из текста

Отправьте текстовый промпт для генерации видео с нативным аудио. API использует асинхронный паттерн — отправка, опрос статуса, скачивание результата.

cURL
# Step 1: Submit text-to-video generation task
curl -X POST https://api.therouter.ai/v1/contents/generations/tasks \
  -H "Authorization: Bearer $THEROUTER_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "doubao/doubao-seedance-2-0",
    "content": [
      {
        "type": "text",
        "text": "A golden retriever running through a sunlit wheat field, wide tracking shot, cinematic lighting"
      }
    ],
    "resolution": "1080p",
    "ratio": "16:9",
    "duration": 5,
    "watermark": false
  }'

# Step 2: Poll for completion (save task_id from response)
curl https://api.therouter.ai/v1/contents/generations/tasks/cgt-xxxxxx \
  -H "Authorization: Bearer $THEROUTER_API_KEY"

# Step 3: When status="succeeded", download video_url from the response

Ещё от doubao

Похожие модели

Аналоги в других провайдерах

Новости и изменения

2026-04-14

Volcengine Ark полностью открывает API Seedance 2.0 для корпоративных и частных пользователей

Volcengine официально запустил API Seedance 2.0 с четырьмя типами ввода (текст, изображение, аудио, видео), стандартами безопасности для портретов и авторских прав, а также более 10 000 предустановленных виртуальных аватаров. Ранние корпоративные пользователи сообщают о повышении эффективности на 80–90% при создании коротких драм и манга-стиля, доступных через TheRouter.

переработано TheRouteraibase.com ↗
2026-02-10

ByteDance выпускает Seedance 2.0 с режимом режиссёра, нативным аудио и 2K

Seedance 2.0 представил архитектуру Dual-Branch Diffusion Transformer для совместной генерации аудио и видео, режим режиссёра для точного управления траекторией камеры и освещением через естественноязыковые промпты, управление начальным и конечным кадром, а также синхронизацию губ на 8+ языках. Модель стала вирусной благодаря реалистичной физике и стабильности движений, быстро став одной из самых обсуждаемых AI-видео моделей 2026 года.

переработано TheRouterreddit.com ↗

Частые вопросы

Какие типы ввода принимает Seedance 2.0?

Seedance 2.0 принимает текст, изображения (до 9, макс. 30 МБ каждое), видео-клипы (до 3, 2–15 секунд каждый, макс. 50 МБ) и аудиофайлы (до 3, MP3, макс. 15 МБ каждый) — все в одном запросе. Можно комбинировать модальности для мультимодальных референсов, например, изображение персонажа + видео-референс движения + фоновое аудио + текстовый промпт.

переработано TheRouterapidog.com ↗
Сколько времени занимает генерация видео?

Обычно 30–120 секунд в зависимости от разрешения и длительности. 5-секундное видео в 1080p занимает в среднем 60–90 секунд. API использует асинхронный паттерн: отправка задачи, опрос эндпоинта статуса каждые 5–10 секунд и скачивание URL результата при статусе 'succeeded'. URL истекает через 24 часа.

переработано TheRouterapidog.com ↗
Можно ли использовать Seedance 2.0 со стандартным OpenAI SDK?

Нет — Seedance 2.0 использует асинхронный task API Volcengine Ark, а не формат OpenAI chat completions. TheRouter направляет запросы на правильный эндпоинт Ark, но вы должны использовать асинхронный паттерн отправка-опрос-скачивание. Родные методы OpenAI SDK, такие как chat.completions.create(), не будут работать. Обратитесь к API-гайдам выше для правильного формата запроса.

переработано TheRouterapidog.com ↗
В чём разница между Seedance 2.0 и Seedance 2.0 Fast?

Seedance 2.0 Fast — это более дешёвый и быстрый вариант, оптимизированный для итеративного черновика и прототипирования. Он использует меньшую модель, генерирующую видео быстрее и по более низкой цене за запрос (3,0556 vs 3,8889). Компромисс — снижение качества вывода, особенно в сложности движения, соответствии промпту и синхронизации аудио/видео. Для финальных материалов используйте стандартный Seedance 2.0; для быстрых черновиков и внутренних итераций Fast более экономичен.

переработано TheRouterwww.volcengine.com ↗
Реестр фактов — каждая утверждаемая величина имеет источник
источникURLполучено
Дата релизаapidog.com ↗2026-05-26проверено
Архитектураseed.bytedance.com ↗2026-05-26к проверке
Макс. длительностьapidog.com ↗2026-05-26проверено
Макс. разрешениеwww.nxcode.io ↗2026-05-26проверено
Частота кадровapidog.com ↗2026-05-26проверено
Модальности вводаapidog.com ↗2026-05-26проверено
Выходное аудиоseed.bytedance.com ↗2026-05-26проверено
Языкиapidog.com ↗2026-05-26проверено
Версия моделиapidog.com ↗2026-05-26проверено
Лицензияvolcengine.com ↗2026-05-26к проверке
SeedVideoBench-2.0 (internal)seed.bytedance.com ↗2026-05-26один источник
Vbenchevolink.ai ↗2026-05-26один источник
Volcengine Ark полностью открывает API Seedance 2.0 для корпоративных и частных пользователейaibase.com ↗2026-05-26проверено
ByteDance выпускает Seedance 2.0 с режимом режиссёра, нативным аудио и 2Kreddit.com ↗2026-05-26проверено
Какие типы ввода принимает Seedance 2.0?apidog.com ↗2026-05-26к проверке
Сколько времени занимает генерация видео?apidog.com ↗2026-05-26к проверке
Можно ли использовать Seedance 2.0 со стандартным OpenAI SDK?apidog.com ↗2026-05-26к проверке
В чём разница между Seedance 2.0 и Seedance 2.0 Fast?www.volcengine.com ↗2026-05-26к проверке
Помощь и контакты