返回模型列表

Doubao Seedance 2.0

doubaodoubao/doubao-seedance-2-0

Doubao SeedDance 2.0 — text/image-to-video generation, flagship quality tier.

豆包 Seedance 2.0 是字节跳动旗舰级多模态视频生成模型,由 Team Seed 开发,通过火山方舟平台提供服务。与仅接受文本提示的文生视频模型不同,Seedance 2.0 支持同时输入文字、图片、音频和视频 —— 每次请求最多 12 个参考文件 —— 采用双分支扩散 Transformer 架构,并行生成同步视频和音频。

该模型在复杂运动生成(真实物理)、原生音视频同步(对话、音效、环境音和音乐)、首尾帧控制以及导演模式(通过自然语言控制镜头轨迹和光照)方面表现出色。输出最长 15 秒、最高 2K 分辨率、24 fps,支持从 1:1 到 21:9 的宽高比。API 采用视频生成典型的异步提交-轮询-下载模式。

适合使用
  • • 短篇视频内容 —— 社交媒体片段、广告和带原生音频的推广视频
  • • 故事板原型制作与预可视化 —— 通过首尾帧控制实现电影级镜头运动
  • • 多模态角色驱动视频 —— 合并角色肖像、参考动作和环境图片到一次请求
  • • 多语言对口型说话人物 —— 对话生成与原生音频对齐(支持 8 种以上语言)
不适合使用
  • • 超过 15 秒的长篇叙事视频 —— 拼接多个 Seedance 片段或使用专用流水线
  • • 实时交互式视频生成 —— Seedance 生成延迟为 30–120 秒;请使用实时扩散模型
  • • 超大批量的低成本缩略图或短 GIF 生成 —— 专用图像模型(如 doubao/doubao-seedream-4-5)每张成本更低
上下文长度
--
最大输出
--
视频价格按视频秒
$0.162每秒

模态能力

文本图像→视频

能力

视觉理解文本生视频图像生视频

媒体生成能力

video_generation
sizes
  • 1280x720
  • 720x1280
durations_seconds
  • 5
  • 10
defaults
size
1280x720
duration_seconds
5

价格明细

类型费率
视频$0.162 每秒

request is price per second for 720x1280 or 1280x720 outputs — the vendor's own per-second rate for this catalog configuration

支持参数

promptimage_urlsecondssizeaspect_ratio

模型规格

发布日期2026-02-10(消费者端);2026-04-02(API 通过火山方舟 GA)apidog.com ↗已核实
架构双分支扩散 Transformer(音频 + 视频联合生成)seed.bytedance.com ↗待核实
最大时长15 秒apidog.com ↗已核实
最高分辨率2K(2560×1440)www.nxcode.io ↗已核实
帧率24 fpsapidog.com ↗已核实
输入模态文本、图片(最多 9 张)、视频(最多 3 段)、音频(最多 3 个文件)apidog.com ↗已核实
输出音频原生生成 —— 对话、音效、环境音、音乐;与视频同步seed.bytedance.com ↗已核实
语言支持多语言(中文和英文原生支持),8 种以上语言对口型apidog.com ↗已核实
模型版本doubao-seedance-2-0-260128apidog.com ↗已核实
许可通过火山方舟 / TheRouter API 商用许可volcengine.com ↗待核实

基准成绩

BenchmarkDistributionScoreSource
SeedVideoBench-2.0 (internal)
字节跳动内部的 SeedVideoBench-2.0 评估运动稳定性、提示遵循度、时序一致性和音视频同步。Seedance 2.0 报告了最先进的结果。暂无第三方审核。
SOTA (internal benchmark)seed.bytedance.com ↗
Vbench
第三方评测(如 evoLink、WaveSpeed)在运动自然度和音频同步方面将 Seedance 2.0 评为高分,整体质量与 Kling 3.0 和 Sora 2 相当。
4.2+/5.0 (third-party estimate)evolink.ai ↗

API 使用示例

所有新集成都应使用下方示例中的全球端点 api.therouter.ai;旧中国加速端点已下线。

cURL
curl https://api.therouter.ai/v1/videos   -H "Content-Type: application/json"   -H "Authorization: Bearer $THE_ROUTER_API_KEY"   -d '{
    "model": "doubao/doubao-seedance-2-0",
    "prompt": "A slow tracking shot through a neon-lit city street",
    "duration": 8
  }'

API 使用指南

文字生成视频

通过文本提示提交视频生成任务。API 使用异步任务模式 —— 提交、轮询完成、下载结果 URL。

cURL
# Step 1: Submit text-to-video generation task
curl -X POST https://api.therouter.ai/v1/contents/generations/tasks \
  -H "Authorization: Bearer $THEROUTER_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "doubao/doubao-seedance-2-0",
    "content": [
      {
        "type": "text",
        "text": "A golden retriever running through a sunlit wheat field, wide tracking shot, cinematic lighting"
      }
    ],
    "resolution": "1080p",
    "ratio": "16:9",
    "duration": 5,
    "watermark": false
  }'

# Step 2: Poll for completion (save task_id from response)
curl https://api.therouter.ai/v1/contents/generations/tasks/cgt-xxxxxx \
  -H "Authorization: Bearer $THEROUTER_API_KEY"

# Step 3: When status="succeeded", download video_url from the response

doubao 其他模型

同类模型

跨供应商的相似能力档位

动态与变更

2026-04-14

火山方舟全面开放 Seedance 2.0 API 服务,面向企业和个人用户

火山方舟正式上线 Seedance 2.0 API,支持文本、图片、音频、视频四种输入方式,建立合规安全标准(肖像和版权),并预装超过 10,000 个高质量虚拟形象。早期企业用户报告在短剧和漫画风格视频制作流程中效率提升 80–90%,可通过 TheRouter 访问。

TheRouter 编辑重写aibase.com ↗
2026-02-10

字节跳动发布 Seedance 2.0,支持导演模式、原生音频和 2K 输出

Seedance 2.0 推出了双分支扩散 Transformer 架构实现联合音视频生成、导演模式通过自然语言精确控制镜头轨迹和光照、首尾帧书夹控制以及 8 种以上语言对口型同步。模型因其真实的物理效果和运动稳定性迅速走红,成为 2026 年讨论度最高的 AI 视频模型之一。

TheRouter 编辑重写reddit.com ↗

常见问题

Seedance 2.0 支持哪些输入类型?

Seedance 2.0 接受文本、图片(最多 9 张,每张最大 30MB)、视频片段(最多 3 段,每段 2–15 秒,每段最大 50MB)和音频文件(最多 3 个,MP3,每个最大 15MB)—— 全部在一次请求内。您可以将多种模态混合使用,例如:角色图片 + 动作参考视频 + 环境音 + 文本提示。

TheRouter 编辑重写apidog.com ↗
视频生成需要多久?

通常在 30–120 秒之间,取决于分辨率和时长。一个 5 秒 1080p 视频平均需要 60–90 秒。API 使用异步模式:提交任务、每 5–10 秒轮询状态端点、当状态变为 'succeeded' 时下载结果 URL。URL 在 24 小时内过期。

TheRouter 编辑重写apidog.com ↗
我能用标准 OpenAI SDK 调用 Seedance 2.0 吗?

不能 —— Seedance 2.0 使用火山方舟的异步任务 API,而非 OpenAI 的 chat completions 格式。TheRouter 将请求路由到正确的 Ark 端点,但您必须使用异步提交-轮询-下载模式。原生 OpenAI SDK 方法如 chat.completions.create() 无法直接使用。请参考上方的 API 指南了解正确的请求格式。

TheRouter 编辑重写apidog.com ↗
Seedance 2.0 和 Seedance 2.0 Fast 有什么区别?

Seedance 2.0 Fast 是低成本、更快速的版本,专为视频迭代草稿和原型制作优化。它使用更小的模型,生成速度更快,每次请求价格更低(3.0556 vs 3.8889)。代价是输出质量有所降低,尤其在运动复杂度、提示遵循度和音视频同步方面。生产级交付物请使用标准 Seedance 2.0;快速草稿和内部迭代则使用 Fast 更经济。

TheRouter 编辑重写www.volcengine.com ↗
事实档案 — 本页每条断言可在此回溯来源
来源URL采集于
发布日期apidog.com ↗2026-05-26已核实
架构seed.bytedance.com ↗2026-05-26待核实
最大时长apidog.com ↗2026-05-26已核实
最高分辨率www.nxcode.io ↗2026-05-26已核实
帧率apidog.com ↗2026-05-26已核实
输入模态apidog.com ↗2026-05-26已核实
输出音频seed.bytedance.com ↗2026-05-26已核实
语言支持apidog.com ↗2026-05-26已核实
模型版本apidog.com ↗2026-05-26已核实
许可volcengine.com ↗2026-05-26待核实
SeedVideoBench-2.0 (internal)seed.bytedance.com ↗2026-05-26单一来源
Vbenchevolink.ai ↗2026-05-26单一来源
火山方舟全面开放 Seedance 2.0 API 服务,面向企业和个人用户aibase.com ↗2026-05-26已核实
字节跳动发布 Seedance 2.0,支持导演模式、原生音频和 2K 输出reddit.com ↗2026-05-26已核实
Seedance 2.0 支持哪些输入类型?apidog.com ↗2026-05-26待核实
视频生成需要多久?apidog.com ↗2026-05-26待核实
我能用标准 OpenAI SDK 调用 Seedance 2.0 吗?apidog.com ↗2026-05-26待核实
Seedance 2.0 和 Seedance 2.0 Fast 有什么区别?www.volcengine.com ↗2026-05-26待核实
帮助与联系