返回模型列表

Doubao Seedream 4.5

doubaodoubao/doubao-seedream-4-5

Doubao SeedDream 4.5 — text/image-to-image generation, Chinese-bilingual prompt support.

豆包 Seedream 4.5 是字节跳动 Team Seedream 开发的统一图像生成与编辑模型,通过火山方舟平台提供服务。与传统的生成/编辑分离流水线不同,Seedream 4.5 将两种能力合并到单一架构中 —— 你可以在同一次 API 调用中通过文本提示生成图片,也可以提供参考图进行精修。

该模型擅长中英双语提示词理解、图内文字渲染(适合海报、电商横幅和 UI 原型)、多图组图生成以保持角色一致性,以及基于参考图的编辑(保留面部特征、光照和色调)。输出分辨率最高可达 4 百万像素(2048×2048),支持灵活的宽高比。

适合使用
  • • 带嵌入式文字和价格标签的电商产品图
  • • 需要精确中英文排版的营销海报和品牌视觉设计
  • • 需要角色一致性的多图故事板和连续插画
  • • 基于参考图的编辑 —— 风格迁移、换装、背景替换,同时保持人物身份
不适合使用
  • • 极近距离的写实人像 —— 专用肖像模型(如 doubao/doubao-seed-character)提供更精细的面部控制
  • • 需要 OpenAI 原生图像推理(先思考再绘制)的场景 —— 请转向 openai/gpt-image-2
  • • 以西方语言为主的密集文字渲染,FLUX Kontext 系列可能表现更好
上下文长度
--
最大输出
--
请求价格按次
$0.0432每次请求

模态能力

文本图像→图像

能力

视觉理解图像生成

媒体生成能力

image_generation
sizes
  • 1024x1024
  • 864x1152
  • 1152x864
defaults
size
1024x1024

价格明细

类型费率
请求$0.0432 每次请求

Per-image output price. BytePlus ModelArk `seedream-4-5-251128`: input image free, output $0.04/image (docs.byteplus.com/en/docs/ModelArk/1544106, read 2026-07-29).

支持参数

promptsizenresponse_formatuser

模型规格

发布日期2025-12-03seed.bytedance.com ↗已核实
参数量约 12 亿docs.apiyi.com ↗待核实
最大输出分辨率4MP(最高 2048×2048)fal.ai ↗已核实
架构统一文生图 + 图像编辑(多模态生成)seed.bytedance.com ↗已核实
批量生成每次请求最多 6 张图;组图模式保持多图一致性fal.ai ↗已核实
提示语言中文和英文(双语原生支持)seed.bytedance.com ↗已核实
模型版本doubao-seedream-4-5-251128www.volcengine.com ↗已核实
许可通过火山方舟 / TheRouter API 商业使用www.volcengine.com ↗待核实

基准成绩

BenchmarkDistributionScoreSource
GenEval
组合生成质量基准;来自 Seedream 4.0 论文(4.5 是 4.0 研究的发布版本)。
0.76arxiv.org ↗
T2I-CompBench
组合文生图基准;论文报告在中文双语模型中达到最先进水平。
Competitive with DALL-E 3 / SDXLarxiv.org ↗

API 使用示例

所有新集成都应使用下方示例中的全球端点 api.therouter.ai;旧中国加速端点已下线。

建议使用异步 API

图像生成通常需要 30–180 秒,超过同步请求的边缘超时。下方示例已使用 ?async=true + 轮询模式。 查看异步图像生成 / 编辑完整指南 →

cURL
# 1) Submit job (returns 202 immediately with a polling URL).
# Image generation takes 30-180s — always use the async path in production.
JOB=$(curl -s -X POST "https://api.therouter.ai/v1/images/generations?async=true"   -H "Content-Type: application/json"   -H "Authorization: Bearer $THE_ROUTER_API_KEY"   -d '{
    "model": "doubao/doubao-seedream-4-5",
    "prompt": "A cinematic product render with soft studio lighting"
  }' | python3 -c "import sys,json;print(json.load(sys.stdin)['id'])")
echo "submitted: $JOB"

# 2) Poll until terminal (succeeded / failed / cancelled / expired).
while :; do
  R=$(curl -s "https://api.therouter.ai/v1/jobs/$JOB"     -H "Authorization: Bearer $THE_ROUTER_API_KEY")
  S=$(echo "$R" | python3 -c "import sys,json;print(json.load(sys.stdin)['status'])")
  echo "status: $S"
  case "$S" in
    succeeded) echo "$R" | python3 -c "import sys,json;print(json.load(sys.stdin)['unsigned_urls'][0])"; break ;;
    failed|cancelled|expired) echo "$R"; exit 1 ;;
  esac
  sleep 5
done

API 使用指南

文本生成图片

使用 OpenAI 兼容的 images 端点生成图片。指定提示词、尺寸和格式。

cURL
curl https://api.therouter.ai/v1/images/generations \
  -H "Authorization: Bearer $THEROUTER_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "doubao/doubao-seedream-4-5",
    "prompt": "A modern minimalist cafe interior, warm lighting, Japanese aesthetic, 4K detail",
    "size": "1024x1024",
    "n": 1,
    "response_format": "url"
  }'

图像编辑示例

上传一张图片并用文本 prompt 描述编辑要求;模型会返回编辑后的图片(base64)。

cURL
# Same async submit + poll pattern as /v1/images/generations.
JOB=$(curl -s -X POST "https://api.therouter.ai/v1/images/edits?async=true"   -H "Authorization: Bearer $THE_ROUTER_API_KEY"   -F "model=doubao/doubao-seedream-4-5"   -F "prompt=Turn this scene into a watercolor painting"   -F "size=1024x1024"   -F "image=@input.png" | python3 -c "import sys,json;print(json.load(sys.stdin)['id'])")
echo "submitted: $JOB"

while :; do
  R=$(curl -s "https://api.therouter.ai/v1/jobs/$JOB"     -H "Authorization: Bearer $THE_ROUTER_API_KEY")
  S=$(echo "$R" | python3 -c "import sys,json;print(json.load(sys.stdin)['status'])")
  echo "status: $S"
  case "$S" in
    succeeded) echo "$R" | python3 -c "import sys,json;print(json.load(sys.stdin)['unsigned_urls'][0])"; break ;;
    failed|cancelled|expired) echo "$R"; exit 1 ;;
  esac
  sleep 5
done

doubao 其他模型

同类模型

跨供应商的相似能力档位

动态与变更

2025-12-03

Seedream 4.5 在火山方舟上线,统一生成与编辑能力

字节跳动 Team Seedream 发布了图像模型 4.5 版本,将文生图与多参考图编辑整合到统一架构中。模型支持最高 4MP 输出、组图模式保持多帧一致性,并增强了中英文文字渲染 —— 特别适合通过 TheRouter 路由的电商和营销创意工作流。

TheRouter 编辑重写ByteDance Seed ↗

常见问题

Seedream 4.5 和 Seedream 5.0 有什么区别?

Seedream 5.0 是直接后继版本,图像保真度和细节保留能力更强。Seedream 4.5 仍然可用,单张价格略高($0.0347 vs $0.0306),对于依赖其特定组图生成和编辑能力的工作流仍是不错的选择。

TheRouter 编辑重写seed.bytedance.com ↗
Seedream 4.5 支持图像编辑(图生图)吗?

是的。Seedream 4.5 的统一架构在同一模型中处理文生图和基于参考图的图像编辑。你可以在文本提示的同时传入参考图像,进行风格迁移、元素替换或多图融合,同时保持主体身份。

TheRouter 编辑重写seed.bytedance.com ↗
Seedream 4.5 支持什么分辨率和宽高比?

模型生成图像总像素最高 4 百万(最大 2048×2048)。支持灵活宽高比 —— 常用选项包括 1:1、16:9、9:16、3:4 和 4:3。通过 API 调用中的 'size' 参数指定尺寸。

TheRouter 编辑重写fal.ai ↗
Seedream 4.5 的文字渲染能力与其他图像模型相比如何?

Seedream 4.5 针对生成图像中的中英文排版进行了专门优化 —— 带嵌入文字的海报、产品卡和横幅是其核心优势。对于纯西方语言密集文字场景,FLUX Kontext 模型可能略有优势,但 Seedream 4.5 在 CJK 文字渲染质量上领先。

TheRouter 编辑重写seed.bytedance.com ↗
事实档案 — 本页每条断言可在此回溯来源
来源URL采集于
发布日期seed.bytedance.com ↗2026-05-26已核实
参数量docs.apiyi.com ↗2026-05-26待核实
最大输出分辨率fal.ai ↗2026-05-26已核实
架构seed.bytedance.com ↗2026-05-26已核实
批量生成fal.ai ↗2026-05-26已核实
提示语言seed.bytedance.com ↗2026-05-26已核实
模型版本www.volcengine.com ↗2026-05-26已核实
许可www.volcengine.com ↗2026-05-26待核实
GenEvalarxiv.org ↗2026-05-26待核实
T2I-CompBencharxiv.org ↗2026-05-26待核实
Seedream 4.5 在火山方舟上线,统一生成与编辑能力ByteDance Seed ↗2026-05-26已核实
Seedream 4.5 和 Seedream 5.0 有什么区别?seed.bytedance.com ↗2026-05-26待核实
Seedream 4.5 支持图像编辑(图生图)吗?seed.bytedance.com ↗2026-05-26待核实
Seedream 4.5 支持什么分辨率和宽高比?fal.ai ↗2026-05-26待核实
Seedream 4.5 的文字渲染能力与其他图像模型相比如何?seed.bytedance.com ↗2026-05-26待核实
帮助与联系