字节跳动 FORCE 大会发布 Seed1.6 系列
字节跳动 Seed 团队发布 Seed1.6 家族,支持 256K 上下文、多模态预训练、AdaCoT 自适应思考,并在 Gaokao/JEE 测评中表现突出。Vision 变体随后数月内跟进。
Doubao Seed 1.6 Vision — vision-language Seed 1.6 variant for multimodal understanding.
Doubao Seed 1.6 Vision(doubao-seed-1.6-vision-250815)是字节跳动通过火山引擎提供的通用多模态模型,属于 Seed1.6 系列稀疏 MoE 家族(230B 总参数 / 23B 激活参数)。该系列在预训练阶段即融入多模态理解,并支持 256K 上下文窗口(上游)。Vision 变体原生支持 VisualCoT——模型可在思维链中对图像进行裁剪、旋转、缩放与标注。
对 TheRouter 路由层用户而言,Doubao Seed 1.6 Vision 是性价比高的中文 provider 视觉模型,在 GUI Agent、Grounding 与视频理解场景表现突出。通过 api.therouter.ai/v1 完全兼容 OpenAI 接口,支持 temperature、max_tokens、top_p、tools/tool_choice、response_format 与 stop,与 standard-models.yaml 中列出的参数一致。
| 类型 | 费率 |
|---|---|
| 输入 | $0.1296 每百万 Tokens |
| 输出 | $1.30 每百万 Tokens |
| 发布日期 | 2025 年 8 月(250815 快照)ohmygpt.com ↗ | 已核实 |
| 架构 | 230B 总参数 / 23B 激活 MoE,多模态预训练seed.bytedance.com ↗ | 已核实 |
| VisualCoT | 原生基于工具的视觉思维链(裁剪、旋转、缩放、标注)developer.volcengine.com ↗ | 已核实 |
| 许可 | 专有(火山引擎 API)www.volcengine.com ↗ | 已核实 |
| 训练数据截止 | 未公开披露 | 未知 |
| 推理后端 | 火山引擎(专有)www.volcengine.com ↗ | 已核实 |
| Benchmark | Distribution | Score | Source |
|---|---|---|---|
MME-SCI (image-only) 科学导向的多模态基准;闭源 Doubao-Seed-1.6 超过多数开源 VLM,但落后于顶尖 Gemini 级别模型。 | 41.32%% | arxiv.org ↗ | |
Gaokao 2025 (multimodal) Seed1.6-Thinking 在 2025 山东高考六科总分中,理科排名第 2、文科排名第 1。 | 676 (science) / 683 (humanities) | seed.bytedance.com ↗ |
所有新集成都应使用下方示例中的全球端点 api.therouter.ai;旧中国加速端点已下线。
curl https://api.therouter.ai/v1/chat/completions -H "Content-Type: application/json" -H "Authorization: Bearer $THE_ROUTER_API_KEY" -d '{
"model": "doubao/doubao-seed-1-6-vision",
"messages": [
{"role": "user", "content": "Summarize the key points from this input."}
]
}'curl https://api.therouter.ai/v1/chat/completions \
-H "Authorization: Bearer $THEROUTER_API_KEY" \
-H "Content-Type: application/json" \
-d '{"model":"doubao/doubao-seed-1-6-vision","messages":[{"role":"user","content":[{"type":"text","text":"描述这张图片"},{"type":"image_url","image_url":{"url":"https://therouter.ai/assets/vision-sample.png"}}]}]}'字节跳动 Seed 团队发布 Seed1.6 家族,支持 256K 上下文、多模态预训练、AdaCoT 自适应思考,并在 Gaokao/JEE 测评中表现突出。Vision 变体随后数月内跟进。
火山引擎文档与开发者评测重点强调原生 VisualCoT、256K 上下文,以及在 GUI Grounding 与视频理解场景的强表现。
上游火山引擎端点支持 256K。TheRouter 按 standard-models.yaml 中配置的 context_length(131072 tokens)暴露该模型。生产容量规划请以 YAML 数值为准。
VisualCoT 是原生的:模型在思维链中自行决定何时以及如何裁剪/旋转/标注图像,并将处理后的图像作为可见 CoT 的一部分返回,无需额外的视觉工具微服务。
| 来源 | URL | 采集于 | |
|---|---|---|---|
| 发布日期 | ohmygpt.com ↗ | 2026-05-25 | 已核实 |
| 架构 | seed.bytedance.com ↗ | 2026-05-25 | 已核实 |
| VisualCoT | developer.volcengine.com ↗ | 2026-05-25 | 已核实 |
| 许可 | www.volcengine.com ↗ | 2026-05-25 | 已核实 |
| 训练数据截止 | — | — | 未知 |
| 推理后端 | www.volcengine.com ↗ | 2026-05-25 | 已核实 |
| MME-SCI (image-only) | arxiv.org ↗ | 2026-05-25 | 待核实 |
| Gaokao 2025 (multimodal) | seed.bytedance.com ↗ | 2026-05-25 | 待核实 |
| 字节跳动 FORCE 大会发布 Seed1.6 系列 | seed.bytedance.com ↗ | 2026-05-25 | 已核实 |
| Doubao-Seed-1.6-vision 公开文档(250815) | volcengine.com ↗ | 2026-05-25 | 已核实 |
| Doubao Seed 1.6 Vision 的上下文窗口与上游 256K 模型一致吗? | www.volcengine.com ↗ | 2026-05-25 | 待核实 |
| VisualCoT 与标准视觉工具调用有何不同? | developer.volcengine.com ↗ | 2026-05-25 | 待核实 |