DeepSeek V4 Pro 9 月 14 日下线:迁移至 V4.1 Flash 完整指南
DeepSeek V4 Pro 将于 2026 年 9 月 14 日正式下线,所有请求将转发至 V4.1 Flash 并按 Flash 价格计费。本文整理了模型名称变更、代码调整、价格影响和回退方案,帮助运维团队在四天内完成迁移。
DeepSeek V4 Pro 将在 2026 年 9 月 14 日北京时间 12:00(UTC 04:00)正式下线。届时所有发送到 deepseek-v4-pro 的请求将被静默转发至 V4.1 Flash,按 Flash 价格计费。没有过渡期,四天后直接硬切换。
V4 Flash 系列已经完成了同样的过渡。deepseek-v4-flash 和 deepseek-v4-flash-vision-exp 这两个名称仍然可以调用,但背后运行的已经是 V4.1 Flash,统一名称为 deepseek-flash。DeepSeek 的合并理由是 V4.1 Flash"在性能、成本、速度和总耗时上全面超越了 V4 Pro"(来源,获取于 2026-09-10)。
我们在 TheRouter 的路由层中使用 DeepSeek 作为目标提供商,因此这次变更直接影响我们的技术栈。下面我们梳理具体变化,说明需要做什么,以及潜在的风险在哪里。
时间线
| 日期 | 事件 | 影响 |
|---|---|---|
| 2026 年 4 月 24 日 | V4 Preview 上线 | 引入 deepseek-v4-pro 和 deepseek-v4-flash |
| 2026 年 9 月 10 日前 | V4 Flash 下线 | deepseek-v4-flash 和 deepseek-v4-flash-vision-exp 已转发至 V4.1 Flash,统一名称为 deepseek-flash |
| 2026 年 9 月 14 日 | V4 Pro 下线 | deepseek-v4-pro 转发至 V4.1 Flash,按 Flash 价格计费 |
| 待定 | V4.1 Pro 发布 | DeepSeek 已确认将推出 V4.1 Pro,但尚未公布日期和价格 |
模型名称变更
这是最容易导致配置失效的部分。DeepSeek 把三个模型名称合并为一个。
变更前(2026 年 9 月之前):
deepseek-v4-flash → DeepSeek-V4-Flash
deepseek-v4-flash-vision-exp → DeepSeek-V4-Flash(视觉)
deepseek-v4-pro → DeepSeek-V4-Pro-0813
变更后(9 月 14 日起):
deepseek-flash → DeepSeek-V4.1-Flash(规范名称)
deepseek-v4-flash → DeepSeek-V4.1-Flash(旧名称,仍可用)
deepseek-v4-flash-vision-exp → DeepSeek-V4.1-Flash(旧名称,仍可用)
deepseek-v4-pro → DeepSeek-V4.1-Flash(转发,按 Flash 价格计费)
最稳妥的做法是现在就将 model 参数改为 deepseek-flash。旧名称虽然能用,但会掩盖你实际调用的模型版本。
代码调整
使用 OpenAI 兼容 SDK 的开发者只需改一行。
变更前:
from openai import OpenAI
client = OpenAI(
api_key="YOUR_DEEPSEEK_KEY",
base_url="https://api.deepseek.com",
)
response = client.chat.completions.create(
model="deepseek-v4-pro", # 9 月 14 日下线
messages=[{"role": "user", "content": "解释 Python 的 async generator。"}],
)
变更后:
from openai import OpenAI
client = OpenAI(
api_key="YOUR_DEEPSEEK_KEY",
base_url="https://api.deepseek.com",
)
response = client.chat.completions.create(
model="deepseek-flash", # V4.1 Flash,规范名称
messages=[{"role": "user", "content": "解释 Python 的 async generator。"}],
)
如果你使用 Anthropic 兼容端点(base_url="https://api.deepseek.com/anthropic"),同样将 model 参数从 deepseek-v4-pro 改为 deepseek-flash。
价格影响
V4.1 Flash 在所有维度上都比 V4 Pro 便宜。9 月 14 日之后,即使你仍然发送 deepseek-v4-pro,也会按 Flash 价格计费。
| 指标 | V4 Pro(当前) | V4.1 Flash(9 月 14 日后) | 变化 |
|---|---|---|---|
| 输入(缓存未命中,低峰) | $0.66 / 百万 tokens | $0.15 / 百万 tokens | -77% |
| 输入(缓存未命中,高峰) | $1.32 / 百万 tokens | $0.30 / 百万 tokens | -77% |
| 输入(缓存命中,低峰) | $0.022 / 百万 tokens | $0.003 / 百万 tokens | -86% |
| 输入(缓存命中,高峰) | $0.044 / 百万 tokens | $0.006 / 百万 tokens | -86% |
| 输出(低峰) | $1.98 / 百万 tokens | $0.60 / 百万 tokens | -70% |
| 输出(高峰) | $3.96 / 百万 tokens | $1.20 / 百万 tokens | -70% |
| 并发上限 | 500 | 2,500 | +5 倍 |
价格数据来自 DeepSeek 定价页面(获取于 2026-09-10)。高峰时段为 UTC 周一至周五 01:00–04:00 和 06:00–10:00。
成本降幅是实打实的,关键在于你的工作负载是否对质量差异敏感。
V4.1 Flash 的实际变化
V4.1 Flash 支持的功能集和 V4 Pro 基本一致,有两个区别。
新增能力 支持视觉输入。deepseek-flash 可以处理图片。V4 Pro 不支持视觉。
保持不变 Thinking 模式(默认启用,支持 low/high/max 三个级别)、Tool calls、JSON 输出、Responses API、FIM 补全(仅非思维模式)、Anthropic API 格式、1M context window、384K 最大输出。
风险点 DeepSeek 声称 V4.1 Flash 全面超越 V4 Pro。但如果你的工作负载高度依赖 V4 Pro 在复杂推理或 agentic coding 场景下的特定行为,请在 9 月 14 日之前运行测试。DeepSeek 尚未公布 V4 Pro 和 V4.1 Flash 之间的独立基准对比。
并发限制变化
并发上限从 500(V4 Pro)跃升至 2,500(V4.1 Flash),对吞吐量敏感的工作负载来说是纯升级。无需额外操作,一旦请求转发到 Flash,更高的限制自动生效。
如需超过 2,500 的并发连接,可以向 DeepSeek 提交扩容申请,无额外费用。
路由配置更新
如果你使用 TheRouter 做请求路由,请将 provider 配置中的模型名称更新为规范名称。
# 变更前
providers:
- id: deepseek
models:
- deepseek-v4-pro
- deepseek-v4-flash
# 变更后
providers:
- id: deepseek
models:
- deepseek-flash # V4.1 Flash,替代 V4 Pro 和 V4 Flash
如果你此前为 V4 Pro(质量层)和 V4 Flash(成本层)配置了不同的路由规则,现在只剩一个模型。可以考虑添加 fallback 链,在需要 Pro 级别质量时回退到其他提供商的 Pro 层模型。
- 替换三个值,不是三个 SDK。在现有 OpenAI 客户端里改
api_key、base_url、model。请求与响应代码保持不变。 - 显式映射 model ID。目标供应商的 model id 几乎不会和 OpenAI 完全一致。 在业务代码之外维护一份
{ openai_id: target_id }映射。 - 验证流式格式。SSE 分片必须遵循 OpenAI 的
data: {...}+data: [DONE]契约。切生产前先跑一次流式调用。 - 检查限流响应头。部分供应商不返回
x-ratelimit-*。 在包装层 做缺省兜底,缺头不要崩。 - 留回滚路径。用 feature flag 切流;新旧 endpoint 影子并行 24 小时,再正式切换。
回退方案
9 月 14 日之后,回退到 V4 Pro 的路已经封死。DeepSeek 将无条件把所有 V4 Pro 请求转发至 V4.1 Flash。
如果 V4.1 Flash 不能满足你对 Pro 层工作负载的质量要求,有三条路可以走。
- 等待 V4.1 Pro。 DeepSeek 已确认将发布 V4.1 Pro,但没有公布日期和价格。在此之前,DeepSeek 上不再有 Pro 层模型可用。
- 路由到其他提供商。 对于需要前沿推理能力的工作负载,可以将请求路由到 Claude Opus 4、GPT-6 Astra 或 Kimi K3 作为主路径或 fallback。
- 现在就测试 V4.1 Flash。 在 9 月 14 日之前,用你的评估套件跑一遍
deepseek-flash。如果通过,你能省下 70%–86% 的成本,并获得 5 倍并发。这是大多数工作负载的大概率结果。
受影响的 TheRouter 博客文章
我们已发布的五篇博客文章中提到了 deepseek-v4-pro 这个模型名称。9 月 14 日之后,这些文章中的模型名称实际上指向的是 V4.1 Flash。我们将更新这些文章以反映新的模型格局。
- DeepSeek API 完整指南
- DeepSeek V4 Pro GA 峰值定价路由指南
- DeepSeek V4 Pro vs Flash API 对比
- Kimi K3 vs DeepSeek V4 vs Qwen3.7 对比
- Qwen3.8-Max vs DeepSeek V4 Pro 对比
常见问题
9 月 14 日之后 deepseek-v4-pro 会停止工作吗?
不会。请求仍然会被接受,但背后运行的是 V4.1 Flash,按 Flash 价格计费。API 调用不会中断,但底层模型会变。
V4.1 Flash 和旧版 V4 Flash 是同一个模型吗? 不是。V4.1 Flash 是全新模型(DeepSeek-V4.1-Flash)。旧版 V4 Flash(DeepSeek-V4-Flash)已经下线,名称重定向到 V4.1 Flash。
V4.1 Pro 什么时候发布? DeepSeek 已确认将发布 V4.1 Pro,但没有公布日期。定价页面写道 V4 Pro 将转发至 V4.1 Flash,"直到未来 V4.1 Pro 发布"。
需要更换 API key 吗? 不需要。同一个 API key 继续有效,只需更新 model 参数。
这次变更影响 DeepSeek R1 吗? 不影响。DeepSeek R1 是独立的模型线,不在本次合并范围内。