DashScope 2026年10月模型下线倒计时:27天最后迁移清单
距离10月10日还有27天。DashScope(百炼)将一次性停服100多个模型,包括 Qwen 主线、快照和全部第三方模型(DeepSeek、GLM、MiniMax、Kimi)。QPM/TPM 限流已经开始。这份紧凑的最后迁移清单帮你在截止日期前完成审计、替换、申请厂商直连密钥和测试。
DashScope 2026年10月模型下线倒计时:27天最后迁移清单
2026年10月10日 00:00 CST,DashScope(百炼)将执行有史以来最大规模的模型下线。没有缓冲期,没有降级模式。QPM 和 TPM 限流已经在进行中。如果你的服务还在调用任何即将下线的模型 ID,时间不多了。
我们在七月发布过一份完整的迁移指南,包含全部模型列表、定价分析和前后代码对比。这篇不是那份指南。这是最后27天的紧凑行动清单。
- 替换三个值,不是三个 SDK。在现有 OpenAI 客户端里改
api_key、base_url、model。请求与响应代码保持不变。 - 显式映射 model ID。目标供应商的 model id 几乎不会和 OpenAI 完全一致。 在业务代码之外维护一份
{ openai_id: target_id }映射。 - 验证流式格式。SSE 分片必须遵循 OpenAI 的
data: {...}+data: [DONE]契约。切生产前先跑一次流式调用。 - 检查限流响应头。部分供应商不返回
x-ratelimit-*。 在包装层 做缺省兜底,缺头不要崩。 - 留回滚路径。用 feature flag 切流;新旧 endpoint 影子并行 24 小时,再正式切换。
哪些模型要下线
六份公告,一个截止日期。所有模型于10月10日停服。
| 公告 | 影响范围 | 数量 |
|---|---|---|
| #118344 | Qwen3 主线:qwen3-max、qwen3-max-preview、qwen3.6-max-preview、qwen3-coder-plus、qwen3-vl-flash | 5 |
| #118177 | 历史主线:qwen-turbo、qwen-vl-max/plus、qwq-plus、qvq-max/plus、qwen-math-turbo、qwen-coder-turbo/plus | 10 |
| #118434 | 老旧主线模型 | 若干 |
| #118345 | 60+ 快照 + 全部第三方:DeepSeek V3/R1、MiniMax-M2.1、GLM-4.7/4.6、Kimi-K2 | 60+ |
| #118331 | 语音主线(cosyvoice、paraformer、gummy) | 15+ |
| #118332 | 语音快照 | 若干 |
第三方模型的迁移最复杂。百炼官方建议用 qwen3.7-plus 统一替代,但如果你选 DeepSeek R1 是因为推理能力,选 GLM-4.7 是因为中文长上下文,换成另一个模型家族等于从头做适配。应该切到厂商直连 API。
迁移清单——五步,现在就开始
第一步:审计模型用量(第1天)
打开 DashScope 模型监控页面,看看有没有活跃调用在使用即将下线的模型 ID。
然后在代码库里跑一遍搜索。
grep -rn "qwen3-max\|qwen3-max-preview\|qwen3.6-max-preview\|qwen3-coder-plus\|qwen3-vl-flash\|qwen-turbo\|qwen-vl-max\|qwen-vl-plus\|qwq-plus\|qvq-max\|qvq-plus\|qwen-math-turbo\|qwen-coder-turbo\|qwen-coder-plus\|deepseek-v3\|deepseek-r1\|MiniMax-M2.1\|glm-4.7\|glm-4.6\|Moonshot-Kimi-K2\|kimi-k2-thinking" \
--include="*.py" --include="*.ts" --include="*.js" --include="*.yaml" --include="*.yml" --include="*.json" .
没有匹配结果的话,你可以关掉这篇文章了。
第二步:替换 Qwen 模型 ID(第2–5天)
Qwen 家族的迁移只需要换模型 ID,endpoint 和 API key 都不用动。
快速替换对照表
| 下线模型 | 替代模型 | 价格变化 |
|---|---|---|
qwen3-max | qwen3.7-max | <32K 输入贵 380%,128K+ 便宜 41% |
qwen3-max-preview | qwen3.7-max | 同上 |
qwen3.6-max-preview | qwen3.7-max | 见定价页面 |
qwen3-coder-plus | qwen3.7-plus | 差异不大 |
qwen3-vl-flash | qwen3.6-flash | 差异不大 |
qwen-turbo | qwen3.6-flash | 便宜 67% |
qwq-plus | qwen3.7-plus + enable_thinking: true | API 接口变化 |
qvq-max / qvq-plus | qwen3.7-plus + enable_thinking: true | API 接口变化 |
qwen-coder-turbo / qwen-coder-plus | qwen3.7-plus | 差异不大 |
如果你在用推理模型(qwq-plus、qvq-max、qvq-plus),替代方案的 API 接口有变化。Qwen3.7 系列使用 enable_thinking: true 参数,推理过程在响应的 reasoning_content 字段中返回,思维链 token 按输出价格计费。详见我们的 Qwen3.7 系列指南。
预算敏感的团队可能觉得 qwen3.7-max 的价格(¥12/¥36 每百万 token)偏高,可以试试同价位的 qwen3.8-max(更新的模型),或者降级到 qwen3.7-plus 只要 ¥2/¥8。如果对延迟更敏感,新推出的 qwen3.8-max-prime 快速模式(¥24/¥72)也值得评估。
第三步:为第三方模型获取厂商直连 API 密钥(第2–5天)
百炼上托管的第三方模型在10月10日全部下线。Qwen 系列无法替代它们的独特能力。请切换到厂商直连。
| 下线的 DashScope 模型 | 厂商 | 厂商直连 Endpoint | 指南 |
|---|---|---|---|
deepseek-v3、deepseek-v3.1、deepseek-v3.2 | DeepSeek | https://api.deepseek.com | DeepSeek API 指南 |
deepseek-r1、deepseek-r1-0528、distill 变体 | DeepSeek | https://api.deepseek.com | DeepSeek API 指南 |
glm-4.7、glm-4.6 | 智谱 AI | https://open.bigmodel.cn | 智谱 GLM API 指南 |
Moonshot-Kimi-K2-Instruct、kimi-k2-thinking | 月之暗面 | https://api.moonshot.cn | Kimi K3 API 指南 |
MiniMax-M2.1 | MiniMax | https://api.minimax.chat | — |
开源模型(DeepSeek V3、R1、R1-distill 变体)还可以通过 SiliconFlow 路由,价格有竞争力。详见我们的 SiliconFlow 免费模型指南。
厂商直连的代码改动只有两行。
# 迁移前 — 通过 DashScope 调用 DeepSeek(10月10日失效)
client = OpenAI(
api_key="sk-dashscope-xxx",
base_url="https://dashscope.aliyuncs.com/compatible-mode/v1"
)
response = client.chat.completions.create(
model="deepseek-v3",
messages=[{"role": "user", "content": "Hello"}]
)
# 迁移后 — DeepSeek 厂商直连
client = OpenAI(
api_key="sk-deepseek-xxx",
base_url="https://api.deepseek.com"
)
response = client.chat.completions.create(
model="deepseek-chat", # 厂商自己的模型 ID
messages=[{"role": "user", "content": "Hello"}]
)
第四步:测试替代模型(第5–14天)
对替代模型运行你的评估套件,重点关注三个方面。
- **输出格式。**推理模型(
qwq-plus迁移到带 thinking 的qwen3.7-plus)会在不同字段返回推理过程。结构化输出格式在不同模型家族之间也可能有差异。 - 上下文窗口。
qwen3-max在 256K 内分三档计价。qwen3.7-max在 1M 内统一价格。你的 prompt 能正常运行,但账单会变。 - **延迟和限流。**百炼正在逐步降低下线模型的限流阈值,在老模型上跑出来的延迟基线没有参考价值。
第五步:上线并监控(第14–27天)
将更新后的模型 ID 和 base URL 推到生产环境,然后做三件事。
- 关注错误率。如果百炼在最后几周进一步收紧下线模型的 QPM/TPM,你的老接口可能在10月10日之前就开始返回 429。
- 对模型 ID 字符串设告警。部署之后如果还有服务引用了下线模型,要在硬停之前发现。
- 如果你使用 TheRouter,可以配置模型 fallback,从下线的 ID 自动切换到替代模型。TheRouter 通过配置的 provider 路由 OpenAI 兼容请求,在产品路径支持的情况下提供 provider/model 路由和 fallback。
QPM/TPM 限流已经在进行
百炼从每份公告发布之日起就开始降低下线模型的限流阈值。最早的公告(#118177)发布于2026年4月13日,那些模型的 QPM 和 TPM 已经持续收缩了五个月。如果你之前申请过扩容,额度会先恢复到默认值,然后继续降低(下线机制说明,2026-09-13 检索)。
如果你在下线模型上观察到 429 响应增多或吞吐量下降,就是限流在起作用。从现在到10月10日,只会更严格。
10月10日 00:00 CST 会发生什么
- **模型推理停止。**对下线模型 ID 的 API 调用将直接失败。没有 fallback,没有降级输出。
- 基于下线基座模型的微调模型如果已经部署可能仍可使用,但无法基于已下线的基座创建新的微调。
- 控制台和文档中与下线模型相关的功能会同步下线。
- **没有延期机制。**百炼的下线截止日期曾经有过延期先例(原定9月8日的 Qwen3 截止日被推迟到10月10日),但押注再次延期是赌博行为。
相关迁移资源
需要完整的逐模型替换映射、定价分析和前后代码对比,请看我们的2026年10月 DashScope 全量迁移指南。
Qwen3 到 Qwen3.7 的升级路径,请看Qwen3 到 Qwen3.7 升级指南。
DashScope 各轮下线的完整时间线,请看DashScope 模型生命周期汇总。
数据来源均为官方文档,包括 阿里云模型下线机制说明(2026-09-13 检索),模型定价(2026-09-13 检索),公告 #118344、#118177、#118345、#118434、#118331、#118332。