← 全部文章

DashScope 2026年10月模型下线倒计时:27天最后迁移清单

距离10月10日还有27天。DashScope(百炼)将一次性停服100多个模型,包括 Qwen 主线、快照和全部第三方模型(DeepSeek、GLM、MiniMax、Kimi)。QPM/TPM 限流已经开始。这份紧凑的最后迁移清单帮你在截止日期前完成审计、替换、申请厂商直连密钥和测试。

· TheRouter

DashScope 2026年10月模型下线倒计时:27天最后迁移清单

2026年10月10日 00:00 CST,DashScope(百炼)将执行有史以来最大规模的模型下线。没有缓冲期,没有降级模式。QPM 和 TPM 限流已经在进行中。如果你的服务还在调用任何即将下线的模型 ID,时间不多了。

我们在七月发布过一份完整的迁移指南,包含全部模型列表、定价分析和前后代码对比。这篇不是那份指南。这是最后27天的紧凑行动清单。

  1. 替换三个值,不是三个 SDK。在现有 OpenAI 客户端里改 api_key、base_url、model。请求与响应代码保持不变。
  2. 显式映射 model ID。目标供应商的 model id 几乎不会和 OpenAI 完全一致。 在业务代码之外维护一份 { openai_id: target_id } 映射。
  3. 验证流式格式。SSE 分片必须遵循 OpenAI 的 data: {...} + data: [DONE] 契约。切生产前先跑一次流式调用。
  4. 检查限流响应头。部分供应商不返回 x-ratelimit-*。 在包装层 做缺省兜底,缺头不要崩。
  5. 留回滚路径。用 feature flag 切流;新旧 endpoint 影子并行 24 小时,再正式切换。

哪些模型要下线

六份公告,一个截止日期。所有模型于10月10日停服。

公告影响范围数量
#118344Qwen3 主线:qwen3-max、qwen3-max-preview、qwen3.6-max-preview、qwen3-coder-plus、qwen3-vl-flash5
#118177历史主线:qwen-turbo、qwen-vl-max/plus、qwq-plus、qvq-max/plus、qwen-math-turbo、qwen-coder-turbo/plus10
#118434老旧主线模型若干
#11834560+ 快照 + 全部第三方:DeepSeek V3/R1、MiniMax-M2.1、GLM-4.7/4.6、Kimi-K260+
#118331语音主线(cosyvoice、paraformer、gummy)15+
#118332语音快照若干

第三方模型的迁移最复杂。百炼官方建议用 qwen3.7-plus 统一替代,但如果你选 DeepSeek R1 是因为推理能力,选 GLM-4.7 是因为中文长上下文,换成另一个模型家族等于从头做适配。应该切到厂商直连 API。

迁移清单——五步,现在就开始

第一步:审计模型用量(第1天)

打开 DashScope 模型监控页面,看看有没有活跃调用在使用即将下线的模型 ID。

然后在代码库里跑一遍搜索。

grep -rn "qwen3-max\|qwen3-max-preview\|qwen3.6-max-preview\|qwen3-coder-plus\|qwen3-vl-flash\|qwen-turbo\|qwen-vl-max\|qwen-vl-plus\|qwq-plus\|qvq-max\|qvq-plus\|qwen-math-turbo\|qwen-coder-turbo\|qwen-coder-plus\|deepseek-v3\|deepseek-r1\|MiniMax-M2.1\|glm-4.7\|glm-4.6\|Moonshot-Kimi-K2\|kimi-k2-thinking" \
  --include="*.py" --include="*.ts" --include="*.js" --include="*.yaml" --include="*.yml" --include="*.json" .

没有匹配结果的话,你可以关掉这篇文章了。

第二步:替换 Qwen 模型 ID(第2–5天)

Qwen 家族的迁移只需要换模型 ID,endpoint 和 API key 都不用动。

快速替换对照表

下线模型替代模型价格变化
qwen3-maxqwen3.7-max<32K 输入贵 380%,128K+ 便宜 41%
qwen3-max-previewqwen3.7-max同上
qwen3.6-max-previewqwen3.7-max见定价页面
qwen3-coder-plusqwen3.7-plus差异不大
qwen3-vl-flashqwen3.6-flash差异不大
qwen-turboqwen3.6-flash便宜 67%
qwq-plusqwen3.7-plus + enable_thinking: trueAPI 接口变化
qvq-max / qvq-plusqwen3.7-plus + enable_thinking: trueAPI 接口变化
qwen-coder-turbo / qwen-coder-plusqwen3.7-plus差异不大

如果你在用推理模型(qwq-plus、qvq-max、qvq-plus),替代方案的 API 接口有变化。Qwen3.7 系列使用 enable_thinking: true 参数,推理过程在响应的 reasoning_content 字段中返回,思维链 token 按输出价格计费。详见我们的 Qwen3.7 系列指南。

预算敏感的团队可能觉得 qwen3.7-max 的价格(¥12/¥36 每百万 token)偏高,可以试试同价位的 qwen3.8-max(更新的模型),或者降级到 qwen3.7-plus 只要 ¥2/¥8。如果对延迟更敏感,新推出的 qwen3.8-max-prime 快速模式(¥24/¥72)也值得评估。

第三步:为第三方模型获取厂商直连 API 密钥(第2–5天)

百炼上托管的第三方模型在10月10日全部下线。Qwen 系列无法替代它们的独特能力。请切换到厂商直连。

下线的 DashScope 模型厂商厂商直连 Endpoint指南
deepseek-v3、deepseek-v3.1、deepseek-v3.2DeepSeekhttps://api.deepseek.comDeepSeek API 指南
deepseek-r1、deepseek-r1-0528、distill 变体DeepSeekhttps://api.deepseek.comDeepSeek API 指南
glm-4.7、glm-4.6智谱 AIhttps://open.bigmodel.cn智谱 GLM API 指南
Moonshot-Kimi-K2-Instruct、kimi-k2-thinking月之暗面https://api.moonshot.cnKimi K3 API 指南
MiniMax-M2.1MiniMaxhttps://api.minimax.chat—

开源模型(DeepSeek V3、R1、R1-distill 变体)还可以通过 SiliconFlow 路由,价格有竞争力。详见我们的 SiliconFlow 免费模型指南。

厂商直连的代码改动只有两行。

# 迁移前 — 通过 DashScope 调用 DeepSeek(10月10日失效)
client = OpenAI(
    api_key="sk-dashscope-xxx",
    base_url="https://dashscope.aliyuncs.com/compatible-mode/v1"
)
response = client.chat.completions.create(
    model="deepseek-v3",
    messages=[{"role": "user", "content": "Hello"}]
)

# 迁移后 — DeepSeek 厂商直连
client = OpenAI(
    api_key="sk-deepseek-xxx",
    base_url="https://api.deepseek.com"
)
response = client.chat.completions.create(
    model="deepseek-chat",    # 厂商自己的模型 ID
    messages=[{"role": "user", "content": "Hello"}]
)

第四步:测试替代模型(第5–14天)

对替代模型运行你的评估套件,重点关注三个方面。

  1. **输出格式。**推理模型(qwq-plus 迁移到带 thinking 的 qwen3.7-plus)会在不同字段返回推理过程。结构化输出格式在不同模型家族之间也可能有差异。
  2. 上下文窗口。qwen3-max 在 256K 内分三档计价。qwen3.7-max 在 1M 内统一价格。你的 prompt 能正常运行,但账单会变。
  3. **延迟和限流。**百炼正在逐步降低下线模型的限流阈值,在老模型上跑出来的延迟基线没有参考价值。

第五步:上线并监控(第14–27天)

将更新后的模型 ID 和 base URL 推到生产环境,然后做三件事。

  • 关注错误率。如果百炼在最后几周进一步收紧下线模型的 QPM/TPM,你的老接口可能在10月10日之前就开始返回 429。
  • 对模型 ID 字符串设告警。部署之后如果还有服务引用了下线模型,要在硬停之前发现。
  • 如果你使用 TheRouter,可以配置模型 fallback,从下线的 ID 自动切换到替代模型。TheRouter 通过配置的 provider 路由 OpenAI 兼容请求,在产品路径支持的情况下提供 provider/model 路由和 fallback。

QPM/TPM 限流已经在进行

百炼从每份公告发布之日起就开始降低下线模型的限流阈值。最早的公告(#118177)发布于2026年4月13日,那些模型的 QPM 和 TPM 已经持续收缩了五个月。如果你之前申请过扩容,额度会先恢复到默认值,然后继续降低(下线机制说明,2026-09-13 检索)。

如果你在下线模型上观察到 429 响应增多或吞吐量下降,就是限流在起作用。从现在到10月10日,只会更严格。

10月10日 00:00 CST 会发生什么

  • **模型推理停止。**对下线模型 ID 的 API 调用将直接失败。没有 fallback,没有降级输出。
  • 基于下线基座模型的微调模型如果已经部署可能仍可使用,但无法基于已下线的基座创建新的微调。
  • 控制台和文档中与下线模型相关的功能会同步下线。
  • **没有延期机制。**百炼的下线截止日期曾经有过延期先例(原定9月8日的 Qwen3 截止日被推迟到10月10日),但押注再次延期是赌博行为。

相关迁移资源

需要完整的逐模型替换映射、定价分析和前后代码对比,请看我们的2026年10月 DashScope 全量迁移指南。

Qwen3 到 Qwen3.7 的升级路径,请看Qwen3 到 Qwen3.7 升级指南。

DashScope 各轮下线的完整时间线,请看DashScope 模型生命周期汇总。


数据来源均为官方文档,包括 阿里云模型下线机制说明(2026-09-13 检索),模型定价(2026-09-13 检索),公告 #118344、#118177、#118345、#118434、#118331、#118332。

帮助与联系