← 全部文章

OpenAI 2026 年 10 月模型下线迁移指南:GPT-5.4-Cyber、GPT-3.5、GPT-4 及 O1 停服时间表

OpenAI 将于 10 月 1 日关闭 gpt-5.4-cyber,10 月 23 日停用 gpt-3.5-turbo、gpt-4、gpt-4-turbo 和 o1 快照。本文覆盖所有受影响模型的替代映射、代码改动、价格变化、Azure Foundry 退役进度以及面向路由团队的生产迁移清单。

· TheRouter

OpenAI 2026 年 10 月模型下线迁移指南

2026 年 10 月对 OpenAI API 用户来说有两波停服。10 月 1 日,专用安全模型 gpt-5.4-cyber 下线。10 月 23 日,一批遗留模型集中退役,包括 gpt-3.5-turbo-0125、gpt-4-0613、gpt-4-turbo-2024-04-09 和 o1-2024-12-17。如果你的代码里还固定写着这些 model ID,现在留给你的时间是按天算的,不是按月算的。

本文给出每个受影响模型的精确替代映射、改动前后代码对比、价格差异分析、Azure Foundry 退役背景,以及一份可以直接执行的生产迁移清单。同时说明 TheRouter 的 fallback 路由如何在停服窗口内自动接管流量,让应用不中断。

我们通过配置好的 provider 来路由 OpenAI 兼容请求,并在产品路径支持的前提下提供 provider/model 级别的路由与 fallback。我们不承诺支持所有模型、零停机或最低价格。下文所有日期与价格均来自检索时的 OpenAI 官方文档。

OpenAI 兼容指供应商提供一个 chat-completions 接口,其请求与响应结构与 OpenAI API 契约足够接近——只需替换三个值(API key、base URL、模型名),原来的 OpenAI SDK 调用即可直接工作。最小实践面是POST /v1/chat/completions 带 messages、model, 并返回 OpenAI 形式的流式响应。

30 秒速览

  • 10 月 1 日,gpt-5.4-cyber 停服,替代品是 gpt-5.6-cyber(需要 Daybreak Red 权限)(OpenAI Deprecations,检索时间 2026-09-18)。
  • 10 月 23 日,gpt-3.5-turbo-0125、gpt-4-0613、gpt-4-turbo-2024-04-09、o1-2024-12-17 停服(OpenAI Deprecations,检索时间 2026-09-18)。
  • 推荐替代,GPT-5.6 家族,Sol 承接旗舰,Terra 承接中端,Luna 承接轻量任务。
  • 现在就该做的事,排查 model ID、影子测试替代模型、配置 fallback 路由。10 月 1 日的截止日离我们只有 13 天。

完整时间表

第一波,10 月 1 日 GPT-5.4-Cyber 停服

下线模型停服日期替代模型访问方式
gpt-5.4-cyber2026-10-01gpt-5.6-cyber仅限 Daybreak Red

GPT-5.4-Cyber 是 OpenAI 于 2026 年 4 月在 Daybreak 计划中推出的首个专训安全模型。后继者 GPT-5.6-Cyber 于 2026 年 8 月 10 日发布,基于 Sol 架构,在 OpenAI 内部高阶安全评测中的完成率从 GPT-5.5-Cyber 的 57.3% 跳到了 95%(OpenAI Daybreak 公告,检索时间 2026-09-18)。

GPT-5.6-Cyber 需要审批才能使用,没有公开的 API model ID。申请 Daybreak Red 需要完成身份验证、签署许可用途限制,并从 2026 年 9 月 1 日起在账户上绑定硬件安全密钥。不在 Daybreak Red 名单中的团队应使用标准的 gpt-5.6-sol,它在公开 CTF 基准上得分 96.7%,在 ExploitBench 上得分 73.5%,不需要任何 Daybreak 权限(eesel.ai GPT-5.6-Cyber 解读,检索时间 2026-09-18)。

第二波,10 月 23 日遗留模型集中退役

下线模型停服日期替代模型类别
gpt-3.5-turbo-01252026-10-23gpt-5.6-terra遗留对话
gpt-4-06132026-10-23gpt-5.6-sol遗留旗舰
gpt-4-turbo-2024-04-092026-10-23gpt-5.6-sol遗留 turbo
o1-2024-12-172026-10-23gpt-5.6-sol早期推理

这一波移除的是 GPT-3.5、GPT-4 以及初代 O1 推理模型的最后一批带日期快照。OpenAI 于 2026 年 4 月 22 日宣布了这些退役计划,按 GA 模型标准提供了 6 个月的提前通知窗口(OpenAI 社区论坛,检索时间 2026-09-18)。

10 月 23 日之后,如果不带日期的 gpt-3.5-turbo 别名仍然指向被退役的 0125 快照,它也会停止工作。务必在截止日前确认你使用的别名实际指向哪个快照。

逐模型迁移路径

GPT-3.5-Turbo 迁移到 GPT-5.6-Terra

GPT-5.6-Terra 是 GPT-5.6 家族的中端模型。对于此前用 GPT-3.5-Turbo 压低成本的场景,Terra 在能力上是大幅升级,但价格也更高。

指标gpt-3.5-turbo-0125gpt-5.6-terra
输入价格(每百万 token)$0.50$2.00
输出价格(每百万 token)$1.50$12.00
缓存输入价格不支持$0.20
Batch 输入价格不支持$1.00
Batch 输出价格不支持$6.00

标准价涨幅很明显,输入 4 倍,输出 8 倍。两种策略可以缓解影响。第一,GPT-5.6-Terra 支持 prompt caching,缓存输入价格 $0.20/百万 token,比非缓存输入便宜 90%。如果你的场景有大量重复前缀,caching 能显著拉平涨幅。第二,batch 处理可以把单价砍一半,适合对延迟不敏感的批量任务(OpenAI Pricing,检索时间 2026-09-18)。

如果你的场景对成本极其敏感,GPT-3.5-Turbo 级别的能力就够用了,可以考虑 gpt-5.6-luna($0.20/$1.20 每百万 token)。Luna 的价格接近老 GPT-3.5 的水平,同时具备 GPT-5.6 级别的能力。

GPT-4 和 GPT-4-Turbo 迁移到 GPT-5.6-Sol

gpt-4-0613 和 gpt-4-turbo-2024-04-09 都映射到 gpt-5.6-sol,也就是旗舰级别。

指标gpt-4-0613gpt-4-turbogpt-5.6-sol
输入价格(每百万 token)$30.00$10.00$4.00
输出价格(每百万 token)$60.00$30.00$20.00
缓存输入价格不支持不支持$0.40

从 GPT-4 (0613) 迁移到 Sol,输入降 87%,输出降 67%。从 GPT-4-Turbo 迁移,输入降 60%,输出降 33%。这是少见的替代模型既更强又更便宜的情况(OpenAI Pricing,检索时间 2026-09-18)。

O1 迁移到 GPT-5.6-Sol

o1-2024-12-17 推理模型映射到 gpt-5.6-sol。OpenAI 在 GPT-5.6 家族中把推理能力和通用模型统一了,O 系列命名方式不会用于新发布。

指标o1-2024-12-17gpt-5.6-sol
输入价格(每百万 token)$15.00$4.00
输出价格(每百万 token)$60.00$20.00

Sol 通过 reasoning.mode 参数来控制推理深度,而不是用一个单独的模型系列。如果你的场景依赖 O1 的扩展推理能力,使用 gpt-5.6-sol 并设置 reasoning.mode: "pro" 可以获得相当的推理深度。

代码改动示例

Python SDK

改动前,固定使用旧模型

from openai import OpenAI

client = OpenAI()

# 遗留 GPT-4 调用
response = client.chat.completions.create(
    model="gpt-4-turbo-2024-04-09",  # 10 月 23 日停服
    messages=[{"role": "user", "content": "分析这份漏洞报告"}]
)

改动后,迁移到替代模型

from openai import OpenAI

client = OpenAI()

# 迁移到 GPT-5.6-Sol
response = client.chat.completions.create(
    model="gpt-5.6-sol",  # 推荐替代
    messages=[{"role": "user", "content": "分析这份漏洞报告"}]
)

Node.js / TypeScript

改动前

const response = await openai.chat.completions.create({
  model: "gpt-3.5-turbo-0125",  // 10 月 23 日停服
  messages: [{ role: "user", content: "总结这份文档" }],
});

改动后

const response = await openai.chat.completions.create({
  model: "gpt-5.6-terra",  // 性价比替代
  messages: [{ role: "user", content: "总结这份文档" }],
});

cURL

改动前

curl https://api.openai.com/v1/chat/completions \
  -H "Authorization: Bearer $OPENAI_API_KEY" \
  -d '{"model": "o1-2024-12-17", "messages": [{"role": "user", "content": "逐步解决这个问题"}]}'

改动后

curl https://api.openai.com/v1/chat/completions \
  -H "Authorization: Bearer $OPENAI_API_KEY" \
  -d '{"model": "gpt-5.6-sol", "messages": [{"role": "user", "content": "逐步解决这个问题"}]}'

Azure Foundry 退役进度

Azure Foundry(前身 Azure OpenAI Service)有自己独立的退役时间表,通常比 OpenAI 直连 API 晚几个月。微软的模型退役周期是从 GA 部署起算 18 个月。

Azure 用户需要注意几件事。

GPT-4 和 GPT-4-Turbo 在 Azure 上的退役日期可能和 OpenAI API 10 月 23 日的日期不同。请查阅 Azure Foundry 模型退役时间表 确认你所在区域的具体日期。

Azure 在 2026 年 3 月 31 日已经退役了部分 GPT-4o 版本(2024-05-13 和 2024-08-06 快照)(Microsoft Learn,检索时间 2026-09-18)。

基于已退役基础模型的 fine-tuned 部署会继续运行到基础模型完全退役为止,但不能再创建新的 fine-tuning 任务。

如果你同时使用 Azure 和 OpenAI 直连 API,需要分别审计两个环境。一个在 Azure 上还能用的模型可能在直连 API 已经下线了,反过来也一样。

TheRouter Fallback 路由配置

TheRouter 的模型 fallback 路由可以配置自动重定向,当被退役的 model ID 开始返回错误时,流量自动切到替代模型,不需要改代码。

下面是 10 月 23 日退役波次的 fallback 配置示例。

# therouter.yaml — 2026 年 10 月退役的 fallback 规则
routes:
  - match:
      model: "gpt-3.5-turbo-0125"
    fallback:
      - model: "gpt-5.6-luna"    # 成本优先替代
      - model: "gpt-5.6-terra"   # 能力升级备选

  - match:
      model: "gpt-4-0613"
    fallback:
      - model: "gpt-5.6-sol"

  - match:
      model: "gpt-4-turbo-2024-04-09"
    fallback:
      - model: "gpt-5.6-sol"

  - match:
      model: "o1-2024-12-17"
    fallback:
      - model: "gpt-5.6-sol"

在 10 月 1 日之前部署,以覆盖 GPT-5.4-Cyber 停服;在 10 月 23 日之前确保遗留模型的规则也已就位。

更多 fallback 配置细节见 LLM API fallback 路由指南。

2026 年下半年跨 provider 退役全景

10 月只是 2026 年多波退役中的一段。了解完整时间线有助于提前规划容量、避免意外中断。

Provider停服日期受影响模型指南
OpenAI2026-10-01gpt-5.4-cyber本文
OpenAI2026-10-23GPT-3.5、GPT-4、O1 快照本文
DashScope2026-10-1030+ Qwen、DeepSeek、GLM 模型DashScope 10 月停服指南
OpenAI2026-12-11GPT-5 和 O3 快照GPT-5 退役指南
Anthropic持续进行Claude 3.x 系列Anthropic 退役节奏指南

生产迁移清单

  1. 替换三个值,不是三个 SDK。在现有 OpenAI 客户端里改 api_key、base_url、model。请求与响应代码保持不变。
  2. 显式映射 model ID。目标供应商的 model id 几乎不会和 OpenAI 完全一致。 在业务代码之外维护一份 { openai_id: target_id } 映射。
  3. 验证流式格式。SSE 分片必须遵循 OpenAI 的 data: {...} + data: [DONE] 契约。切生产前先跑一次流式调用。
  4. 检查限流响应头。部分供应商不返回 x-ratelimit-*。 在包装层 做缺省兜底,缺头不要崩。
  5. 留回滚路径。用 feature flag 切流;新旧 endpoint 影子并行 24 小时,再正式切换。

10 月专项步骤

  1. 排查 model ID。搜索代码库、环境变量、配置文件中的 gpt-5.4-cyber、gpt-3.5-turbo-0125、gpt-3.5-turbo、gpt-4-0613、gpt-4、gpt-4-turbo-2024-04-09、gpt-4-turbo、o1-2024-12-17。第三方库和 workflow 工具中写死的 model ID 也要查。

  2. 确认别名指向。gpt-3.5-turbo、gpt-4、gpt-4-turbo 这些不带日期的别名可能指向正在退役的快照。调用 /v1/models 接口确认你当前使用的别名实际解析到哪个快照。

  3. 影子测试。把你的评测集同时跑 gpt-5.6-sol 和 gpt-5.6-terra,与当前模型做并行对比,看输出质量、延迟和成本三个维度。

  4. 配置 fallback 路由。部署上文的 TheRouter fallback 规则作为安全网。即使你已经在代码中更新了 model ID,fallback 路由仍然能兜住遗漏的引用。

  5. 监控网关日志。部署后盯着日志看,还有没有请求在打已退役的 model ID。这些请求说明代码库或第三方集成中还有漏网之鱼。

  6. Azure 单独审计。如果你用 Azure Foundry,单独查微软的退役时间表。不要假设 OpenAI API 的日期适用于 Azure 部署。

  7. 测试错误处理。停服之后,发往已退役模型的请求会返回 HTTP 400 或 404 错误。确认你的应用能够优雅地处理这些错误,并给出有用的提示信息。

常见问题

10 月 23 日之后,不带日期的 gpt-4 别名还能用吗?

不带日期的 gpt-4 别名目前解析到 gpt-4-0613 快照,而这个快照 10 月 23 日就要停服。停服之后,OpenAI 可能会把别名重定向到更新的模型,也可能直接移除别名。不要在退役窗口期间依赖别名的稳定性,直接写替代模型的 ID。

我用 GPT-3.5-Turbo 跑大批量低成本任务,最便宜的替代是什么?

gpt-5.6-luna,$0.20/$1.20 每百万 input/output token,是与 GPT-3.5-Turbo 的 $0.50/$1.50 最接近的价位。Luna 的能力比 GPT-3.5 强不少,同时价格在同一数量级。批量场景下,Luna 的 batch 价格还能再降到 $0.10/$0.60。

gpt-5.6-cyber 能通过标准 OpenAI API 使用吗?

不能。GPT-5.6-Cyber 仅限 Daybreak Red 计划内的审批用户使用。你需要申请、通过身份验证、签署许可用途限制,并在账户上绑定硬件安全密钥。一般安全工作可以用 Daybreak Blue(标准 Sol 去掉系统级安全限制)或无需任何 Daybreak 权限的标准 Sol。

向已停服模型发请求会怎样?

API 返回 HTTP 400 或 404 错误,告诉你这个模型不存在或已经退役。请求不会返回任何内容,立刻失败。


本文引用来源均于 2026 年 9 月 18 日检索。OpenAI 可能在发布后更新退役日期、价格或替代建议。做生产变更前务必核实 OpenAI 官方退役页面。

帮助与联系