OpenAI 2026 年 10 月模型下线迁移指南:GPT-5.4-Cyber、GPT-3.5、GPT-4 及 O1 停服时间表
OpenAI 将于 10 月 1 日关闭 gpt-5.4-cyber,10 月 23 日停用 gpt-3.5-turbo、gpt-4、gpt-4-turbo 和 o1 快照。本文覆盖所有受影响模型的替代映射、代码改动、价格变化、Azure Foundry 退役进度以及面向路由团队的生产迁移清单。
OpenAI 2026 年 10 月模型下线迁移指南
2026 年 10 月对 OpenAI API 用户来说有两波停服。10 月 1 日,专用安全模型 gpt-5.4-cyber 下线。10 月 23 日,一批遗留模型集中退役,包括 gpt-3.5-turbo-0125、gpt-4-0613、gpt-4-turbo-2024-04-09 和 o1-2024-12-17。如果你的代码里还固定写着这些 model ID,现在留给你的时间是按天算的,不是按月算的。
本文给出每个受影响模型的精确替代映射、改动前后代码对比、价格差异分析、Azure Foundry 退役背景,以及一份可以直接执行的生产迁移清单。同时说明 TheRouter 的 fallback 路由如何在停服窗口内自动接管流量,让应用不中断。
我们通过配置好的 provider 来路由 OpenAI 兼容请求,并在产品路径支持的前提下提供 provider/model 级别的路由与 fallback。我们不承诺支持所有模型、零停机或最低价格。下文所有日期与价格均来自检索时的 OpenAI 官方文档。
OpenAI 兼容指供应商提供一个 chat-completions 接口,其请求与响应结构与 OpenAI API 契约足够接近——只需替换三个值(API key、base URL、模型名),原来的 OpenAI SDK 调用即可直接工作。最小实践面是POST /v1/chat/completions 带 messages、model, 并返回 OpenAI 形式的流式响应。
30 秒速览
- 10 月 1 日,
gpt-5.4-cyber停服,替代品是gpt-5.6-cyber(需要 Daybreak Red 权限)(OpenAI Deprecations,检索时间 2026-09-18)。 - 10 月 23 日,
gpt-3.5-turbo-0125、gpt-4-0613、gpt-4-turbo-2024-04-09、o1-2024-12-17停服(OpenAI Deprecations,检索时间 2026-09-18)。 - 推荐替代,GPT-5.6 家族,Sol 承接旗舰,Terra 承接中端,Luna 承接轻量任务。
- 现在就该做的事,排查 model ID、影子测试替代模型、配置 fallback 路由。10 月 1 日的截止日离我们只有 13 天。
完整时间表
第一波,10 月 1 日 GPT-5.4-Cyber 停服
| 下线模型 | 停服日期 | 替代模型 | 访问方式 |
|---|---|---|---|
gpt-5.4-cyber | 2026-10-01 | gpt-5.6-cyber | 仅限 Daybreak Red |
GPT-5.4-Cyber 是 OpenAI 于 2026 年 4 月在 Daybreak 计划中推出的首个专训安全模型。后继者 GPT-5.6-Cyber 于 2026 年 8 月 10 日发布,基于 Sol 架构,在 OpenAI 内部高阶安全评测中的完成率从 GPT-5.5-Cyber 的 57.3% 跳到了 95%(OpenAI Daybreak 公告,检索时间 2026-09-18)。
GPT-5.6-Cyber 需要审批才能使用,没有公开的 API model ID。申请 Daybreak Red 需要完成身份验证、签署许可用途限制,并从 2026 年 9 月 1 日起在账户上绑定硬件安全密钥。不在 Daybreak Red 名单中的团队应使用标准的 gpt-5.6-sol,它在公开 CTF 基准上得分 96.7%,在 ExploitBench 上得分 73.5%,不需要任何 Daybreak 权限(eesel.ai GPT-5.6-Cyber 解读,检索时间 2026-09-18)。
第二波,10 月 23 日遗留模型集中退役
| 下线模型 | 停服日期 | 替代模型 | 类别 |
|---|---|---|---|
gpt-3.5-turbo-0125 | 2026-10-23 | gpt-5.6-terra | 遗留对话 |
gpt-4-0613 | 2026-10-23 | gpt-5.6-sol | 遗留旗舰 |
gpt-4-turbo-2024-04-09 | 2026-10-23 | gpt-5.6-sol | 遗留 turbo |
o1-2024-12-17 | 2026-10-23 | gpt-5.6-sol | 早期推理 |
这一波移除的是 GPT-3.5、GPT-4 以及初代 O1 推理模型的最后一批带日期快照。OpenAI 于 2026 年 4 月 22 日宣布了这些退役计划,按 GA 模型标准提供了 6 个月的提前通知窗口(OpenAI 社区论坛,检索时间 2026-09-18)。
10 月 23 日之后,如果不带日期的 gpt-3.5-turbo 别名仍然指向被退役的 0125 快照,它也会停止工作。务必在截止日前确认你使用的别名实际指向哪个快照。
逐模型迁移路径
GPT-3.5-Turbo 迁移到 GPT-5.6-Terra
GPT-5.6-Terra 是 GPT-5.6 家族的中端模型。对于此前用 GPT-3.5-Turbo 压低成本的场景,Terra 在能力上是大幅升级,但价格也更高。
| 指标 | gpt-3.5-turbo-0125 | gpt-5.6-terra |
|---|---|---|
| 输入价格(每百万 token) | $0.50 | $2.00 |
| 输出价格(每百万 token) | $1.50 | $12.00 |
| 缓存输入价格 | 不支持 | $0.20 |
| Batch 输入价格 | 不支持 | $1.00 |
| Batch 输出价格 | 不支持 | $6.00 |
标准价涨幅很明显,输入 4 倍,输出 8 倍。两种策略可以缓解影响。第一,GPT-5.6-Terra 支持 prompt caching,缓存输入价格 $0.20/百万 token,比非缓存输入便宜 90%。如果你的场景有大量重复前缀,caching 能显著拉平涨幅。第二,batch 处理可以把单价砍一半,适合对延迟不敏感的批量任务(OpenAI Pricing,检索时间 2026-09-18)。
如果你的场景对成本极其敏感,GPT-3.5-Turbo 级别的能力就够用了,可以考虑 gpt-5.6-luna($0.20/$1.20 每百万 token)。Luna 的价格接近老 GPT-3.5 的水平,同时具备 GPT-5.6 级别的能力。
GPT-4 和 GPT-4-Turbo 迁移到 GPT-5.6-Sol
gpt-4-0613 和 gpt-4-turbo-2024-04-09 都映射到 gpt-5.6-sol,也就是旗舰级别。
| 指标 | gpt-4-0613 | gpt-4-turbo | gpt-5.6-sol |
|---|---|---|---|
| 输入价格(每百万 token) | $30.00 | $10.00 | $4.00 |
| 输出价格(每百万 token) | $60.00 | $30.00 | $20.00 |
| 缓存输入价格 | 不支持 | 不支持 | $0.40 |
从 GPT-4 (0613) 迁移到 Sol,输入降 87%,输出降 67%。从 GPT-4-Turbo 迁移,输入降 60%,输出降 33%。这是少见的替代模型既更强又更便宜的情况(OpenAI Pricing,检索时间 2026-09-18)。
O1 迁移到 GPT-5.6-Sol
o1-2024-12-17 推理模型映射到 gpt-5.6-sol。OpenAI 在 GPT-5.6 家族中把推理能力和通用模型统一了,O 系列命名方式不会用于新发布。
| 指标 | o1-2024-12-17 | gpt-5.6-sol |
|---|---|---|
| 输入价格(每百万 token) | $15.00 | $4.00 |
| 输出价格(每百万 token) | $60.00 | $20.00 |
Sol 通过 reasoning.mode 参数来控制推理深度,而不是用一个单独的模型系列。如果你的场景依赖 O1 的扩展推理能力,使用 gpt-5.6-sol 并设置 reasoning.mode: "pro" 可以获得相当的推理深度。
代码改动示例
Python SDK
改动前,固定使用旧模型
from openai import OpenAI
client = OpenAI()
# 遗留 GPT-4 调用
response = client.chat.completions.create(
model="gpt-4-turbo-2024-04-09", # 10 月 23 日停服
messages=[{"role": "user", "content": "分析这份漏洞报告"}]
)
改动后,迁移到替代模型
from openai import OpenAI
client = OpenAI()
# 迁移到 GPT-5.6-Sol
response = client.chat.completions.create(
model="gpt-5.6-sol", # 推荐替代
messages=[{"role": "user", "content": "分析这份漏洞报告"}]
)
Node.js / TypeScript
改动前
const response = await openai.chat.completions.create({
model: "gpt-3.5-turbo-0125", // 10 月 23 日停服
messages: [{ role: "user", content: "总结这份文档" }],
});
改动后
const response = await openai.chat.completions.create({
model: "gpt-5.6-terra", // 性价比替代
messages: [{ role: "user", content: "总结这份文档" }],
});
cURL
改动前
curl https://api.openai.com/v1/chat/completions \
-H "Authorization: Bearer $OPENAI_API_KEY" \
-d '{"model": "o1-2024-12-17", "messages": [{"role": "user", "content": "逐步解决这个问题"}]}'
改动后
curl https://api.openai.com/v1/chat/completions \
-H "Authorization: Bearer $OPENAI_API_KEY" \
-d '{"model": "gpt-5.6-sol", "messages": [{"role": "user", "content": "逐步解决这个问题"}]}'
Azure Foundry 退役进度
Azure Foundry(前身 Azure OpenAI Service)有自己独立的退役时间表,通常比 OpenAI 直连 API 晚几个月。微软的模型退役周期是从 GA 部署起算 18 个月。
Azure 用户需要注意几件事。
GPT-4 和 GPT-4-Turbo 在 Azure 上的退役日期可能和 OpenAI API 10 月 23 日的日期不同。请查阅 Azure Foundry 模型退役时间表 确认你所在区域的具体日期。
Azure 在 2026 年 3 月 31 日已经退役了部分 GPT-4o 版本(2024-05-13 和 2024-08-06 快照)(Microsoft Learn,检索时间 2026-09-18)。
基于已退役基础模型的 fine-tuned 部署会继续运行到基础模型完全退役为止,但不能再创建新的 fine-tuning 任务。
如果你同时使用 Azure 和 OpenAI 直连 API,需要分别审计两个环境。一个在 Azure 上还能用的模型可能在直连 API 已经下线了,反过来也一样。
TheRouter Fallback 路由配置
TheRouter 的模型 fallback 路由可以配置自动重定向,当被退役的 model ID 开始返回错误时,流量自动切到替代模型,不需要改代码。
下面是 10 月 23 日退役波次的 fallback 配置示例。
# therouter.yaml — 2026 年 10 月退役的 fallback 规则
routes:
- match:
model: "gpt-3.5-turbo-0125"
fallback:
- model: "gpt-5.6-luna" # 成本优先替代
- model: "gpt-5.6-terra" # 能力升级备选
- match:
model: "gpt-4-0613"
fallback:
- model: "gpt-5.6-sol"
- match:
model: "gpt-4-turbo-2024-04-09"
fallback:
- model: "gpt-5.6-sol"
- match:
model: "o1-2024-12-17"
fallback:
- model: "gpt-5.6-sol"
在 10 月 1 日之前部署,以覆盖 GPT-5.4-Cyber 停服;在 10 月 23 日之前确保遗留模型的规则也已就位。
更多 fallback 配置细节见 LLM API fallback 路由指南。
2026 年下半年跨 provider 退役全景
10 月只是 2026 年多波退役中的一段。了解完整时间线有助于提前规划容量、避免意外中断。
| Provider | 停服日期 | 受影响模型 | 指南 |
|---|---|---|---|
| OpenAI | 2026-10-01 | gpt-5.4-cyber | 本文 |
| OpenAI | 2026-10-23 | GPT-3.5、GPT-4、O1 快照 | 本文 |
| DashScope | 2026-10-10 | 30+ Qwen、DeepSeek、GLM 模型 | DashScope 10 月停服指南 |
| OpenAI | 2026-12-11 | GPT-5 和 O3 快照 | GPT-5 退役指南 |
| Anthropic | 持续进行 | Claude 3.x 系列 | Anthropic 退役节奏指南 |
生产迁移清单
- 替换三个值,不是三个 SDK。在现有 OpenAI 客户端里改
api_key、base_url、model。请求与响应代码保持不变。 - 显式映射 model ID。目标供应商的 model id 几乎不会和 OpenAI 完全一致。 在业务代码之外维护一份
{ openai_id: target_id }映射。 - 验证流式格式。SSE 分片必须遵循 OpenAI 的
data: {...}+data: [DONE]契约。切生产前先跑一次流式调用。 - 检查限流响应头。部分供应商不返回
x-ratelimit-*。 在包装层 做缺省兜底,缺头不要崩。 - 留回滚路径。用 feature flag 切流;新旧 endpoint 影子并行 24 小时,再正式切换。
10 月专项步骤
-
排查 model ID。搜索代码库、环境变量、配置文件中的
gpt-5.4-cyber、gpt-3.5-turbo-0125、gpt-3.5-turbo、gpt-4-0613、gpt-4、gpt-4-turbo-2024-04-09、gpt-4-turbo、o1-2024-12-17。第三方库和 workflow 工具中写死的 model ID 也要查。 -
确认别名指向。
gpt-3.5-turbo、gpt-4、gpt-4-turbo这些不带日期的别名可能指向正在退役的快照。调用/v1/models接口确认你当前使用的别名实际解析到哪个快照。 -
影子测试。把你的评测集同时跑
gpt-5.6-sol和gpt-5.6-terra,与当前模型做并行对比,看输出质量、延迟和成本三个维度。 -
配置 fallback 路由。部署上文的 TheRouter fallback 规则作为安全网。即使你已经在代码中更新了 model ID,fallback 路由仍然能兜住遗漏的引用。
-
监控网关日志。部署后盯着日志看,还有没有请求在打已退役的 model ID。这些请求说明代码库或第三方集成中还有漏网之鱼。
-
Azure 单独审计。如果你用 Azure Foundry,单独查微软的退役时间表。不要假设 OpenAI API 的日期适用于 Azure 部署。
-
测试错误处理。停服之后,发往已退役模型的请求会返回 HTTP 400 或 404 错误。确认你的应用能够优雅地处理这些错误,并给出有用的提示信息。
常见问题
10 月 23 日之后,不带日期的 gpt-4 别名还能用吗?
不带日期的 gpt-4 别名目前解析到 gpt-4-0613 快照,而这个快照 10 月 23 日就要停服。停服之后,OpenAI 可能会把别名重定向到更新的模型,也可能直接移除别名。不要在退役窗口期间依赖别名的稳定性,直接写替代模型的 ID。
我用 GPT-3.5-Turbo 跑大批量低成本任务,最便宜的替代是什么?
gpt-5.6-luna,$0.20/$1.20 每百万 input/output token,是与 GPT-3.5-Turbo 的 $0.50/$1.50 最接近的价位。Luna 的能力比 GPT-3.5 强不少,同时价格在同一数量级。批量场景下,Luna 的 batch 价格还能再降到 $0.10/$0.60。
gpt-5.6-cyber 能通过标准 OpenAI API 使用吗?
不能。GPT-5.6-Cyber 仅限 Daybreak Red 计划内的审批用户使用。你需要申请、通过身份验证、签署许可用途限制,并在账户上绑定硬件安全密钥。一般安全工作可以用 Daybreak Blue(标准 Sol 去掉系统级安全限制)或无需任何 Daybreak 权限的标准 Sol。
向已停服模型发请求会怎样?
API 返回 HTTP 400 或 404 错误,告诉你这个模型不存在或已经退役。请求不会返回任何内容,立刻失败。
本文引用来源均于 2026 年 9 月 18 日检索。OpenAI 可能在发布后更新退役日期、价格或替代建议。做生产变更前务必核实 OpenAI 官方退役页面。