OpenAI 将于12月11日停用 gpt-5 和 o3 快照版本:路由团队必须现在开始审查
OpenAI 已弃用六个初代 gpt-5 和 o3 模型快照,全部将于2026年12月11日停止服务。仍在路由策略中使用带日期 model ID 的团队有六个月时间迁移——完整审查清单在此。

OpenAI 最早一批 gpt-5 和 o3 模型快照将于2026年12月11日停止响应 API 请求。如果你的路由策略中仍引用这些带日期的 model ID,距离硬性截止日期只剩六个月——这不是一个"可选的迁移建议"。
OpenAI 弃用了哪些模型
2026年6月11日,OpenAI 通知开发者以下模型将被停用:
| Model ID | 停用日期 | 推荐替代 |
|---|---|---|
gpt-5-2025-08-07 | 2026-12-11 | gpt-5.5 |
gpt-5-mini-2025-08-07 | 2026-12-11 | gpt-5.4-mini |
gpt-5-nano-2025-08-07 | 2026-12-11 | gpt-5.4-nano |
gpt-5-pro-2025-10-06 | 2026-12-11 | gpt-5.5-pro |
o3-2025-04-16 | 2026-12-11 | gpt-5.5 |
o3-pro-2025-06-10 | 2026-12-11 | gpt-5.5-pro |
这是 OpenAI 2026年第二波重大弃用。第一波发生在五月底,主要清退 gpt-4、o1、o4-mini 等旧时代模型。这一波不同:它停用的是 gpt-5 系列的初始公开快照以及两个 o3 变体版本。当年出于行为锁定考虑而显式 pin 到带日期 ID 的团队,现在需要重新验证并迁移。
为什么这次比五月那波更需要关注
五月那波弃用的是已落后几代的旧模型,多数工程团队早已迁移或有计划在手。
这次在运维上更紧迫,原因有两点:
第一,o3 → gpt-5.5 不是直接替换。 OpenAI 将 o3-2025-04-16 和 o3-pro-2025-06-10 都映射到 gpt-5.5 / gpt-5.5-pro。但 gpt-5.5 是 chat-completion 模型,而 o3 是具有独立思维范式的 reasoning 模型。依赖 o3 结构化推理输出、系统提示行为或扩展上下文能力的团队,需要认真评估 gpt-5.5 开启 Thinking 模式后能否产生同等或更好的效果。
第二,gpt-5-pro 快照 → gpt-5.5-pro 意味着能力层级变化。 如果你的路由策略将高风险任务定向到 gpt-5-pro-2025-10-06,在12月切换前必须先验证 gpt-5.5-pro 在你的评测集上表现达标。
路由团队审查清单
在12月11日之前,路由团队应当:
-
在路由配置中搜索带日期的 model ID。 任何对
gpt-5-2025、gpt-5-mini-2025、gpt-5-nano-2025、gpt-5-pro-2025、o3-2025或o3-pro-2025的引用都是迁移目标。 -
区分快照 pin 和 fallback 链。 如果你将带日期 ID 用作 fallback target(例如 gpt-5.5 过载时回退到
gpt-5-2025-08-07),你的 fallback 链会在12月11日当天断掉。将 fallback target 更新为推荐替代版本。 -
针对 o3 → gpt-5.5 的替换运行 provider 能力测试。 reasoning 范式的迁移意味着必须做行为验证,而不仅仅是延迟/成本 benchmark。在最高风险的 agent 和代码任务上进行测试。
-
检查下游缓存和 prompt 模板。 一些团队会缓存与特定模型对应的 prompt 格式或系统指令。gpt-5.5 的 tokenizer 和指令遵循行为与 o3 有足够差异,需要系统性地复查 prompt。
-
重新核算 API 成本预测。
gpt-5.5和gpt-5.5-pro的定价与其 o3 前身不同。如果你的计费模型基于历史 o3 费率,在迁移完成前需要用 gpt-5.5 定价重新预估。 -
设定迁移里程碑。 六个月听起来宽裕,但会穿越 Q3 暑期放缓期和年末假日季。建议节奏:8月前完成验证,10月前上线 staging 路由,11月前完成生产切换,12月作为缓冲期。
gpt-5 系列迁移要注意什么
对于仍在使用 gpt-5-2025-08-07 或 gpt-5-mini-2025-08-07 的团队,迁移到 gpt-5.5 或 gpt-5.4-mini 相对接近直接替换——同样的 chat-completions API,同样的参数集。主要风险在于:
- 指令遵循的细微差异。 gpt-5 系列的后续快照对针对2025年8月版本调优的系统提示响应有所不同。在正式提交前,用你现有的评测集跑一遍目标模型。
- 延迟特征变化。
gpt-5.5的 p50/p99 延迟特征可能不同。如果你有延迟敏感的路由规则(例如超过2秒预算时切到 gpt-5.4-mini),需要重新校准阈值。
TheRouter 用户应当关注什么
通过 gateway 路由到 OpenAI 的团队,应审查每一条引用了上述六个弃用 ID 的命名模型配置、路由规则和 fallback 链。将目标 model 字段更新为推荐替代版本,并在 staging 路由中验证后再推进到生产环境。对于 o3→gpt-5.5 的迁移,在切换前运行一次 Thinking 模式对比评测是值得的——行为契约的变化程度足以让仅靠非正式冒烟测试作为依据成为一种风险。
对于跨多个 provider 或模型层级的迁移,在8月前完成一次统一审查——列出所有被 pin 的 model ID、其弃用状态以及计划替代方案——是对路由策略健康度的重要检查。
本文涉及的模型
相关阅读
AI 路由新闻与供应商动态 →
OpenAI 将于 2027 年 1 月下线九个 Audio 和 Realtime 模型 ID:运营商必须完成的迁移
OpenAI 于 7 月 20 日弃用九个遗留 audio、realtime 和 transcription 模型 ID,将于 2027 年 1 月 20 日下线。大多数情况下,迁移只需替换模型字符串,但路由 gpt-4o-audio、gpt-4o-realtime 和 gpt-audio 系列流量的运营商需要完成审计清单。

OpenAI 的「每美元有效智能」评分框架:每位 AI 网关运营者需要的路由策略清单
OpenAI 发布了一套四维评估框架——「每美元有效智能(Useful Intelligence per Dollar)」,将模型评估从每 token 成本重构为每次成功任务成本。以下是每位路由运营者今天需要做出的改变。

GPT-Live 语音 API 路由:全双工语音把委派策略变成新的控制点
GPT-Live 语音 API 路由正在成为新的运营决策:OpenAI 将全双工语音、后台模型委派和实时安全控制推向开发者场景。