GPT-5.6 Sol、Terra 与 Luna:OpenAI 三层模型家族的路由策略
OpenAI 以三个独立层级发布了 GPT-5.6 预览版——Sol、Terra 和 Luna。对路由运营商而言,关键变化是 Terra:以 GPT-5.5 同等性能实现半价。以下是正式上线前更新路由策略的完整指南。

2026 年 6 月 26 日,OpenAI 开启了 GPT-5.6 的有限预览——不是单一模型,而是三层家族:Sol(旗舰)、Terra(均衡)和 Luna(快速低成本)。预览仅限于约 20 家与美国政府协调后参与的可信合作伙伴,正式面向所有用户开放预计在"未来数周"内完成。
即便在模型正式上线前,路由影响已经很明确:工程团队现在需要围绕三个新模型 ID 提前规划路由策略,新的定价结构改变了中间层的成本逻辑,而两种新推理模式——max 和 ultra——也将影响 agentic 任务的每任务成本核算方式。
发生了什么
OpenAI 在 GPT-5.6 家族下推出了三款模型:
- GPT-5.6 Sol — 旗舰层。定价与 GPT-5.5 相同(每百万 token 输入 $5 / 输出 $30),上下文窗口扩展至 1.5M token(GPT-5.5 Pro 为 1.05M),在 agentic 编码基准 Terminal-Bench 2.1 上位列家族第一。Sol 支持三种运行模式:标准模式、
max(更深的单模型推理)和ultra(并行子代理编排)。 - GPT-5.6 Terra — 均衡层。定价每百万 token 输入 $2.50 / 输出 $15——以 GPT-5.5 一半的价格提供相当的能力。这是最核心的路由信号:Terra 被定位为此前默认使用 GPT-5.5 的任务的新成本高效默认选项。
- GPT-5.6 Luna — 快速低成本层。定价每百万 token 输入 $1 / 输出 $6,面向高吞吐量、低复杂度的工作负载。
OpenAI 在预览材料中尚未公布确切的 API 模型 ID 字符串。参照 GPT-5.5 的命名惯例,正式上线后预计对应 gpt-5.6-sol、gpt-5.6-terra 和 gpt-5.6-luna。
目前的有限预览仅限 API 访问(尚无 ChatGPT Web 端),仅对少数组织开放。更广泛的可用性受制于美国政府审查流程——OpenAI 承认这种方式"不可持续",并承诺建立更系统化的框架。
对 AI 工程团队意味着什么
最具运营意义的数字是 Terra 的定价:每百万 token $2.50 / $15。如果 Terra 在你的实际工作负载上能够达到 GPT-5.5 的输出质量,这意味着相比 GPT-5.5($5 / $30)直接降低 50% 的输入成本。对已将 GPT-5.5 作为默认推理层的团队而言,Terra 正式上线就是一个计划中的成本削减事件——不是锦上添花,而是需要提前进行路由测试的必选项。
Luna 以 $1 / $6 的定价成为标准 API 中最低成本的 OpenAI 模型,与 GPT-4.1-nano 或 GPT-5.4-mini 直接竞争,适用于高吞吐量的分类、提取和摘要工作负载。
Sol 的上下文窗口扩展至 1.5M token,对运行长时间编码 agent、法律文档审查或大型代码库重构的团队至关重要——此前受上下文限制不得不分块处理或多轮转换的场景将得到改善。
Sol 的 ultra 模式——编排并行子代理而非单次模型调用——改变了 agentic 任务的成本核算逻辑。单次 ultra 模式调用可能分裂为多个子代理完成,每个都单独计费。使用 Codex 或自定义编码 agent 流水线的团队需要评估 ultra 的吞吐量收益是否值得承担 token 展开带来的成本。
路由运营商视角
从单一旗舰模型转向三层家族,且 Sol、Terra、Luna 将各自独立演进——这是路由策略设计方式的结构性变化。
现在就需要规划的三条路由通道:
-
Sol 通道 — 最高能力任务:长时间 agentic 编码、安全研究、生物/基因组分析、多轮复杂推理。以 $5 / $30 的定价,成本结构与 GPT-5.5 相同。若当前路由将
gpt-5.5作为旗舰层目标,gpt-5.6-sol是自然接班者。 -
Terra 通道 — 新的成本高效标准:日常编码辅助、文档摘要、多步骤业务逻辑推理、无需前沿能力的 agentic 任务。以 GPT-5.5 一半的价格提供同等定位能力,Terra 是多数生产工作负载中最具商业价值的层级。制定路由规则,在正式上线时将非前沿任务导向
gpt-5.6-terra。 -
Luna 通道 — 高吞吐量、低复杂度:分类、提取、短摘要、意图解析、结构化输出生成。以 $1 / $6 的定价,Luna 作为 Terra 的降级 fallback,适合对质量要求宽松的大量请求。
有限预览期间的 fallback 链: 在正式上线前,gpt-5.6-* 系列模型 ID 对多数 API Key 仍会返回错误。路由配置中应将 GPT-5.6 ID 上的 404/model-not-found 响应视为上线就绪信号,而非永久性错误。当前生产路由仍以 GPT-5.5 为活跃默认值;在预发布环境中添加 GPT-5.6 各层配置,一旦你的组织获得访问权限即可立即对 Terra 进行路由测试。
Ultra 模式与子代理成本归因: 若路由 Codex 或任何将运行 ultra 模式的编码 agent,请确保成本核算管道能将展开的子代理完成归因回父任务。单次 ultra 模式请求并非单个 completion 事件——它在共享父级下产生多个子代理 token。检查成本追踪中间件是否将这些折叠为单行,或能正确处理子 completion 归因。
别名策略: 参照 GPT-5.5 的先例,gpt-5.6(不带层级后缀)预计将解析为 Sol。不要在成本敏感的生产工作负载中依赖裸别名——API 开放后请明确固定为 gpt-5.6-terra 或 gpt-5.6-luna。
需要持续关注的事项
- 正式上线公告。 正式上线为 6 月 26 日起"数周内"——关注 OpenAI API 更新日志 获取确切模型 ID 字符串和定价确认。
- Terra 在实际工作负载上的质量验证。 OpenAI 将 Terra 定位为 GPT-5.5 同等能力,这是厂商声明,而非针对你特定任务分布的基准验证。访问权限开放后,立即将 5-10% 的预发布流量路由到 Terra,并在全面迁移前与当前 GPT-5.5 基线进行输出质量对比。
- Luna 与现有 mini 层模型的对比。 以 $1 / $6 的定价,Luna 进入了与 GPT-4.1-nano 和 GPT-5.4-mini 竞争的拥挤赛道。在将 Luna 视为自动替代品之前,先在你的高吞吐量分类或提取工作负载上与当前 mini 层模型进行基准对比。
- Sol Ultra 计费行为。 在生产环境启用 ultra 模式之前,向 OpenAI 确认 ultra 模式下的 completion 是按单次 Sol completion 计费,还是按独立子代理 completion 分别计费。
对于 TheRouter 用户,当前按名称指向 gpt-5.5 的路由规则在过渡期间将继续有效。一旦 GPT-5.6 ID 在 API 中正式上线,更新 provider 模型列表并定义层级专属路由规则——成本优化通道使用 Terra,能力优先通道使用 Sol。
相关阅读
AI 路由新闻与供应商动态 →
GPT-5.6 Sol 提示注入防御能力:GPT-Red 基准测试对你的路由策略意味着什么
OpenAI 的 GPT-Red 对抗训练器让 GPT-5.6 Sol 对提示注入的抵抗力比此前最优模型提高了 6 倍。对于运行会接触邮件、网页或第三方工具调用的 Agent 流水线的 operator 而言,这一差距现在已成为路由决策依据。

GPT-5.6 正式发布:Programmatic Tool Calling 将工具编排逻辑内置于模型——运营商必须更新的配置清单
GPT-5.6 Sol、Terra 和 Luna 正式上线,定价确认。Responses API 新增 Programmatic Tool Calling 功能,将工具调度逻辑移入模型内部,绕过网关层的工具编排路径,AI 路由团队需立即审查架构影响。

OpenAI Prompt Cache Diagnostics 正式发布:网关层不能随意丢弃的字段
OpenAI 的 Prompt Cache Diagnostics 工具在 Responses API 正式发布,新增 comparison_response_id 和 reason 字段用于定位缓存未命中原因。若网关层剥离 prompt_cache_options,诊断信号会静默丢失。