GPT-5.6 Sol, Terra и Luna: политика маршрутизации для трёхуровневого семейства моделей OpenAI
OpenAI представила GPT-5.6 в виде трёх уровней: Sol, Terra и Luna. Ключевое изменение для routing-операторов — Terra: производительность уровня GPT-5.5 вдвое дешевле. Вот как обновить политику маршрутизации до выхода GA.

26 июня 2026 года OpenAI начала ограниченный предварительный показ GPT-5.6 — не как единую модель, а как трёхуровневое семейство: Sol (флагман), Terra (сбалансированный) и Luna (быстрый и доступный). Превью ограничено примерно 20 доверенными организациями, участие которых было согласовано с правительством США; широкая доступность обещана «в течение ближайших недель».
Операционные последствия для маршрутизации очевидны ещё до выхода GA: команды инженеров уже сейчас должны планировать routing-политики под три новых model ID, обновлённую структуру ценообразования, которая меняет экономику среднего уровня, и два новых режима вывода — max и ultra, — влияющих на подсчёт стоимости agentic-задач.
Что произошло
OpenAI представила три модели под брендом GPT-5.6:
- GPT-5.6 Sol — флагманский уровень. Цена совпадает с GPT-5.5 ($5 / $30 за миллион токенов вход/выход), контекстное окно расширено до 1,5 млн токенов (против 1,05 млн у GPT-5.5 Pro), лидер семейства на Terminal-Bench 2.1 для agentic-кодирования. Sol работает в трёх режимах: стандартный,
max(более глубокое рассуждение на одной модели) иultra(оркестрация параллельных субагентов). - GPT-5.6 Terra — сбалансированный уровень. $2,50 / $15 за миллион токенов — вдвое дешевле GPT-5.5 при заявленной эквивалентной производительности. Именно здесь сосредоточен главный routing-тезис: Terra позиционируется как новый экономически эффективный дефолт для задач, ранее требовавших GPT-5.5.
- GPT-5.6 Luna — быстрый и доступный уровень. $1 / $6 за миллион токенов; ориентирован на высокопроизводительные, низкосложные рабочие нагрузки.
OpenAI пока не опубликовала точные строки model ID для API в материалах превью. Исходя из прецедента GPT-5.5, при общем доступе следует ожидать gpt-5.6-sol, gpt-5.6-terra и gpt-5.6-luna.
Ограниченный превью работает только через API (веб-доступ ChatGPT пока не открыт) и ограничен небольшим кругом организаций. Более широкий доступ зависит от процедуры согласования с правительством США — OpenAI признала, что это «неприемлемый долгосрочный дефолт», и обязалась выработать более системный процесс.
Почему это важно для AI-инженерных команд
Наиболее операционно значимая цифра — цена Terra: $2,50 / $15 за миллион токенов. Если Terra обеспечит качество GPT-5.5 на ваших реальных рабочих нагрузках, это прямое снижение затрат на ввод на 50% по сравнению с GPT-5.5 ($5 / $30). Для команд, использующих GPT-5.5 как основной tier по умолчанию, выход Terra GA — это запланированное событие снижения затрат, которое требует заблаговременного тестирования routing-конфигурации.
Luna по цене $1 / $6 становится самой дешёвой моделью OpenAI в стандартном API, конкурируя с GPT-4.1-nano или GPT-5.4-mini для высокопроизводительных задач классификации, извлечения данных и суммаризации.
Расширение контекстного окна Sol до 1,5 млн токенов важно для команд, ведущих долгосрочные coding-агенты, обрабатывающих юридические документы или рефакторящих крупные кодовые базы, где прежние ограничения требовали разбивки на части или многоходового обхода.
Режим ultra в Sol — оркестрация параллельных субагентов вместо одного вызова модели — меняет модель расчёта стоимости для agentic-задач. Один вызов в режиме ultra может разворачиваться в несколько субагентных completion, каждый из которых тарифицируется отдельно. Командам, использующим Codex или собственные coding-agent-пайплайны, нужно оценить, оправдывает ли прирост throughput от ultra соответствующий рост токенных расходов.
Перспектива routing-оператора
Переход от единственной флагманской модели к трёхуровневому семейству с устойчивыми именованными уровнями (Sol, Terra, Luna будут развиваться независимо) — структурное изменение в том, как должны строиться routing-политики для линейки OpenAI.
Три routing-лейна для планирования уже сейчас:
-
Sol lane — задачи наивысшей сложности: долгосрочное agentic-кодирование, исследования безопасности, биология и геномный анализ, многоходовые сложные рассуждения. При $5 / $30 профиль затрат не изменился по сравнению с GPT-5.5. Если текущий routing нацелен на
gpt-5.5для флагманских задач,gpt-5.6-sol— естественный преемник. -
Terra lane — новый экономически эффективный стандарт: повседневная помощь в написании кода, суммаризация документов, многоступенчатая бизнес-логика, agentic-задачи без необходимости в граничных возможностях. При 50% цены GPT-5.5 при заявленной эквивалентной производительности Terra — наиболее коммерчески интересный tier для большинства production-нагрузок. Запланируйте правило маршрутизации, направляющее не-флагманские задачи на
gpt-5.6-terraпосле GA. -
Luna lane — высокий объём, низкая сложность: классификация, извлечение данных, краткая суммаризация, разбор намерений, генерация структурированного вывода. По цене $1 / $6 Luna занимает позицию fallback для объёмочувствительных нагрузок с мягкими требованиями к качеству.
Fallback-цепочка в период ограниченного превью: До выхода GA запросы к model ID семейства gpt-5.6-* будут возвращать ошибки для большинства API-ключей. Routing-конфигурация должна трактовать ответы 404/model-not-found на GPT-5.6 ID как сигнал готовности к GA, а не как постоянную ошибку. В production пока оставляйте GPT-5.5 активным дефолтом; добавляйте тиры GPT-5.6 в staging-конфигурацию и тестируйте routing на Terra сразу, как только ваша организация получит доступ.
Ultra-режим и атрибуция стоимости субагентов: Если вы маршрутизируете Codex или любой coding-агент, который будет работать в режиме ultra, убедитесь, что ваш пайплайн учёта использования умеет атрибутировать развёрнутые субагентные completion к родительской задаче. Единственный вызов в режиме ultra — это не одно completion-событие: он порождает несколько субагентных токенов в рамках общего родителя. Проверьте, корректно ли ваш cost-tracking middleware агрегирует их.
Политика алиасов: По аналогии с GPT-5.5, ожидается, что gpt-5.6 (без суффикса уровня) будет резолвиться в Sol. Не полагайтесь на голый алиас в cost-sensitive production-нагрузках — после открытия API явно указывайте gpt-5.6-terra или gpt-5.6-luna.
За чем следить
- Объявление о GA. GA запланирован на «ближайшие недели» с 26 июня — следите за API changelog OpenAI для получения точных строк model ID и подтверждения ценообразования.
- Проверка качества Terra на ваших нагрузках. Позиционирование Terra как эквивалента GPT-5.5 — это заявление производителя, а не гарантия для вашего конкретного распределения задач. Сразу после получения доступа направьте 5–10% staging-трафика на Terra и измерьте качество вывода относительно текущего baseline GPT-5.5, прежде чем переходить на полную миграцию.
- Luna против существующих mini-tier моделей. При цене $1 / $6 Luna выходит в конкурентное поле рядом с GPT-4.1-nano и GPT-5.4-mini. Прежде чем автоматически заменять текущую mini-tier модель на Luna, проведите benchmark на своих высокопроизводительных задачах классификации или извлечения данных.
- Тарификация Sol Ultra. До включения
ultraв production уточните у OpenAI, тарифицируются ли ultra-mode completion как единый Sol-completion или как отдельные субагентные completion.
Для пользователей TheRouter routing-правила, сейчас нацеленные на gpt-5.5 по имени, продолжат работать в переходный период. Как только GPT-5.6 ID будут подтверждены в API, обновите список моделей провайдера и определите tier-специфичные routing-правила: Terra для оптимизированного по стоимости лейна, Sol — для лейна максимальных возможностей.
Похожие материалы
Новости AI-роутинга и провайдеров →
GPT-5.6 Sol и устойчивость к prompt injection: что результаты GPT-Red означают для вашей политики маршрутизации
GPT-Red от OpenAI сделал GPT-5.6 Sol в 6 раз устойчивее к prompt injection. Для операторов, чьи агентные pipeline обрабатывают email, веб-контент или вызовы сторонних инструментов, этот разрыв — теперь routing-решение.

GPT-5.6 GA: Programmatic Tool Calling перемещает оркестрацию инструментов внутрь модели — что операторам нужно обновить немедленно
GPT-5.6 Sol, Terra и Luna доступны в общем доступе с подтверждёнными ценами. Новая функция Responses API — Programmatic Tool Calling — смещает диспетчеризацию инструментов внутрь модели, обходя слой оркестрации на стороне шлюза.

OpenAI Prompt Cache Diagnostics стал GA: что нельзя убирать на уровне gateway
OpenAI выпустил Prompt Cache Diagnostics в GA для Responses API. Новые поля comparison_response_id и reason объясняют промахи кеша — но если gateway удаляет prompt_cache_options, диагностика молча исчезает.