GPT-5.6 Sol, Terra и Luna: политика маршрутизации для трёхуровневого семейства моделей OpenAI

OpenAI представила GPT-5.6 в виде трёх уровней: Sol, Terra и Luna. Ключевое изменение для routing-операторов — Terra: производительность уровня GPT-5.5 вдвое дешевле. Вот как обновить политику маршрутизации до выхода GA.

TheRouter Newsroomисточник OpenAI
Три орбитальных тела, представляющих GPT-5.6 Sol, Terra и Luna, в лаконичной редакционной композиции на нейтральном фоне

26 июня 2026 года OpenAI начала ограниченный предварительный показ GPT-5.6 — не как единую модель, а как трёхуровневое семейство: Sol (флагман), Terra (сбалансированный) и Luna (быстрый и доступный). Превью ограничено примерно 20 доверенными организациями, участие которых было согласовано с правительством США; широкая доступность обещана «в течение ближайших недель».

Операционные последствия для маршрутизации очевидны ещё до выхода GA: команды инженеров уже сейчас должны планировать routing-политики под три новых model ID, обновлённую структуру ценообразования, которая меняет экономику среднего уровня, и два новых режима вывода — max и ultra, — влияющих на подсчёт стоимости agentic-задач.

Что произошло

OpenAI представила три модели под брендом GPT-5.6:

  • GPT-5.6 Sol — флагманский уровень. Цена совпадает с GPT-5.5 ($5 / $30 за миллион токенов вход/выход), контекстное окно расширено до 1,5 млн токенов (против 1,05 млн у GPT-5.5 Pro), лидер семейства на Terminal-Bench 2.1 для agentic-кодирования. Sol работает в трёх режимах: стандартный, max (более глубокое рассуждение на одной модели) и ultra (оркестрация параллельных субагентов).
  • GPT-5.6 Terra — сбалансированный уровень. $2,50 / $15 за миллион токенов — вдвое дешевле GPT-5.5 при заявленной эквивалентной производительности. Именно здесь сосредоточен главный routing-тезис: Terra позиционируется как новый экономически эффективный дефолт для задач, ранее требовавших GPT-5.5.
  • GPT-5.6 Luna — быстрый и доступный уровень. $1 / $6 за миллион токенов; ориентирован на высокопроизводительные, низкосложные рабочие нагрузки.

OpenAI пока не опубликовала точные строки model ID для API в материалах превью. Исходя из прецедента GPT-5.5, при общем доступе следует ожидать gpt-5.6-sol, gpt-5.6-terra и gpt-5.6-luna.

Ограниченный превью работает только через API (веб-доступ ChatGPT пока не открыт) и ограничен небольшим кругом организаций. Более широкий доступ зависит от процедуры согласования с правительством США — OpenAI признала, что это «неприемлемый долгосрочный дефолт», и обязалась выработать более системный процесс.

Почему это важно для AI-инженерных команд

Наиболее операционно значимая цифра — цена Terra: $2,50 / $15 за миллион токенов. Если Terra обеспечит качество GPT-5.5 на ваших реальных рабочих нагрузках, это прямое снижение затрат на ввод на 50% по сравнению с GPT-5.5 ($5 / $30). Для команд, использующих GPT-5.5 как основной tier по умолчанию, выход Terra GA — это запланированное событие снижения затрат, которое требует заблаговременного тестирования routing-конфигурации.

Luna по цене $1 / $6 становится самой дешёвой моделью OpenAI в стандартном API, конкурируя с GPT-4.1-nano или GPT-5.4-mini для высокопроизводительных задач классификации, извлечения данных и суммаризации.

Расширение контекстного окна Sol до 1,5 млн токенов важно для команд, ведущих долгосрочные coding-агенты, обрабатывающих юридические документы или рефакторящих крупные кодовые базы, где прежние ограничения требовали разбивки на части или многоходового обхода.

Режим ultra в Sol — оркестрация параллельных субагентов вместо одного вызова модели — меняет модель расчёта стоимости для agentic-задач. Один вызов в режиме ultra может разворачиваться в несколько субагентных completion, каждый из которых тарифицируется отдельно. Командам, использующим Codex или собственные coding-agent-пайплайны, нужно оценить, оправдывает ли прирост throughput от ultra соответствующий рост токенных расходов.

Перспектива routing-оператора

Переход от единственной флагманской модели к трёхуровневому семейству с устойчивыми именованными уровнями (Sol, Terra, Luna будут развиваться независимо) — структурное изменение в том, как должны строиться routing-политики для линейки OpenAI.

Три routing-лейна для планирования уже сейчас:

  1. Sol lane — задачи наивысшей сложности: долгосрочное agentic-кодирование, исследования безопасности, биология и геномный анализ, многоходовые сложные рассуждения. При $5 / $30 профиль затрат не изменился по сравнению с GPT-5.5. Если текущий routing нацелен на gpt-5.5 для флагманских задач, gpt-5.6-sol — естественный преемник.

  2. Terra lane — новый экономически эффективный стандарт: повседневная помощь в написании кода, суммаризация документов, многоступенчатая бизнес-логика, agentic-задачи без необходимости в граничных возможностях. При 50% цены GPT-5.5 при заявленной эквивалентной производительности Terra — наиболее коммерчески интересный tier для большинства production-нагрузок. Запланируйте правило маршрутизации, направляющее не-флагманские задачи на gpt-5.6-terra после GA.

  3. Luna lane — высокий объём, низкая сложность: классификация, извлечение данных, краткая суммаризация, разбор намерений, генерация структурированного вывода. По цене $1 / $6 Luna занимает позицию fallback для объёмочувствительных нагрузок с мягкими требованиями к качеству.

Fallback-цепочка в период ограниченного превью: До выхода GA запросы к model ID семейства gpt-5.6-* будут возвращать ошибки для большинства API-ключей. Routing-конфигурация должна трактовать ответы 404/model-not-found на GPT-5.6 ID как сигнал готовности к GA, а не как постоянную ошибку. В production пока оставляйте GPT-5.5 активным дефолтом; добавляйте тиры GPT-5.6 в staging-конфигурацию и тестируйте routing на Terra сразу, как только ваша организация получит доступ.

Ultra-режим и атрибуция стоимости субагентов: Если вы маршрутизируете Codex или любой coding-агент, который будет работать в режиме ultra, убедитесь, что ваш пайплайн учёта использования умеет атрибутировать развёрнутые субагентные completion к родительской задаче. Единственный вызов в режиме ultra — это не одно completion-событие: он порождает несколько субагентных токенов в рамках общего родителя. Проверьте, корректно ли ваш cost-tracking middleware агрегирует их.

Политика алиасов: По аналогии с GPT-5.5, ожидается, что gpt-5.6 (без суффикса уровня) будет резолвиться в Sol. Не полагайтесь на голый алиас в cost-sensitive production-нагрузках — после открытия API явно указывайте gpt-5.6-terra или gpt-5.6-luna.

За чем следить

  • Объявление о GA. GA запланирован на «ближайшие недели» с 26 июня — следите за API changelog OpenAI для получения точных строк model ID и подтверждения ценообразования.
  • Проверка качества Terra на ваших нагрузках. Позиционирование Terra как эквивалента GPT-5.5 — это заявление производителя, а не гарантия для вашего конкретного распределения задач. Сразу после получения доступа направьте 5–10% staging-трафика на Terra и измерьте качество вывода относительно текущего baseline GPT-5.5, прежде чем переходить на полную миграцию.
  • Luna против существующих mini-tier моделей. При цене $1 / $6 Luna выходит в конкурентное поле рядом с GPT-4.1-nano и GPT-5.4-mini. Прежде чем автоматически заменять текущую mini-tier модель на Luna, проведите benchmark на своих высокопроизводительных задачах классификации или извлечения данных.
  • Тарификация Sol Ultra. До включения ultra в production уточните у OpenAI, тарифицируются ли ultra-mode completion как единый Sol-completion или как отдельные субагентные completion.

Для пользователей TheRouter routing-правила, сейчас нацеленные на gpt-5.5 по имени, продолжат работать в переходный период. Как только GPT-5.6 ID будут подтверждены в API, обновите список моделей провайдера и определите tier-специфичные routing-правила: Terra для оптимизированного по стоимости лейна, Sol — для лейна максимальных возможностей.

GPT-5.6 Sol устойчивость к prompt injection политика маршрутизации AI-операторы

GPT-5.6 Sol и устойчивость к prompt injection: что результаты GPT-Red означают для вашей политики маршрутизации

GPT-Red от OpenAI сделал GPT-5.6 Sol в 6 раз устойчивее к prompt injection. Для операторов, чьи агентные pipeline обрабатывают email, веб-контент или вызовы сторонних инструментов, этот разрыв — теперь routing-решение.

источник OpenAI
Редакционная иллюстрация с тремя орбитальными уровнями и символом выполнения кода в центре, обозначающая Programmatic Tool Calling GPT-5.6 и политику многомодельного роутинга, на нейтральном фоне

GPT-5.6 GA: Programmatic Tool Calling перемещает оркестрацию инструментов внутрь модели — что операторам нужно обновить немедленно

GPT-5.6 Sol, Terra и Luna доступны в общем доступе с подтверждёнными ценами. Новая функция Responses API — Programmatic Tool Calling — смещает диспетчеризацию инструментов внутрь модели, обходя слой оркестрации на стороне шлюза.

источник OpenAI
Помощь и контакты