← Все статьи

GPT-6 Sol и GPT-6 Luna: руководство по API, ценам и миграции с GPT-5.6

GPT-6 Sol ($2/$10 за 1M токенов) и GPT-6 Luna ($0.10/$0.50) вышли 22 сентября 2026 года — снижение цены более чем на 50% по сравнению с GPT-5.6. Разбираем model ID, контекстное окно, reasoning effort, интеграцию через SDK, миграцию с GPT-5.6, трёхуровневую маршрутизацию GPT-6, cross-provider fallback с Claude Sonnet 5 и экономию на смешанных нагрузках.

· TheRouter

GPT-6 Sol и GPT-6 Luna — модели среднего и бюджетного уровня в семействе GPT-6 от OpenAI. Они стали доступны 22 сентября 2026 года в 18:00 UTC, через 19 дней после GPT-6 Astra. Sol стоит $2 за миллион входных токенов и $10 за выходные. Luna — $0.10 и $0.50 соответственно. Оба модели дешевле предшественников GPT-5.6 более чем на 50%, поддерживают контекстное окно в 1 050 000 токенов с reasoning effort от none до max, и сразу доступны через API под model ID gpt-6-sol и gpt-6-luna.

Если ваш production-стек работает на GPT-5.6 Sol или Luna, миграция сводится к замене имени модели. Единственное поведенческое отличие, которое стоит протестировать: GPT-6 чаще задаёт уточняющие вопросы вместо того, чтобы молча додумывать. Все таблицы цен, примеры SDK-кода, изменения в кэшировании и конфигурации маршрутизации ниже основаны на данных с официальных страниц OpenAI от 22 сентября 2026 года.

GPT-6 Sol и Luna: ключевые характеристики

ПараметрGPT-6 SolGPT-6 LunaGPT-6 Astra
Model IDgpt-6-solgpt-6-lunagpt-6-astra
Вход / 1M токенов$2.00$0.10$10.00
Кэшированный вход / 1M токенов$0.20$0.01$1.00
Выход / 1M токенов$10.00$0.50$50.00
Длинный контекст (>272K) вход$4.00$0.20$20.00
Длинный контекст выход$15.00$0.75$75.00
Контекстное окно1 050 0001 050 0001 050 000
Макс. входных токенов922 000922 000922 000
Макс. выходных токенов128 000128 000128 000
Reasoning effortnone–max (по умолчанию medium)none–max (по умолчанию medium)low–max (без none)
Дата среза знаний20 апреля 202618 мая 202631 марта 2026
Batch-цены50% от стандарта50% от стандарта50% от стандарта

Источники: OpenAI Pricing (проверено 2026-09-22), Using GPT-6 (проверено 2026-09-22).

Детали цен: насколько дешевле GPT-5.6

Главная цифра — 50% снижение по всей линейке, если сравнивать с промо-ценами GPT-5.6.

МодельВходВыходСравнение с GPT-5.6
GPT-6 Sol$2.00$10.00Вход −50%, выход −50% (GPT-5.6 Sol: $4/$20)
GPT-6 Luna$0.10$0.50Вход −50%, выход −58% (GPT-5.6 Luna: $0.20/$1.20)
GPT-6 Astra$10.00$50.00Флагман, прямого предшественника нет

Цена GPT-5.6 Sol $4/$20 была промо-тарифом (при запуске стоил дороже). GPT-6 Sol за $2/$10 — постоянная цена, без пометки «промо». Промо-тариф GPT-5.6 Sol действует минимум до 21 ноября 2026 года для тех, кто ещё не мигрировал.

Batch-цены дополнительно снижают стоимость вдвое: Sol опускается до $1.00/$5.00, Luna — до $0.05/$0.25. Для офлайн-задач большого объёма (классификация, извлечение, суммаризация) Luna в batch-режиме по $0.05 за вход практически бесплатна.

Цены на длинный контекст активируются при >272K входных токенов: вход ×2, выход ×1.5. Sol при длинном контексте стоит $4.00 за вход (столько же, сколько стандартная цена GPT-5.6 Sol), Luna — $0.20 (столько же, сколько GPT-5.6 Luna). При регулярном использовании длинного контекста эффективная цена совпадает с GPT-5.6, но качество уже следующего поколения.

Model ID и работа с API

Обе модели доступны через стандартный OpenAI Responses API и Chat Completions API.

from openai import OpenAI

client = OpenAI()  # использует OPENAI_API_KEY

# GPT-6 Sol — код, анализ, многошаговые задачи
response = client.responses.create(
    model="gpt-6-sol",
    input="Объясни, как реализовать exponential backoff с jitter для rate limiting API.",
)
print(response.output_text)
# GPT-6 Luna — извлечение, классификация, суммаризация
response = client.responses.create(
    model="gpt-6-luna",
    input="Извлеки название компании, выручку и рост YoY из этого отчёта о прибыли.",
)
print(response.output_text)
// Node.js / TypeScript
import OpenAI from "openai";

const client = new OpenAI();

const response = await client.responses.create({
  model: "gpt-6-sol",
  input: "Напиши функцию на Python, реализующую паттерн circuit breaker.",
});
console.log(response.output_text);

Доступность: API — сразу на всех тарифах. ChatGPT Work и Codex — для планов Plus, Pro, Business, Enterprise и Edu. Free и Go — Luna в десктопном приложении. В веб-интерфейсе Chat модели пока недоступны.

Reasoning Effort: управление балансом стоимости и качества

GPT-6 Sol и Luna поддерживают полный диапазон reasoning effort от none до max (у Astra none недоступен). По умолчанию стоит medium.

# Минимальный effort для простого извлечения — быстрее, дешевле
response = client.responses.create(
    model="gpt-6-luna",
    input="Классифицируй этот тикет как billing, technical или general.",
    reasoning={"effort": "low"},
)

# Высокий effort для сложного анализа
response = client.responses.create(
    model="gpt-6-sol",
    input="Проведи ревью этого Pull Request на уязвимости безопасности.",
    reasoning={"effort": "high"},
)

При none расширенное размышление полностью отключается — модель отвечает за один проход. Подходит для задач, где важна минимальная задержка без цепочки рассуждений.

Смена effort посреди диалога — новая возможность GPT-6. Можно начать с low, на сложном вопросе переключить на high, и кэш промпт-префикса останется целым. Реализуется через configuration_update input item.

Кэширование: что изменилось в GPT-6

Три улучшения кэширования, напрямую влияющие на стоимость:

  1. Более высокий hit rate по умолчанию. OpenAI утверждает, что в GPT-6 кэш попадает чаще, чем в GPT-5.6.
  2. Смена reasoning effort и tool definitions больше не инвалидирует кэш. В GPT-5.6 это ломало кэшированный префикс; в GPT-6 — нет.
  3. Явные cache breakpoints. Теперь можно указать, где именно заканчивается кэшируемый префикс, и управлять границей между постоянной и изменяемой частью промпта.

Кэшированный вход стоит 10% от стандартной входной цены: $0.20 у Sol, $0.01 у Luna.

Когда использовать Sol, Luna и Astra

Три уровня семейства GPT-6, три класса задач.

GPT-6 Astra ($10/$50) — frontier-задачи. Многодневные проекты разработки, сложные агентные workflow, ситуации, где ошибка стоит дороже токенов. Когда единственное ограничение — качество.

GPT-6 Sol ($2/$10) — ежедневная рабочая лошадка. Код, анализ, tool calling, многошаговые рассуждения. На DeepSWE v1.1 Sol отстаёт от лучшего результата Claude Fable 5 всего на 1.1 процентного пункта, а стоит в разы дешевле. Для production-нагрузок, где нужна надёжная логика без premium-цен.

GPT-6 Luna ($0.10/$0.50) — массовые, бюджетно-чувствительные задачи. Классификация, извлечение, суммаризация, генерация structured output, простые tool calls. Luna набирает 66.6% на DeepSWE v1.1 при стоимости на 93% ниже Claude Opus 5. Для тех, кому нужно обрабатывать тысячи запросов в час без пристального контроля за счётом.

Быстрое правило: задача, на которую старший инженер потратит больше 30 минут вручную, — начинайте с Sol. Задача, которую джуниор решит за 5 минут, — начинайте с Luna. Координация между несколькими инструментами, браузерами и кодовыми базами на протяжении часов — Astra.

Миграция с GPT-5.6

Миграция проста: замена model name. API-интерфейс идентичен.

- model="gpt-5.6-sol"
+ model="gpt-6-sol"
- model="gpt-5.6-luna"
+ model="gpt-6-luna"

Поведенческие отличия, которые стоит протестировать:

  1. GPT-6 чаще задаёт вопросы. Характерное для Astra поведение «уточнить, а не додумать» распространяется на Sol и Luna. Если ваши промпты рассчитаны на то, что модель сама угадает намерение, может потребоваться добавить в system prompt "infer the user's intent and carry the task to completion without asking for clarification".

  2. Reasoning effort по умолчанию medium. Как и у GPT-5.6. Но GPT-6 на medium сильнее GPT-5.6 на medium — задачи, раньше требовавшие high, теперь могут работать на medium, экономя токены.

  3. Дата среза знаний сдвинулась вперёд. Sol — 20 апреля 2026 (у GPT-5.6 Sol было 16 февраля). Luna — 18 мая 2026. Если промпты затрагивают события февраля-мая 2026, модель уже знает об этих событиях.

  4. Кэш стал устойчивее. В эпоху GPT-5.6 разработчики старались не менять reasoning effort или tool definitions посреди диалога, чтобы не потерять cache hit. В GPT-6 эта осторожность больше не нужна.

Откат: GPT-5.6 Sol и Luna остаются доступны в API. Промо-цена GPT-5.6 Sol ($4/$20) действует минимум до 21 ноября 2026. Можно запустить обе модели параллельно, направить часть трафика на GPT-6, сравнить результаты и переключить полностью, когда уверены в качестве.

OpenAI-совместимость означает, что провайдер предоставляет endpoint chat-completions, чей контракт запроса и ответа достаточно близок к API OpenAI, чтобы немодифицированный вызов OpenAI SDK работал после замены трёх значений: API key, base URL, название модели. Минимальная поверхность на практике —POST /v1/chat/completions с messages, model и потоковым ответом в форме OpenAI.

Трёхуровневая маршрутизация GPT-6

Для команд со смешанными нагрузками можно настроить трёхуровневый routing-стек, который сопоставляет сложность задачи со стоимостью модели.

# Пример конфигурации TheRouter
routes:
  - name: gpt6-astra-frontier
    model: openai/gpt-6-astra
    match:
      tags: [frontier, multi-tool, computer-use]
    priority: 1

  - name: gpt6-sol-workhorse
    model: openai/gpt-6-sol
    match:
      tags: [coding, analysis, tool-calling]
    priority: 2
    fallback: gpt6-luna-value

  - name: gpt6-luna-value
    model: openai/gpt-6-luna
    match:
      tags: [extraction, classification, summarization]
    priority: 3

Frontier-задачи идут на Astra, повседневная разработка — на Sol, массовая обработка — на Luna. При недоступности Sol трафик уходит на Luna: просадка качества умеренная, снижение стоимости — 20-кратное.

Cross-provider routing: Sol против Claude Sonnet 5

GPT-6 Sol за $2/$10 стоит ровно столько же, сколько Claude Sonnet 5 — $2/$10. При одинаковой цене решение о маршрутизации определяется характером нагрузки.

ПараметрGPT-6 SolClaude Sonnet 5
Цена (вход/выход за 1M)$2 / $10$2 / $10
Контекстное окно1 050 0001 000 000
Макс. выход128 00064 000
Reasoning effortnone–maxlow–max
Prompt cachingДа, улучшен в GPT-6Да
Batch APIДа, −50%Да, −50%
Tool callingДа, async tool calling в GPT-6Да
Сильные стороныБенчмарки кода, async tools, длинный выходАгентные workflow, extended thinking, creative writing

При равных ценах мы настраиваем cross-provider routing как страховку надёжности. Если OpenAI возвращает 5xx или упирается в rate limit, трафик автоматически уходит к Anthropic, и наоборот. Штраф по стоимости — нулевой.

Расчёт экономии: до и после

Допустим, команда ежедневно потребляет 100M входных и 20M выходных токенов на GPT-5.6 Sol.

GPT-5.6 SolGPT-6 SolЭкономия
Стоимость входа в день$400$200$200/день
Стоимость выхода в день$400$200$200/день
Итого за месяц$24 000$12 000$12 000/мес

Luna-нагрузки считаем отдельно. Команда обрабатывает 500M входных токенов в день на GPT-5.6 Luna.

GPT-5.6 LunaGPT-6 LunaЭкономия
Стоимость входа в день$100$50$50/день
Стоимость выхода в день$120 ($1.20)$50 ($0.50)$70/день
Итого за месяц$6 600$3 000$3 600/мес

Batch поверх скидки: если Luna-задачи допускают асинхронную обработку, batch-цены снижают стоимость ещё на 50% — до $1 500/мес в сумме.

Чек-лист для перевода production

Перед переключением production-трафика на GPT-6 Sol или Luna:

  • Обновить model ID в конфигурации: gpt-5.6-sol на gpt-6-sol, gpt-5.6-luna на gpt-6-luna
  • Протестировать на реальных промптах — GPT-6 может задавать уточняющие вопросы там, где GPT-5.6 молча додумывал
  • При необходимости добавить в system prompt "infer the user's intent and carry the task to completion"
  • Проверить влияние цен на длинный контекст, если промпты превышают 272K токенов (вход ×2, выход ×1.5)
  • Убедиться в поведении кэша — смена reasoning effort больше не ломает кэш
  • Настроить fallback routing: Sol → Luna, или Sol → Claude Sonnet 5 для cross-provider устойчивости
  • Мониторить качество вывода 24–48 часов перед полным переключением
  • Сохранить GPT-5.6 model ID как rollback-цели — они доступны минимум до ноября 2026

FAQ

Какие model ID у GPT-6 Sol и Luna? gpt-6-sol и gpt-6-luna — указываются в параметре model любого запроса к OpenAI API.

GPT-6 Sol лучше GPT-5.6 Sol? Да. GPT-6 Sol набирает больше на AutomationBench, DeepSWE и Agents' Last Exam, а стоит вдвое дешевле. Дата среза знаний тоже свежее — апрель 2026 против февраля 2026.

Какая самая дешёвая модель OpenAI? GPT-6 Luna: $0.10/$0.50 за миллион токенов. В batch-режиме — $0.05/$0.25.

Можно ли вызывать GPT-6 Sol и Luna через OpenAI Python SDK? Да. Установите openai >= 1.0.0 и укажите model="gpt-6-sol" или model="gpt-6-luna". Никаких изменений в SDK не требуется.

Когда отключат GPT-5.6 Sol и Luna? OpenAI не объявлял даты deprecation. Промо-цена GPT-5.6 Sol действует минимум до 21 ноября 2026 года. Обе модели по-прежнему доступны в API.

GPT-6 Luna поддерживает reasoning effort? Да. Luna поддерживает весь диапазон от none до max (Astra не поддерживает none). По умолчанию — medium.

GPT-6 Sol стоит столько же, сколько Claude Sonnet 5? Да. $2/$10 за миллион токенов у обоих. При одинаковой цене выбор зависит от характера задач и требуемой надёжности провайдера.

Какое контекстное окно у GPT-6 Sol и Luna? 1 050 000 токенов, максимум 922 000 на вход и 128 000 на выход. При >272K входных токенов включается long-context pricing (вход ×2, выход ×1.5).

Можно ли маршрутизировать GPT-6 Sol через TheRouter? Да. TheRouter направляет OpenAI-совместимые запросы через настроенных провайдеров. Укажите openai/gpt-6-sol или openai/gpt-6-luna в качестве model target и настройте fallback routing для cross-provider устойчивости.

Что нового в API GPT-6 по сравнению с GPT-5.6? Async tool calling (модель продолжает рассуждать, пока инструмент выполняется), mid-turn steering (отправка корректировок пока модель работает), configuration updates посреди диалога (смена reasoning effort без потери кэша) и более высокий hit rate кэша по умолчанию.

Модели, упомянутые в статье

Помощь и контакты