GPT-6 Sol и GPT-6 Luna: руководство по API, ценам и миграции с GPT-5.6
GPT-6 Sol ($2/$10 за 1M токенов) и GPT-6 Luna ($0.10/$0.50) вышли 22 сентября 2026 года — снижение цены более чем на 50% по сравнению с GPT-5.6. Разбираем model ID, контекстное окно, reasoning effort, интеграцию через SDK, миграцию с GPT-5.6, трёхуровневую маршрутизацию GPT-6, cross-provider fallback с Claude Sonnet 5 и экономию на смешанных нагрузках.
GPT-6 Sol и GPT-6 Luna — модели среднего и бюджетного уровня в семействе GPT-6 от OpenAI. Они стали доступны 22 сентября 2026 года в 18:00 UTC, через 19 дней после GPT-6 Astra. Sol стоит $2 за миллион входных токенов и $10 за выходные. Luna — $0.10 и $0.50 соответственно. Оба модели дешевле предшественников GPT-5.6 более чем на 50%, поддерживают контекстное окно в 1 050 000 токенов с reasoning effort от none до max, и сразу доступны через API под model ID gpt-6-sol и gpt-6-luna.
Если ваш production-стек работает на GPT-5.6 Sol или Luna, миграция сводится к замене имени модели. Единственное поведенческое отличие, которое стоит протестировать: GPT-6 чаще задаёт уточняющие вопросы вместо того, чтобы молча додумывать. Все таблицы цен, примеры SDK-кода, изменения в кэшировании и конфигурации маршрутизации ниже основаны на данных с официальных страниц OpenAI от 22 сентября 2026 года.
GPT-6 Sol и Luna: ключевые характеристики
| Параметр | GPT-6 Sol | GPT-6 Luna | GPT-6 Astra |
|---|---|---|---|
| Model ID | gpt-6-sol | gpt-6-luna | gpt-6-astra |
| Вход / 1M токенов | $2.00 | $0.10 | $10.00 |
| Кэшированный вход / 1M токенов | $0.20 | $0.01 | $1.00 |
| Выход / 1M токенов | $10.00 | $0.50 | $50.00 |
| Длинный контекст (>272K) вход | $4.00 | $0.20 | $20.00 |
| Длинный контекст выход | $15.00 | $0.75 | $75.00 |
| Контекстное окно | 1 050 000 | 1 050 000 | 1 050 000 |
| Макс. входных токенов | 922 000 | 922 000 | 922 000 |
| Макс. выходных токенов | 128 000 | 128 000 | 128 000 |
| Reasoning effort | none–max (по умолчанию medium) | none–max (по умолчанию medium) | low–max (без none) |
| Дата среза знаний | 20 апреля 2026 | 18 мая 2026 | 31 марта 2026 |
| Batch-цены | 50% от стандарта | 50% от стандарта | 50% от стандарта |
Источники: OpenAI Pricing (проверено 2026-09-22), Using GPT-6 (проверено 2026-09-22).
Детали цен: насколько дешевле GPT-5.6
Главная цифра — 50% снижение по всей линейке, если сравнивать с промо-ценами GPT-5.6.
| Модель | Вход | Выход | Сравнение с GPT-5.6 |
|---|---|---|---|
| GPT-6 Sol | $2.00 | $10.00 | Вход −50%, выход −50% (GPT-5.6 Sol: $4/$20) |
| GPT-6 Luna | $0.10 | $0.50 | Вход −50%, выход −58% (GPT-5.6 Luna: $0.20/$1.20) |
| GPT-6 Astra | $10.00 | $50.00 | Флагман, прямого предшественника нет |
Цена GPT-5.6 Sol $4/$20 была промо-тарифом (при запуске стоил дороже). GPT-6 Sol за $2/$10 — постоянная цена, без пометки «промо». Промо-тариф GPT-5.6 Sol действует минимум до 21 ноября 2026 года для тех, кто ещё не мигрировал.
Batch-цены дополнительно снижают стоимость вдвое: Sol опускается до $1.00/$5.00, Luna — до $0.05/$0.25. Для офлайн-задач большого объёма (классификация, извлечение, суммаризация) Luna в batch-режиме по $0.05 за вход практически бесплатна.
Цены на длинный контекст активируются при >272K входных токенов: вход ×2, выход ×1.5. Sol при длинном контексте стоит $4.00 за вход (столько же, сколько стандартная цена GPT-5.6 Sol), Luna — $0.20 (столько же, сколько GPT-5.6 Luna). При регулярном использовании длинного контекста эффективная цена совпадает с GPT-5.6, но качество уже следующего поколения.
Model ID и работа с API
Обе модели доступны через стандартный OpenAI Responses API и Chat Completions API.
from openai import OpenAI
client = OpenAI() # использует OPENAI_API_KEY
# GPT-6 Sol — код, анализ, многошаговые задачи
response = client.responses.create(
model="gpt-6-sol",
input="Объясни, как реализовать exponential backoff с jitter для rate limiting API.",
)
print(response.output_text)
# GPT-6 Luna — извлечение, классификация, суммаризация
response = client.responses.create(
model="gpt-6-luna",
input="Извлеки название компании, выручку и рост YoY из этого отчёта о прибыли.",
)
print(response.output_text)
// Node.js / TypeScript
import OpenAI from "openai";
const client = new OpenAI();
const response = await client.responses.create({
model: "gpt-6-sol",
input: "Напиши функцию на Python, реализующую паттерн circuit breaker.",
});
console.log(response.output_text);
Доступность: API — сразу на всех тарифах. ChatGPT Work и Codex — для планов Plus, Pro, Business, Enterprise и Edu. Free и Go — Luna в десктопном приложении. В веб-интерфейсе Chat модели пока недоступны.
Reasoning Effort: управление балансом стоимости и качества
GPT-6 Sol и Luna поддерживают полный диапазон reasoning effort от none до max (у Astra none недоступен). По умолчанию стоит medium.
# Минимальный effort для простого извлечения — быстрее, дешевле
response = client.responses.create(
model="gpt-6-luna",
input="Классифицируй этот тикет как billing, technical или general.",
reasoning={"effort": "low"},
)
# Высокий effort для сложного анализа
response = client.responses.create(
model="gpt-6-sol",
input="Проведи ревью этого Pull Request на уязвимости безопасности.",
reasoning={"effort": "high"},
)
При none расширенное размышление полностью отключается — модель отвечает за один проход. Подходит для задач, где важна минимальная задержка без цепочки рассуждений.
Смена effort посреди диалога — новая возможность GPT-6. Можно начать с low, на сложном вопросе переключить на high, и кэш промпт-префикса останется целым. Реализуется через configuration_update input item.
Кэширование: что изменилось в GPT-6
Три улучшения кэширования, напрямую влияющие на стоимость:
- Более высокий hit rate по умолчанию. OpenAI утверждает, что в GPT-6 кэш попадает чаще, чем в GPT-5.6.
- Смена reasoning effort и tool definitions больше не инвалидирует кэш. В GPT-5.6 это ломало кэшированный префикс; в GPT-6 — нет.
- Явные cache breakpoints. Теперь можно указать, где именно заканчивается кэшируемый префикс, и управлять границей между постоянной и изменяемой частью промпта.
Кэшированный вход стоит 10% от стандартной входной цены: $0.20 у Sol, $0.01 у Luna.
Когда использовать Sol, Luna и Astra
Три уровня семейства GPT-6, три класса задач.
GPT-6 Astra ($10/$50) — frontier-задачи. Многодневные проекты разработки, сложные агентные workflow, ситуации, где ошибка стоит дороже токенов. Когда единственное ограничение — качество.
GPT-6 Sol ($2/$10) — ежедневная рабочая лошадка. Код, анализ, tool calling, многошаговые рассуждения. На DeepSWE v1.1 Sol отстаёт от лучшего результата Claude Fable 5 всего на 1.1 процентного пункта, а стоит в разы дешевле. Для production-нагрузок, где нужна надёжная логика без premium-цен.
GPT-6 Luna ($0.10/$0.50) — массовые, бюджетно-чувствительные задачи. Классификация, извлечение, суммаризация, генерация structured output, простые tool calls. Luna набирает 66.6% на DeepSWE v1.1 при стоимости на 93% ниже Claude Opus 5. Для тех, кому нужно обрабатывать тысячи запросов в час без пристального контроля за счётом.
Быстрое правило: задача, на которую старший инженер потратит больше 30 минут вручную, — начинайте с Sol. Задача, которую джуниор решит за 5 минут, — начинайте с Luna. Координация между несколькими инструментами, браузерами и кодовыми базами на протяжении часов — Astra.
Миграция с GPT-5.6
Миграция проста: замена model name. API-интерфейс идентичен.
- model="gpt-5.6-sol"
+ model="gpt-6-sol"
- model="gpt-5.6-luna"
+ model="gpt-6-luna"
Поведенческие отличия, которые стоит протестировать:
-
GPT-6 чаще задаёт вопросы. Характерное для Astra поведение «уточнить, а не додумать» распространяется на Sol и Luna. Если ваши промпты рассчитаны на то, что модель сама угадает намерение, может потребоваться добавить в system prompt "infer the user's intent and carry the task to completion without asking for clarification".
-
Reasoning effort по умолчанию
medium. Как и у GPT-5.6. Но GPT-6 наmediumсильнее GPT-5.6 наmedium— задачи, раньше требовавшиеhigh, теперь могут работать наmedium, экономя токены. -
Дата среза знаний сдвинулась вперёд. Sol — 20 апреля 2026 (у GPT-5.6 Sol было 16 февраля). Luna — 18 мая 2026. Если промпты затрагивают события февраля-мая 2026, модель уже знает об этих событиях.
-
Кэш стал устойчивее. В эпоху GPT-5.6 разработчики старались не менять reasoning effort или tool definitions посреди диалога, чтобы не потерять cache hit. В GPT-6 эта осторожность больше не нужна.
Откат: GPT-5.6 Sol и Luna остаются доступны в API. Промо-цена GPT-5.6 Sol ($4/$20) действует минимум до 21 ноября 2026. Можно запустить обе модели параллельно, направить часть трафика на GPT-6, сравнить результаты и переключить полностью, когда уверены в качестве.
OpenAI-совместимость означает, что провайдер предоставляет endpoint chat-completions, чей контракт запроса и ответа достаточно близок к API OpenAI, чтобы немодифицированный вызов OpenAI SDK работал после замены трёх значений: API key, base URL, название модели. Минимальная поверхность на практике —POST /v1/chat/completions с messages, model и потоковым ответом в форме OpenAI.
Трёхуровневая маршрутизация GPT-6
Для команд со смешанными нагрузками можно настроить трёхуровневый routing-стек, который сопоставляет сложность задачи со стоимостью модели.
# Пример конфигурации TheRouter
routes:
- name: gpt6-astra-frontier
model: openai/gpt-6-astra
match:
tags: [frontier, multi-tool, computer-use]
priority: 1
- name: gpt6-sol-workhorse
model: openai/gpt-6-sol
match:
tags: [coding, analysis, tool-calling]
priority: 2
fallback: gpt6-luna-value
- name: gpt6-luna-value
model: openai/gpt-6-luna
match:
tags: [extraction, classification, summarization]
priority: 3
Frontier-задачи идут на Astra, повседневная разработка — на Sol, массовая обработка — на Luna. При недоступности Sol трафик уходит на Luna: просадка качества умеренная, снижение стоимости — 20-кратное.
Cross-provider routing: Sol против Claude Sonnet 5
GPT-6 Sol за $2/$10 стоит ровно столько же, сколько Claude Sonnet 5 — $2/$10. При одинаковой цене решение о маршрутизации определяется характером нагрузки.
| Параметр | GPT-6 Sol | Claude Sonnet 5 |
|---|---|---|
| Цена (вход/выход за 1M) | $2 / $10 | $2 / $10 |
| Контекстное окно | 1 050 000 | 1 000 000 |
| Макс. выход | 128 000 | 64 000 |
| Reasoning effort | none–max | low–max |
| Prompt caching | Да, улучшен в GPT-6 | Да |
| Batch API | Да, −50% | Да, −50% |
| Tool calling | Да, async tool calling в GPT-6 | Да |
| Сильные стороны | Бенчмарки кода, async tools, длинный выход | Агентные workflow, extended thinking, creative writing |
При равных ценах мы настраиваем cross-provider routing как страховку надёжности. Если OpenAI возвращает 5xx или упирается в rate limit, трафик автоматически уходит к Anthropic, и наоборот. Штраф по стоимости — нулевой.
Расчёт экономии: до и после
Допустим, команда ежедневно потребляет 100M входных и 20M выходных токенов на GPT-5.6 Sol.
| GPT-5.6 Sol | GPT-6 Sol | Экономия | |
|---|---|---|---|
| Стоимость входа в день | $400 | $200 | $200/день |
| Стоимость выхода в день | $400 | $200 | $200/день |
| Итого за месяц | $24 000 | $12 000 | $12 000/мес |
Luna-нагрузки считаем отдельно. Команда обрабатывает 500M входных токенов в день на GPT-5.6 Luna.
| GPT-5.6 Luna | GPT-6 Luna | Экономия | |
|---|---|---|---|
| Стоимость входа в день | $100 | $50 | $50/день |
| Стоимость выхода в день | $120 ($1.20) | $50 ($0.50) | $70/день |
| Итого за месяц | $6 600 | $3 000 | $3 600/мес |
Batch поверх скидки: если Luna-задачи допускают асинхронную обработку, batch-цены снижают стоимость ещё на 50% — до $1 500/мес в сумме.
Чек-лист для перевода production
Перед переключением production-трафика на GPT-6 Sol или Luna:
- Обновить model ID в конфигурации:
gpt-5.6-solнаgpt-6-sol,gpt-5.6-lunaнаgpt-6-luna - Протестировать на реальных промптах — GPT-6 может задавать уточняющие вопросы там, где GPT-5.6 молча додумывал
- При необходимости добавить в system prompt "infer the user's intent and carry the task to completion"
- Проверить влияние цен на длинный контекст, если промпты превышают 272K токенов (вход ×2, выход ×1.5)
- Убедиться в поведении кэша — смена reasoning effort больше не ломает кэш
- Настроить fallback routing: Sol → Luna, или Sol → Claude Sonnet 5 для cross-provider устойчивости
- Мониторить качество вывода 24–48 часов перед полным переключением
- Сохранить GPT-5.6 model ID как rollback-цели — они доступны минимум до ноября 2026
FAQ
Какие model ID у GPT-6 Sol и Luna?
gpt-6-sol и gpt-6-luna — указываются в параметре model любого запроса к OpenAI API.
GPT-6 Sol лучше GPT-5.6 Sol? Да. GPT-6 Sol набирает больше на AutomationBench, DeepSWE и Agents' Last Exam, а стоит вдвое дешевле. Дата среза знаний тоже свежее — апрель 2026 против февраля 2026.
Какая самая дешёвая модель OpenAI? GPT-6 Luna: $0.10/$0.50 за миллион токенов. В batch-режиме — $0.05/$0.25.
Можно ли вызывать GPT-6 Sol и Luna через OpenAI Python SDK?
Да. Установите openai >= 1.0.0 и укажите model="gpt-6-sol" или model="gpt-6-luna". Никаких изменений в SDK не требуется.
Когда отключат GPT-5.6 Sol и Luna? OpenAI не объявлял даты deprecation. Промо-цена GPT-5.6 Sol действует минимум до 21 ноября 2026 года. Обе модели по-прежнему доступны в API.
GPT-6 Luna поддерживает reasoning effort?
Да. Luna поддерживает весь диапазон от none до max (Astra не поддерживает none). По умолчанию — medium.
GPT-6 Sol стоит столько же, сколько Claude Sonnet 5? Да. $2/$10 за миллион токенов у обоих. При одинаковой цене выбор зависит от характера задач и требуемой надёжности провайдера.
Какое контекстное окно у GPT-6 Sol и Luna? 1 050 000 токенов, максимум 922 000 на вход и 128 000 на выход. При >272K входных токенов включается long-context pricing (вход ×2, выход ×1.5).
Можно ли маршрутизировать GPT-6 Sol через TheRouter?
Да. TheRouter направляет OpenAI-совместимые запросы через настроенных провайдеров. Укажите openai/gpt-6-sol или openai/gpt-6-luna в качестве model target и настройте fallback routing для cross-provider устойчивости.
Что нового в API GPT-6 по сравнению с GPT-5.6? Async tool calling (модель продолжает рассуждать, пока инструмент выполняется), mid-turn steering (отправка корректировок пока модель работает), configuration updates посреди диалога (смена reasoning effort без потери кэша) и более высокий hit rate кэша по умолчанию.