Руководство по миграции моделей OpenAI в октябре 2026: GPT-5.4-Cyber, GPT-3.5, GPT-4 и O1 — сроки и замены
OpenAI отключает gpt-5.4-cyber 1 октября и выводит из эксплуатации gpt-3.5-turbo, gpt-4, gpt-4-turbo и o1 23 октября 2026 года. Руководство по миграции: полная матрица замен, примеры кода, анализ цен, особенности Azure Foundry и чек-лист для продакшена.
Руководство по миграции моделей OpenAI в октябре 2026
В октябре 2026 года пользователей OpenAI API ждут две волны отключений. 1 октября перестаёт работать специализированная модель gpt-5.4-cyber. 23 октября уходит группа устаревших моделей — gpt-3.5-turbo-0125, gpt-4-0613, gpt-4-turbo-2024-04-09 и o1-2024-12-17. Если ваш код привязан к любому из этих model ID, действовать нужно сейчас — счёт идёт на дни, а не на месяцы.
В этом руководстве — точная матрица замен, примеры кода до и после миграции, анализ изменения цен, контекст по Azure Foundry и пошаговый чек-лист для продакшена. Мы также покажем, как fallback-маршрутизация TheRouter автоматически перенаправляет трафик при отключении модели.
Мы маршрутизируем OpenAI-совместимые запросы через настроенных провайдеров и поддерживаем fallback на уровне провайдеров и моделей там, где это реализовано в продукте. Мы не заявляем поддержку всех моделей, нулевого даунтайма или гарантированно самых низких цен. Все даты и цены взяты из официальной документации OpenAI на момент проверки.
OpenAI-совместимость означает, что провайдер предоставляет endpoint chat-completions, чей контракт запроса и ответа достаточно близок к API OpenAI, чтобы немодифицированный вызов OpenAI SDK работал после замены трёх значений: API key, base URL, название модели. Минимальная поверхность на практике —POST /v1/chat/completions с messages, model и потоковым ответом в форме OpenAI.
Коротко — за 30 секунд
- 1 октября 2026 года —
gpt-5.4-cyberпрекращает работу. Замена —gpt-5.6-cyber(нужен доступ к Daybreak Red) (OpenAI Deprecations, проверено 2026-09-18). - 23 октября 2026 года — отключаются
gpt-3.5-turbo-0125,gpt-4-0613,gpt-4-turbo-2024-04-09,o1-2024-12-17(OpenAI Deprecations, проверено 2026-09-18). - Рекомендуемые замены — семейство GPT-5.6: Sol для флагманских задач, Terra для среднего уровня, Luna для лёгких нагрузок.
- Что делать прямо сейчас — проверить model ID в коде, запустить теневое тестирование замен, настроить fallback-маршрутизацию. До дедлайна 1 октября осталось 13 дней.
Полный график отключений в октябре
Волна 1 — 1 октября: отключение GPT-5.4-Cyber
| Отключаемая модель | Дата | Замена | Доступ |
|---|---|---|---|
gpt-5.4-cyber | 1 окт. 2026 | gpt-5.6-cyber | Только Daybreak Red |
GPT-5.4-Cyber — первая специализированная модель OpenAI для кибербезопасности, запущенная в апреле 2026 года в рамках программы Daybreak. Преемник GPT-5.6-Cyber был представлен 10 августа 2026 года. Он построен на архитектуре Sol и значительно улучшил показатели на продвинутых тестах кибербезопасности — 95% против 57,3% у GPT-5.5-Cyber (анонс OpenAI Daybreak, проверено 2026-09-18).
GPT-5.6-Cyber доступен только по заявке. Публичного model ID для API нет. Для Daybreak Red требуется верификация личности, согласие на ограничения использования и аппаратный ключ безопасности на аккаунте с 1 сентября 2026 года. Команды без доступа к Daybreak Red могут использовать стандартный gpt-5.6-sol, который набирает 96,7% на CTF-бенчмарках и 73,5% на ExploitBench без какого-либо доступа к Daybreak (обзор GPT-5.6-Cyber на eesel.ai, проверено 2026-09-18).
Волна 2 — 23 октября: массовое отключение устаревших моделей
| Отключаемая модель | Дата | Замена | Категория |
|---|---|---|---|
gpt-3.5-turbo-0125 | 23 окт. 2026 | gpt-5.6-terra | Устаревший чат |
gpt-4-0613 | 23 окт. 2026 | gpt-5.6-sol | Устаревший флагман |
gpt-4-turbo-2024-04-09 | 23 окт. 2026 | gpt-5.6-sol | Устаревший turbo |
o1-2024-12-17 | 23 окт. 2026 | gpt-5.6-sol | Ранний reasoning |
Эта волна убирает последние датированные снэпшоты GPT-3.5, GPT-4 и первой модели O1. OpenAI объявил об этих отключениях 22 апреля 2026 года, предоставив стандартное 6-месячное уведомление для GA-моделей (форум OpenAI, проверено 2026-09-18).
После 23 октября алиас gpt-3.5-turbo без даты тоже перестанет работать, если он указывает на отключаемый снэпшот 0125. Проверьте, на какой снэпшот сейчас ссылается ваш алиас.
Пути миграции по моделям
GPT-3.5-Turbo → GPT-5.6-Terra
GPT-5.6-Terra — модель среднего уровня в семействе GPT-5.6. Для рабочих нагрузок, где GPT-3.5-Turbo использовался ради экономии, Terra даёт серьёзный прирост возможностей, но стоит дороже.
| Параметр | gpt-3.5-turbo-0125 | gpt-5.6-terra |
|---|---|---|
| Цена ввода (за 1 млн токенов) | $0.50 | $2.00 |
| Цена вывода (за 1 млн токенов) | $1.50 | $12.00 |
| Кэшированный ввод | Нет | $0.20 |
| Batch ввод | Нет | $1.00 |
| Batch вывод | Нет | $6.00 |
Рост цен заметный — ввод в 4 раза, вывод в 8 раз по стандартным тарифам. Две стратегии помогают снизить разницу. Первая — prompt caching у GPT-5.6-Terra: кэшированный ввод стоит $0.20 за 1 млн токенов, на 90% дешевле обычного ввода. Для задач с повторяющимися префиксами кэширование значительно сглаживает рост. Вторая — batch-обработка, которая снижает тарифы на 50% для задач, нечувствительных к задержке (OpenAI Pricing, проверено 2026-09-18).
Для высоконагруженных задач, где возможностей GPT-3.5-Turbo хватало, рассмотрите gpt-5.6-luna ($0.20/$1.20 за 1 млн токенов). По цене Luna ближе к старому GPT-3.5, при этом уже на уровне GPT-5.6 по возможностям.
GPT-4 и GPT-4-Turbo → GPT-5.6-Sol
Обе модели — gpt-4-0613 и gpt-4-turbo-2024-04-09 — замещаются на gpt-5.6-sol, флагманский уровень.
| Параметр | gpt-4-0613 | gpt-4-turbo | gpt-5.6-sol |
|---|---|---|---|
| Цена ввода (за 1 млн токенов) | $30.00 | $10.00 | $4.00 |
| Цена вывода (за 1 млн токенов) | $60.00 | $30.00 | $20.00 |
| Кэшированный ввод | Нет | Нет | $0.40 |
При переходе с GPT-4 (0613) на Sol ввод дешевеет на 87%, вывод — на 67%. С GPT-4-Turbo экономия составляет 60% на вводе и 33% на выводе. Редкий случай, когда замена одновременно мощнее и дешевле (OpenAI Pricing, проверено 2026-09-18).
O1 → GPT-5.6-Sol
Модель reasoning o1-2024-12-17 замещается на gpt-5.6-sol. OpenAI объединил линейки reasoning и общего назначения в семействе GPT-5.6. Отдельная серия O для новых моделей больше не используется.
| Параметр | o1-2024-12-17 | gpt-5.6-sol |
|---|---|---|
| Цена ввода (за 1 млн токенов) | $15.00 | $4.00 |
| Цена вывода (за 1 млн токенов) | $60.00 | $20.00 |
Sol управляет глубиной reasoning через параметр reasoning.mode. Если вашим задачам нужен расширенный reasoning, как у O1, используйте gpt-5.6-sol с reasoning.mode: "pro".
Примеры кода: обновление model ID
Python SDK
До — привязка к устаревшей модели:
from openai import OpenAI
client = OpenAI()
# Устаревший GPT-4
response = client.chat.completions.create(
model="gpt-4-turbo-2024-04-09", # отключается 23 октября
messages=[{"role": "user", "content": "Проанализируй этот отчёт об уязвимостях"}]
)
После — миграция на замену:
from openai import OpenAI
client = OpenAI()
# Миграция на GPT-5.6-Sol
response = client.chat.completions.create(
model="gpt-5.6-sol", # рекомендуемая замена
messages=[{"role": "user", "content": "Проанализируй этот отчёт об уязвимостях"}]
)
Node.js / TypeScript
До:
const response = await openai.chat.completions.create({
model: "gpt-3.5-turbo-0125", // отключается 23 октября
messages: [{ role: "user", content: "Суммаризируй этот документ" }],
});
После:
const response = await openai.chat.completions.create({
model: "gpt-5.6-terra", // экономичная замена
messages: [{ role: "user", content: "Суммаризируй этот документ" }],
});
cURL
До:
curl https://api.openai.com/v1/chat/completions \
-H "Authorization: Bearer $OPENAI_API_KEY" \
-d '{"model": "o1-2024-12-17", "messages": [{"role": "user", "content": "Реши задачу пошагово"}]}'
После:
curl https://api.openai.com/v1/chat/completions \
-H "Authorization: Bearer $OPENAI_API_KEY" \
-d '{"model": "gpt-5.6-sol", "messages": [{"role": "user", "content": "Реши задачу пошагово"}]}'
Azure Foundry: отдельный график
Azure Foundry (бывший Azure OpenAI Service) работает по собственному графику отключений, обычно с задержкой в несколько месяцев относительно прямого API OpenAI. Жизненный цикл моделей в Microsoft — 18 месяцев с момента GA-развёртывания.
Что важно для пользователей Azure:
- Даты отключения GPT-4 и GPT-4-Turbo на Azure могут отличаться от 23 октября в прямом API OpenAI. Проверяйте график отключений Azure Foundry для вашего региона.
- Azure уже отключил некоторые версии GPT-4o (снэпшоты 2024-05-13 и 2024-08-06) 31 марта 2026 года (Microsoft Learn, проверено 2026-09-18).
- Fine-tuned модели на базе отключаемых моделей продолжат работать до полного отключения базовой модели, но новые задачи fine-tuning создавать нельзя.
Если вы используете и Azure, и прямой API OpenAI — аудит нужно делать по каждой среде отдельно. Модель, которая ещё работает на Azure, может уже быть отключена в прямом API, и наоборот.
Настройка fallback-маршрутизации TheRouter
Fallback-маршрутизация TheRouter позволяет настроить автоматическое перенаправление: когда устаревший model ID начинает возвращать ошибки, трафик переключается на замену без изменений в коде.
Пример конфигурации для волны 23 октября:
# therouter.yaml — правила fallback для отключений октября 2026
routes:
- match:
model: "gpt-3.5-turbo-0125"
fallback:
- model: "gpt-5.6-luna" # экономичная замена
- model: "gpt-5.6-terra" # апгрейд по возможностям
- match:
model: "gpt-4-0613"
fallback:
- model: "gpt-5.6-sol"
- match:
model: "gpt-4-turbo-2024-04-09"
fallback:
- model: "gpt-5.6-sol"
- match:
model: "o1-2024-12-17"
fallback:
- model: "gpt-5.6-sol"
Разверните правила до 1 октября, чтобы покрыть отключение GPT-5.4-Cyber, и до 23 октября — для волны устаревших моделей.
Подробнее о настройке fallback — в руководстве по fallback-маршрутизации LLM API.
Контекст: отключения у разных провайдеров во второй половине 2026 года
Октябрь — одна из нескольких волн отключений у разных провайдеров в этом году. Полная картина помогает планировать мощности и избежать неожиданных простоев.
| Провайдер | Дата отключения | Затронутые модели | Руководство |
|---|---|---|---|
| OpenAI | 1 окт. 2026 | gpt-5.4-cyber | Это руководство |
| OpenAI | 23 окт. 2026 | GPT-3.5, GPT-4, O1 | Это руководство |
| DashScope | 10 окт. 2026 | 30+ моделей Qwen, DeepSeek, GLM | Руководство по DashScope окт. 2026 |
| OpenAI | 11 дек. 2026 | Снэпшоты GPT-5 и O3 | Руководство по GPT-5 |
| Anthropic | Постоянно | Серия Claude 3.x | Руководство по Anthropic |
Чек-лист миграции для продакшена
- Меняйте три значения, а не три SDK. Замените
api_key,base_urlиmodelв существующем клиенте OpenAI. Код запроса и ответа оставьте неизменным. - Сопоставьте model ID явно. ID модели у целевого провайдера почти никогда не совпадает с OpenAI ID. Держите словарь
{ openai_id: target_id }вне бизнес-логики. - Проверьте формат streaming. SSE-чанки должны соответствовать контракту OpenAI:
data: {...}+data: [DONE]. Прогоните один streaming вызов до продакшена. - Проверьте rate-limit заголовки. Некоторые провайдеры не возвращают
x-ratelimit-*. Добавьте обёртку с безопасным дефолтом. - Оставьте путь отката. Раскатайте замену под feature flag, гоняйте оба endpoint в shadow-режиме 24 часа, затем переключайтесь.
Шаги, специфичные для октября
-
Проверьте model ID в коде. Поищите
gpt-5.4-cyber,gpt-3.5-turbo-0125,gpt-3.5-turbo,gpt-4-0613,gpt-4,gpt-4-turbo-2024-04-09,gpt-4-turbo,o1-2024-12-17в репозиториях, переменных окружения и конфигурационных файлах. Не забудьте про сторонние библиотеки и инструменты автоматизации. -
Проверьте, куда указывают алиасы. Алиасы
gpt-3.5-turbo,gpt-4,gpt-4-turboбез дат могут ссылаться на отключаемые снэпшоты. Вызовите/v1/models, чтобы узнать, какой снэпшот стоит за вашим алиасом. -
Запустите теневое тестирование. Прогоните вашу тестовую выборку на
gpt-5.6-solиgpt-5.6-terraпараллельно с текущими моделями. Сравните качество, задержку и стоимость. -
Настройте fallback-маршрутизацию. Разверните правила TheRouter (см. выше) в качестве страховочной сети. Даже если model ID обновлены в коде, fallback-маршрутизация перехватит пропущенные ссылки.
-
Мониторьте логи шлюза. После развёртывания следите за запросами, которые всё ещё бьют по устаревшим model ID — это значит, что в коде или интеграциях остались пропуски.
-
Аудит Azure отдельно. Если вы используете Azure Foundry — сверяйтесь с графиком Microsoft отдельно. Даты OpenAI API не обязательно совпадают с Azure.
-
Проверьте обработку ошибок. После отключения запросы к устаревшим моделям вернут HTTP 400 или 404. Убедитесь, что приложение обрабатывает такие ошибки корректно и выдаёт понятные сообщения.
Частые вопросы
Будет ли работать алиас gpt-4 без даты после 23 октября?
Алиас gpt-4 сейчас указывает на снэпшот gpt-4-0613, который отключается 23 октября. После этой даты OpenAI может перенаправить алиас на другую модель или убрать его совсем. Не полагайтесь на стабильность алиасов в период отключений — явно укажите model ID замены.
Какая самая дешёвая замена GPT-3.5-Turbo для массовых задач?
gpt-5.6-luna по $0.20/$1.20 за 1 млн input/output токенов — ближайший ценовой аналог GPT-3.5-Turbo ($0.50/$1.50). Luna значительно превосходит GPT-3.5 по возможностям, оставаясь в том же ценовом порядке. В batch-режиме Luna стоит $0.10/$0.60.
Можно ли использовать gpt-5.6-cyber через стандартный API OpenAI?
Нет. GPT-5.6-Cyber доступен только участникам программы Daybreak Red. Нужно подать заявку, пройти верификацию, подписать ограничения использования и привязать аппаратный ключ безопасности к аккаунту. Для обычной работы в области кибербезопасности OpenAI рекомендует Daybreak Blue (стандартный Sol без системных ограничений) или стандартный Sol без доступа к Daybreak.
Что произойдёт при запросе к отключённой модели?
API вернёт HTTP 400 или 404 с сообщением о том, что модель не существует или выведена из эксплуатации. Запрос не вернёт никакого результата — он сразу завершится с ошибкой.
Источники в этом руководстве проверены 18 сентября 2026 года. OpenAI может обновить даты отключений, цены или рекомендации по замене после публикации. Перед внесением изменений в продакшен всегда сверяйтесь с официальной страницей OpenAI Deprecations.