← Все статьи

Руководство по миграции моделей OpenAI в октябре 2026: GPT-5.4-Cyber, GPT-3.5, GPT-4 и O1 — сроки и замены

OpenAI отключает gpt-5.4-cyber 1 октября и выводит из эксплуатации gpt-3.5-turbo, gpt-4, gpt-4-turbo и o1 23 октября 2026 года. Руководство по миграции: полная матрица замен, примеры кода, анализ цен, особенности Azure Foundry и чек-лист для продакшена.

· TheRouter

Руководство по миграции моделей OpenAI в октябре 2026

В октябре 2026 года пользователей OpenAI API ждут две волны отключений. 1 октября перестаёт работать специализированная модель gpt-5.4-cyber. 23 октября уходит группа устаревших моделей — gpt-3.5-turbo-0125, gpt-4-0613, gpt-4-turbo-2024-04-09 и o1-2024-12-17. Если ваш код привязан к любому из этих model ID, действовать нужно сейчас — счёт идёт на дни, а не на месяцы.

В этом руководстве — точная матрица замен, примеры кода до и после миграции, анализ изменения цен, контекст по Azure Foundry и пошаговый чек-лист для продакшена. Мы также покажем, как fallback-маршрутизация TheRouter автоматически перенаправляет трафик при отключении модели.

Мы маршрутизируем OpenAI-совместимые запросы через настроенных провайдеров и поддерживаем fallback на уровне провайдеров и моделей там, где это реализовано в продукте. Мы не заявляем поддержку всех моделей, нулевого даунтайма или гарантированно самых низких цен. Все даты и цены взяты из официальной документации OpenAI на момент проверки.

OpenAI-совместимость означает, что провайдер предоставляет endpoint chat-completions, чей контракт запроса и ответа достаточно близок к API OpenAI, чтобы немодифицированный вызов OpenAI SDK работал после замены трёх значений: API key, base URL, название модели. Минимальная поверхность на практике —POST /v1/chat/completions с messages, model и потоковым ответом в форме OpenAI.

Коротко — за 30 секунд

  • 1 октября 2026 года — gpt-5.4-cyber прекращает работу. Замена — gpt-5.6-cyber (нужен доступ к Daybreak Red) (OpenAI Deprecations, проверено 2026-09-18).
  • 23 октября 2026 года — отключаются gpt-3.5-turbo-0125, gpt-4-0613, gpt-4-turbo-2024-04-09, o1-2024-12-17 (OpenAI Deprecations, проверено 2026-09-18).
  • Рекомендуемые замены — семейство GPT-5.6: Sol для флагманских задач, Terra для среднего уровня, Luna для лёгких нагрузок.
  • Что делать прямо сейчас — проверить model ID в коде, запустить теневое тестирование замен, настроить fallback-маршрутизацию. До дедлайна 1 октября осталось 13 дней.

Полный график отключений в октябре

Волна 1 — 1 октября: отключение GPT-5.4-Cyber

Отключаемая модельДатаЗаменаДоступ
gpt-5.4-cyber1 окт. 2026gpt-5.6-cyberТолько Daybreak Red

GPT-5.4-Cyber — первая специализированная модель OpenAI для кибербезопасности, запущенная в апреле 2026 года в рамках программы Daybreak. Преемник GPT-5.6-Cyber был представлен 10 августа 2026 года. Он построен на архитектуре Sol и значительно улучшил показатели на продвинутых тестах кибербезопасности — 95% против 57,3% у GPT-5.5-Cyber (анонс OpenAI Daybreak, проверено 2026-09-18).

GPT-5.6-Cyber доступен только по заявке. Публичного model ID для API нет. Для Daybreak Red требуется верификация личности, согласие на ограничения использования и аппаратный ключ безопасности на аккаунте с 1 сентября 2026 года. Команды без доступа к Daybreak Red могут использовать стандартный gpt-5.6-sol, который набирает 96,7% на CTF-бенчмарках и 73,5% на ExploitBench без какого-либо доступа к Daybreak (обзор GPT-5.6-Cyber на eesel.ai, проверено 2026-09-18).

Волна 2 — 23 октября: массовое отключение устаревших моделей

Отключаемая модельДатаЗаменаКатегория
gpt-3.5-turbo-012523 окт. 2026gpt-5.6-terraУстаревший чат
gpt-4-061323 окт. 2026gpt-5.6-solУстаревший флагман
gpt-4-turbo-2024-04-0923 окт. 2026gpt-5.6-solУстаревший turbo
o1-2024-12-1723 окт. 2026gpt-5.6-solРанний reasoning

Эта волна убирает последние датированные снэпшоты GPT-3.5, GPT-4 и первой модели O1. OpenAI объявил об этих отключениях 22 апреля 2026 года, предоставив стандартное 6-месячное уведомление для GA-моделей (форум OpenAI, проверено 2026-09-18).

После 23 октября алиас gpt-3.5-turbo без даты тоже перестанет работать, если он указывает на отключаемый снэпшот 0125. Проверьте, на какой снэпшот сейчас ссылается ваш алиас.

Пути миграции по моделям

GPT-3.5-Turbo → GPT-5.6-Terra

GPT-5.6-Terra — модель среднего уровня в семействе GPT-5.6. Для рабочих нагрузок, где GPT-3.5-Turbo использовался ради экономии, Terra даёт серьёзный прирост возможностей, но стоит дороже.

Параметрgpt-3.5-turbo-0125gpt-5.6-terra
Цена ввода (за 1 млн токенов)$0.50$2.00
Цена вывода (за 1 млн токенов)$1.50$12.00
Кэшированный вводНет$0.20
Batch вводНет$1.00
Batch выводНет$6.00

Рост цен заметный — ввод в 4 раза, вывод в 8 раз по стандартным тарифам. Две стратегии помогают снизить разницу. Первая — prompt caching у GPT-5.6-Terra: кэшированный ввод стоит $0.20 за 1 млн токенов, на 90% дешевле обычного ввода. Для задач с повторяющимися префиксами кэширование значительно сглаживает рост. Вторая — batch-обработка, которая снижает тарифы на 50% для задач, нечувствительных к задержке (OpenAI Pricing, проверено 2026-09-18).

Для высоконагруженных задач, где возможностей GPT-3.5-Turbo хватало, рассмотрите gpt-5.6-luna ($0.20/$1.20 за 1 млн токенов). По цене Luna ближе к старому GPT-3.5, при этом уже на уровне GPT-5.6 по возможностям.

GPT-4 и GPT-4-Turbo → GPT-5.6-Sol

Обе модели — gpt-4-0613 и gpt-4-turbo-2024-04-09 — замещаются на gpt-5.6-sol, флагманский уровень.

Параметрgpt-4-0613gpt-4-turbogpt-5.6-sol
Цена ввода (за 1 млн токенов)$30.00$10.00$4.00
Цена вывода (за 1 млн токенов)$60.00$30.00$20.00
Кэшированный вводНетНет$0.40

При переходе с GPT-4 (0613) на Sol ввод дешевеет на 87%, вывод — на 67%. С GPT-4-Turbo экономия составляет 60% на вводе и 33% на выводе. Редкий случай, когда замена одновременно мощнее и дешевле (OpenAI Pricing, проверено 2026-09-18).

O1 → GPT-5.6-Sol

Модель reasoning o1-2024-12-17 замещается на gpt-5.6-sol. OpenAI объединил линейки reasoning и общего назначения в семействе GPT-5.6. Отдельная серия O для новых моделей больше не используется.

Параметрo1-2024-12-17gpt-5.6-sol
Цена ввода (за 1 млн токенов)$15.00$4.00
Цена вывода (за 1 млн токенов)$60.00$20.00

Sol управляет глубиной reasoning через параметр reasoning.mode. Если вашим задачам нужен расширенный reasoning, как у O1, используйте gpt-5.6-sol с reasoning.mode: "pro".

Примеры кода: обновление model ID

Python SDK

До — привязка к устаревшей модели:

from openai import OpenAI

client = OpenAI()

# Устаревший GPT-4
response = client.chat.completions.create(
    model="gpt-4-turbo-2024-04-09",  # отключается 23 октября
    messages=[{"role": "user", "content": "Проанализируй этот отчёт об уязвимостях"}]
)

После — миграция на замену:

from openai import OpenAI

client = OpenAI()

# Миграция на GPT-5.6-Sol
response = client.chat.completions.create(
    model="gpt-5.6-sol",  # рекомендуемая замена
    messages=[{"role": "user", "content": "Проанализируй этот отчёт об уязвимостях"}]
)

Node.js / TypeScript

До:

const response = await openai.chat.completions.create({
  model: "gpt-3.5-turbo-0125",  // отключается 23 октября
  messages: [{ role: "user", content: "Суммаризируй этот документ" }],
});

После:

const response = await openai.chat.completions.create({
  model: "gpt-5.6-terra",  // экономичная замена
  messages: [{ role: "user", content: "Суммаризируй этот документ" }],
});

cURL

До:

curl https://api.openai.com/v1/chat/completions \
  -H "Authorization: Bearer $OPENAI_API_KEY" \
  -d '{"model": "o1-2024-12-17", "messages": [{"role": "user", "content": "Реши задачу пошагово"}]}'

После:

curl https://api.openai.com/v1/chat/completions \
  -H "Authorization: Bearer $OPENAI_API_KEY" \
  -d '{"model": "gpt-5.6-sol", "messages": [{"role": "user", "content": "Реши задачу пошагово"}]}'

Azure Foundry: отдельный график

Azure Foundry (бывший Azure OpenAI Service) работает по собственному графику отключений, обычно с задержкой в несколько месяцев относительно прямого API OpenAI. Жизненный цикл моделей в Microsoft — 18 месяцев с момента GA-развёртывания.

Что важно для пользователей Azure:

  • Даты отключения GPT-4 и GPT-4-Turbo на Azure могут отличаться от 23 октября в прямом API OpenAI. Проверяйте график отключений Azure Foundry для вашего региона.
  • Azure уже отключил некоторые версии GPT-4o (снэпшоты 2024-05-13 и 2024-08-06) 31 марта 2026 года (Microsoft Learn, проверено 2026-09-18).
  • Fine-tuned модели на базе отключаемых моделей продолжат работать до полного отключения базовой модели, но новые задачи fine-tuning создавать нельзя.

Если вы используете и Azure, и прямой API OpenAI — аудит нужно делать по каждой среде отдельно. Модель, которая ещё работает на Azure, может уже быть отключена в прямом API, и наоборот.

Настройка fallback-маршрутизации TheRouter

Fallback-маршрутизация TheRouter позволяет настроить автоматическое перенаправление: когда устаревший model ID начинает возвращать ошибки, трафик переключается на замену без изменений в коде.

Пример конфигурации для волны 23 октября:

# therouter.yaml — правила fallback для отключений октября 2026
routes:
  - match:
      model: "gpt-3.5-turbo-0125"
    fallback:
      - model: "gpt-5.6-luna"    # экономичная замена
      - model: "gpt-5.6-terra"   # апгрейд по возможностям

  - match:
      model: "gpt-4-0613"
    fallback:
      - model: "gpt-5.6-sol"

  - match:
      model: "gpt-4-turbo-2024-04-09"
    fallback:
      - model: "gpt-5.6-sol"

  - match:
      model: "o1-2024-12-17"
    fallback:
      - model: "gpt-5.6-sol"

Разверните правила до 1 октября, чтобы покрыть отключение GPT-5.4-Cyber, и до 23 октября — для волны устаревших моделей.

Подробнее о настройке fallback — в руководстве по fallback-маршрутизации LLM API.

Контекст: отключения у разных провайдеров во второй половине 2026 года

Октябрь — одна из нескольких волн отключений у разных провайдеров в этом году. Полная картина помогает планировать мощности и избежать неожиданных простоев.

ПровайдерДата отключенияЗатронутые моделиРуководство
OpenAI1 окт. 2026gpt-5.4-cyberЭто руководство
OpenAI23 окт. 2026GPT-3.5, GPT-4, O1Это руководство
DashScope10 окт. 202630+ моделей Qwen, DeepSeek, GLMРуководство по DashScope окт. 2026
OpenAI11 дек. 2026Снэпшоты GPT-5 и O3Руководство по GPT-5
AnthropicПостоянноСерия Claude 3.xРуководство по Anthropic

Чек-лист миграции для продакшена

  1. Меняйте три значения, а не три SDK. Замените api_key, base_url и model в существующем клиенте OpenAI. Код запроса и ответа оставьте неизменным.
  2. Сопоставьте model ID явно. ID модели у целевого провайдера почти никогда не совпадает с OpenAI ID. Держите словарь { openai_id: target_id } вне бизнес-логики.
  3. Проверьте формат streaming. SSE-чанки должны соответствовать контракту OpenAI: data: {...} + data: [DONE]. Прогоните один streaming вызов до продакшена.
  4. Проверьте rate-limit заголовки. Некоторые провайдеры не возвращают x-ratelimit-*. Добавьте обёртку с безопасным дефолтом.
  5. Оставьте путь отката. Раскатайте замену под feature flag, гоняйте оба endpoint в shadow-режиме 24 часа, затем переключайтесь.

Шаги, специфичные для октября

  1. Проверьте model ID в коде. Поищите gpt-5.4-cyber, gpt-3.5-turbo-0125, gpt-3.5-turbo, gpt-4-0613, gpt-4, gpt-4-turbo-2024-04-09, gpt-4-turbo, o1-2024-12-17 в репозиториях, переменных окружения и конфигурационных файлах. Не забудьте про сторонние библиотеки и инструменты автоматизации.

  2. Проверьте, куда указывают алиасы. Алиасы gpt-3.5-turbo, gpt-4, gpt-4-turbo без дат могут ссылаться на отключаемые снэпшоты. Вызовите /v1/models, чтобы узнать, какой снэпшот стоит за вашим алиасом.

  3. Запустите теневое тестирование. Прогоните вашу тестовую выборку на gpt-5.6-sol и gpt-5.6-terra параллельно с текущими моделями. Сравните качество, задержку и стоимость.

  4. Настройте fallback-маршрутизацию. Разверните правила TheRouter (см. выше) в качестве страховочной сети. Даже если model ID обновлены в коде, fallback-маршрутизация перехватит пропущенные ссылки.

  5. Мониторьте логи шлюза. После развёртывания следите за запросами, которые всё ещё бьют по устаревшим model ID — это значит, что в коде или интеграциях остались пропуски.

  6. Аудит Azure отдельно. Если вы используете Azure Foundry — сверяйтесь с графиком Microsoft отдельно. Даты OpenAI API не обязательно совпадают с Azure.

  7. Проверьте обработку ошибок. После отключения запросы к устаревшим моделям вернут HTTP 400 или 404. Убедитесь, что приложение обрабатывает такие ошибки корректно и выдаёт понятные сообщения.

Частые вопросы

Будет ли работать алиас gpt-4 без даты после 23 октября?

Алиас gpt-4 сейчас указывает на снэпшот gpt-4-0613, который отключается 23 октября. После этой даты OpenAI может перенаправить алиас на другую модель или убрать его совсем. Не полагайтесь на стабильность алиасов в период отключений — явно укажите model ID замены.

Какая самая дешёвая замена GPT-3.5-Turbo для массовых задач?

gpt-5.6-luna по $0.20/$1.20 за 1 млн input/output токенов — ближайший ценовой аналог GPT-3.5-Turbo ($0.50/$1.50). Luna значительно превосходит GPT-3.5 по возможностям, оставаясь в том же ценовом порядке. В batch-режиме Luna стоит $0.10/$0.60.

Можно ли использовать gpt-5.6-cyber через стандартный API OpenAI?

Нет. GPT-5.6-Cyber доступен только участникам программы Daybreak Red. Нужно подать заявку, пройти верификацию, подписать ограничения использования и привязать аппаратный ключ безопасности к аккаунту. Для обычной работы в области кибербезопасности OpenAI рекомендует Daybreak Blue (стандартный Sol без системных ограничений) или стандартный Sol без доступа к Daybreak.

Что произойдёт при запросе к отключённой модели?

API вернёт HTTP 400 или 404 с сообщением о том, что модель не существует или выведена из эксплуатации. Запрос не вернёт никакого результата — он сразу завершится с ошибкой.


Источники в этом руководстве проверены 18 сентября 2026 года. OpenAI может обновить даты отключений, цены или рекомендации по замене после публикации. Перед внесением изменений в продакшен всегда сверяйтесь с официальной страницей OpenAI Deprecations.

Помощь и контакты