OpenAI выводит снапшоты gpt-5 и o3 из эксплуатации 11 декабря: что должна проверить каждая команда
OpenAI объявила об устаревании шести первых снапшотов gpt-5 и o3 — все они отключаются 11 декабря 2026 года. Командам, которые ещё использует date-stamped идентификаторы в routing-конфигурациях, дано шесть месяцев на миграцию.

Шесть первых снапшотов gpt-5 и o3 от OpenAI перестанут отвечать на API-запросы 11 декабря 2026 года. Если ваша routing-политика ссылается на какие-либо из этих date-stamped идентификаторов — у вас ровно шесть месяцев до жёсткого дедлайна. Это не рекомендация к миграции, это обязательное требование.
Что именно устаревает
11 июня 2026 года OpenAI уведомила разработчиков о следующих отключениях:
| Идентификатор модели | Дата отключения | Рекомендованная замена |
|---|---|---|
gpt-5-2025-08-07 | 11 дек. 2026 | gpt-5.5 |
gpt-5-mini-2025-08-07 | 11 дек. 2026 | gpt-5.4-mini |
gpt-5-nano-2025-08-07 | 11 дек. 2026 | gpt-5.4-nano |
gpt-5-pro-2025-10-06 | 11 дек. 2026 | gpt-5.5-pro |
o3-2025-04-16 | 11 дек. 2026 | gpt-5.5 |
o3-pro-2025-06-10 | 11 дек. 2026 | gpt-5.5-pro |
Это вторая крупная волна устаревания за 2026 год. Первая прокатилась в конце мая и вывела из эксплуатации такие модели, как gpt-4, o1 и o4-mini. Нынешняя волна принципиально отличается: она затрагивает первые публичные снапшоты семейства gpt-5 и оба варианта o3. Команды, которые намеренно закрепили date-stamped идентификаторы ради стабильного поведения, теперь обязаны пройти повторную валидацию и перейти на актуальные версии.
Почему это важнее майской волны
Майская волна списывала со счетов модели уже нескольких поколений назад — большинство инженерных команд либо уже мигрировали, либо имели готовый план. Эта волна требует большего внимания по двум причинам.
Первое: o3 → gpt-5.5 — не прямая замена. OpenAI предлагает заменить как o3-2025-04-16, так и o3-pro-2025-06-10 на gpt-5.5 / gpt-5.5-pro. Однако gpt-5.5 — это chat-completion модель, тогда как o3 была reasoning-моделью с отдельной парадигмой мышления. Команды, которые полагаются на структурированный вывод рассуждений o3, специфику системных промптов или расширенный контекстный режим, должны тщательно проверить, даёт ли gpt-5.5 с включённым Thinking mode эквивалентный или лучший результат на их конкретных рабочих нагрузках.
Второе: переход gpt-5-pro → gpt-5.5-pro означает смену уровня возможностей. Если ваша routing-политика направляет высококритичные задачи на gpt-5-pro-2025-10-06, необходимо заранее убедиться, что gpt-5.5-pro проходит ваши eval-тесты на нужном уровне.
Чеклист аудита для routing-команд
До 11 декабря командам стоит сделать следующее:
-
Найти date-stamped идентификаторы в конфигурациях. Любое упоминание
gpt-5-2025,gpt-5-mini-2025,gpt-5-nano-2025,gpt-5-pro-2025,o3-2025илиo3-pro-2025— это цель для миграции. -
Разделить snapshot-закрепления и fallback-цепочки. Если вы используете date-stamped идентификаторы в качестве fallback target (например, откатываться на
gpt-5-2025-08-07при перегрузкеgpt-5.5), ваша fallback-цепочка сломается 11 декабря. Обновите fallback target на рекомендованные замены. -
Провести тест возможностей провайдера для миграции o3 → gpt-5.5. Смена paradigm рассуждения означает, что поведенческая валидация обязательна — простого benchmark по latency и стоимости недостаточно. Тестируйте на самых критичных агентских и кодировочных задачах.
-
Проверить кеши и шаблоны промптов. Некоторые команды кешируют форматы промптов или системные инструкции под конкретную модель. Tokenizer и поведение при следовании инструкциям у gpt-5.5 достаточно отличаются от o3, чтобы требовать систематического пересмотра промптов.
-
Пересчитать бюджет API.
gpt-5.5иgpt-5.5-proтарифицируются иначе, чем их предшественники o3. Если ваша модель расходов базируется на исторических тарифах o3, пересчитайте прогноз по ценам gpt-5.5 до завершения миграции. -
Установить вехи миграции. Шесть месяцев кажутся большим запасом, но они проходят через летнее замедление Q3 и праздничный сезон. Рекомендуемый ритм: завершить валидацию к августу, выкатить на staging-маршрутизацию к октябрю, перевести production к ноябрю — декабрь оставить как буфер.
На что обратить внимание при миграции gpt-5
Командам, использующим gpt-5-2025-08-07 или gpt-5-mini-2025-08-07, переход на gpt-5.5 или gpt-5.4-mini ближе к прямой замене: тот же chat-completions API, те же параметры. Основные риски:
- Расхождения в following инструкций. Более поздние снапшоты семейства gpt-5 иначе реагируют на системные промпты, отточенные под поведение августа 2025 года. Прогоните существующий eval-набор на целевой модели перед финальным решением.
- Изменение профиля latency. У
gpt-5.5могут быть другие характеристики p50/p99. Если у вас есть latency-чувствительные правила маршрутизации (например, откат на gpt-5.4-mini при превышении 2-секундного бюджета) — пересчитайте пороги.
Что стоит сделать прямо сейчас
Командам, которые маршрутизируют запросы к OpenAI через gateway, нужно проверить каждую конфигурацию именованной модели, правило routing и fallback-цепочку, ссылающуюся на любой из шести устаревших идентификаторов. Обновите поле target model на рекомендованные замены и протестируйте изменения на staging-маршруте до вывода в production. Для миграции o3→gpt-5.5 стоит прогнать сравнительный eval с включённым Thinking mode — поведенческий контракт меняется достаточно существенно, чтобы не ограничиваться только неформальными smoke-тестами.
Для миграций, охватывающих несколько провайдеров или уровней моделей, рекомендуем до августа провести единый аудит routing-политики: составить список всех закреплённых идентификаторов, их статус устаревания и запланированную замену.
Модели, упомянутые в статье
Похожие материалы
Новости AI-роутинга и провайдеров →
OpenAI выводит из эксплуатации девять моделей Audio и Realtime к январю 2027 года: миграция, которую обязаны завершить операторы
20 июля OpenAI вывела из эксплуатации девять legacy-моделей audio и realtime — отключение 20 января 2027 г. Миграция: замена строки модели, но операторам с трафиком через gpt-4o-audio, gpt-4o-realtime и gpt-audio нужен полный аудит конфигурации.

Скорбалл OpenAI «Полезный интеллект на доллар»: чек-лист роутинговой политики для каждого оператора AI-шлюза
OpenAI опубликовала четырёхмерный фреймворк — «Useful Intelligence per Dollar» — который переосмысляет оценку моделей: вместо стоимости токена — стоимость успешно выполненной задачи. Вот что должен изменить каждый оператор роутинга уже сегодня.

GPT-Live voice API routing: full-duplex voice превращает delegation policy в точку контроля
GPT-Live voice API routing становится новым operator решением: OpenAI ведет full-duplex voice, background delegation и realtime safeguards к developer API.