OpenAI выводит снапшоты gpt-5 и o3 из эксплуатации 11 декабря: что должна проверить каждая команда

OpenAI объявила об устаревании шести первых снапшотов gpt-5 и o3 — все они отключаются 11 декабря 2026 года. Командам, которые ещё использует date-stamped идентификаторы в routing-конфигурациях, дано шесть месяцев на миграцию.

TheRouter Newsroomисточник OpenAI
Диаграмма маршрутизации с переходами между версиями моделей и таймлайнами устаревания

Шесть первых снапшотов gpt-5 и o3 от OpenAI перестанут отвечать на API-запросы 11 декабря 2026 года. Если ваша routing-политика ссылается на какие-либо из этих date-stamped идентификаторов — у вас ровно шесть месяцев до жёсткого дедлайна. Это не рекомендация к миграции, это обязательное требование.

Что именно устаревает

11 июня 2026 года OpenAI уведомила разработчиков о следующих отключениях:

Идентификатор моделиДата отключенияРекомендованная замена
gpt-5-2025-08-0711 дек. 2026gpt-5.5
gpt-5-mini-2025-08-0711 дек. 2026gpt-5.4-mini
gpt-5-nano-2025-08-0711 дек. 2026gpt-5.4-nano
gpt-5-pro-2025-10-0611 дек. 2026gpt-5.5-pro
o3-2025-04-1611 дек. 2026gpt-5.5
o3-pro-2025-06-1011 дек. 2026gpt-5.5-pro

Это вторая крупная волна устаревания за 2026 год. Первая прокатилась в конце мая и вывела из эксплуатации такие модели, как gpt-4, o1 и o4-mini. Нынешняя волна принципиально отличается: она затрагивает первые публичные снапшоты семейства gpt-5 и оба варианта o3. Команды, которые намеренно закрепили date-stamped идентификаторы ради стабильного поведения, теперь обязаны пройти повторную валидацию и перейти на актуальные версии.

Почему это важнее майской волны

Майская волна списывала со счетов модели уже нескольких поколений назад — большинство инженерных команд либо уже мигрировали, либо имели готовый план. Эта волна требует большего внимания по двум причинам.

Первое: o3 → gpt-5.5 — не прямая замена. OpenAI предлагает заменить как o3-2025-04-16, так и o3-pro-2025-06-10 на gpt-5.5 / gpt-5.5-pro. Однако gpt-5.5 — это chat-completion модель, тогда как o3 была reasoning-моделью с отдельной парадигмой мышления. Команды, которые полагаются на структурированный вывод рассуждений o3, специфику системных промптов или расширенный контекстный режим, должны тщательно проверить, даёт ли gpt-5.5 с включённым Thinking mode эквивалентный или лучший результат на их конкретных рабочих нагрузках.

Второе: переход gpt-5-pro → gpt-5.5-pro означает смену уровня возможностей. Если ваша routing-политика направляет высококритичные задачи на gpt-5-pro-2025-10-06, необходимо заранее убедиться, что gpt-5.5-pro проходит ваши eval-тесты на нужном уровне.

Чеклист аудита для routing-команд

До 11 декабря командам стоит сделать следующее:

  1. Найти date-stamped идентификаторы в конфигурациях. Любое упоминание gpt-5-2025, gpt-5-mini-2025, gpt-5-nano-2025, gpt-5-pro-2025, o3-2025 или o3-pro-2025 — это цель для миграции.

  2. Разделить snapshot-закрепления и fallback-цепочки. Если вы используете date-stamped идентификаторы в качестве fallback target (например, откатываться на gpt-5-2025-08-07 при перегрузке gpt-5.5), ваша fallback-цепочка сломается 11 декабря. Обновите fallback target на рекомендованные замены.

  3. Провести тест возможностей провайдера для миграции o3 → gpt-5.5. Смена paradigm рассуждения означает, что поведенческая валидация обязательна — простого benchmark по latency и стоимости недостаточно. Тестируйте на самых критичных агентских и кодировочных задачах.

  4. Проверить кеши и шаблоны промптов. Некоторые команды кешируют форматы промптов или системные инструкции под конкретную модель. Tokenizer и поведение при следовании инструкциям у gpt-5.5 достаточно отличаются от o3, чтобы требовать систематического пересмотра промптов.

  5. Пересчитать бюджет API. gpt-5.5 и gpt-5.5-pro тарифицируются иначе, чем их предшественники o3. Если ваша модель расходов базируется на исторических тарифах o3, пересчитайте прогноз по ценам gpt-5.5 до завершения миграции.

  6. Установить вехи миграции. Шесть месяцев кажутся большим запасом, но они проходят через летнее замедление Q3 и праздничный сезон. Рекомендуемый ритм: завершить валидацию к августу, выкатить на staging-маршрутизацию к октябрю, перевести production к ноябрю — декабрь оставить как буфер.

На что обратить внимание при миграции gpt-5

Командам, использующим gpt-5-2025-08-07 или gpt-5-mini-2025-08-07, переход на gpt-5.5 или gpt-5.4-mini ближе к прямой замене: тот же chat-completions API, те же параметры. Основные риски:

  • Расхождения в following инструкций. Более поздние снапшоты семейства gpt-5 иначе реагируют на системные промпты, отточенные под поведение августа 2025 года. Прогоните существующий eval-набор на целевой модели перед финальным решением.
  • Изменение профиля latency. У gpt-5.5 могут быть другие характеристики p50/p99. Если у вас есть latency-чувствительные правила маршрутизации (например, откат на gpt-5.4-mini при превышении 2-секундного бюджета) — пересчитайте пороги.

Что стоит сделать прямо сейчас

Командам, которые маршрутизируют запросы к OpenAI через gateway, нужно проверить каждую конфигурацию именованной модели, правило routing и fallback-цепочку, ссылающуюся на любой из шести устаревших идентификаторов. Обновите поле target model на рекомендованные замены и протестируйте изменения на staging-маршруте до вывода в production. Для миграции o3→gpt-5.5 стоит прогнать сравнительный eval с включённым Thinking mode — поведенческий контракт меняется достаточно существенно, чтобы не ограничиваться только неформальными smoke-тестами.

Для миграций, охватывающих несколько провайдеров или уровней моделей, рекомендуем до августа провести единый аудит routing-политики: составить список всех закреплённых идентификаторов, их статус устаревания и запланированную замену.

Модели, упомянутые в статье

Диаграмма маршрутизации, отображающая сопоставление девяти устаревших идентификаторов audio и realtime моделей с их заменами к январю 2027 года, выдержанная в приглушённой сине-серой палитре

OpenAI выводит из эксплуатации девять моделей Audio и Realtime к январю 2027 года: миграция, которую обязаны завершить операторы

20 июля OpenAI вывела из эксплуатации девять legacy-моделей audio и realtime — отключение 20 января 2027 г. Миграция: замена строки модели, но операторам с трафиком через gpt-4o-audio, gpt-4o-realtime и gpt-audio нужен полный аудит конфигурации.

источник OpenAI API
Абстрактная схема роутинга с уровнями выбора модели по соотношению стоимости и результата, проходящими через AI-шлюз

Скорбалл OpenAI «Полезный интеллект на доллар»: чек-лист роутинговой политики для каждого оператора AI-шлюза

OpenAI опубликовала четырёхмерный фреймворк — «Useful Intelligence per Dollar» — который переосмысляет оценку моделей: вместо стоимости токена — стоимость успешно выполненной задачи. Вот что должен изменить каждый оператор роутинга уже сегодня.

источник OpenAI
Поддержка