Теги

Новости по тегу "service-tier"

RSS-лента
Диаграмма дерева решений при маршрутизации long-context запросов между Fast mode и Standard tier

OpenAI Fast Mode снимает ограничение по токенам: какие решения нужно принять командам с long-context routing

Fast mode теперь покрывает запросы объёмом более 272K токенов на GPT-5.6 Sol, Terra и Luna — конец вынужденного использования Standard tier для large-context нагрузок, но ramp rate limit никуда не делся.

источник OpenAI API Changelog
Абстрактная схема маршрутизации, показывающая компромиссы между стоимостью и скоростью при выборе API service tier

OpenAI Fast Mode и снижение цен на GPT-5.6: что должны изменить команды маршрутизации

Priority Processing переименован в Fast mode, GPT-5.6 Luna подешевел на 80%, Terra на 20% — и лимит скорости роста трафика означает, что batch-задачи могут незаметно деградировать до стандартной скорости.

источник OpenAI API Changelog
Помощь и контакты