Теги

Новости по тегу "rate-limits"

RSS-лента
Две разделяющиеся ветки ошибок API — 429 slow_down и 503 server_is_overloaded — с отдельными метками стратегии повторных запросов

OpenAI разделил 429 для ограничений: что 'slow_down' и 'server_is_overloaded' означают для вашей политики повторных запросов

OpenAI теперь возвращает разные коды ошибок для двух ситуаций: slow_down для слишком быстрого роста трафика и 503 server_is_overloaded для перегрузки модели.

источник OpenAI API Changelog
Anthropic Claude API унификация лимитов уровней маршрутизация — консолидация Start Build Scale editorial

Anthropic унифицирует лимиты API Claude: что означает паритет Sonnet/Haiku/Opus для команд маршрутизации

26 июня Anthropic выровняла RPM, ITPM и OTPM для Sonnet и Haiku до уровня Opus и консолидировала пять уровней использования в три. Что новая структура Start/Build/Scale означает для политики fallback-маршрутизации и управления лимитами расходов.

источник Anthropic Platform Docs
Помощь и контакты