
OpenAI 拆分了限流 429:'slow_down' 和 'server_is_overloaded' 对你的重试策略意味着什么
OpenAI 现在对两种此前看起来相同的 429 返回不同的错误码——发包速率过快得到 slow_down,模型饱和返回 503。你的重试逻辑必须分开处理它们。
来源 OpenAI API Changelog

OpenAI 现在对两种此前看起来相同的 429 返回不同的错误码——发包速率过快得到 slow_down,模型饱和返回 503。你的重试逻辑必须分开处理它们。

DashScope 限流 fallback 路由已经成为明确的 operator 模式:阿里云文档列出了 RPM、TPM、突发保护、备选模型、Batch API 和 30 天临时 TPM 提额。

Anthropic 于 6 月 26 日将 Sonnet 和 Haiku 的 RPM、ITPM、OTPM 上限与 Opus 拉平,并将五个用量分层合并为三个。本文解析新 Start/Build/Scale 架构对回退路由策略和消费上限管理的实质影响。

Anthropic 将 Claude Code 限额翻倍并大幅提升 Opus API 速率限制,背后是 SpaceX Colossus 1 的 22 万张 GPU。了解降级触发、调度策略和多 provider 路由的变化。