Claude Sonnet 5 发布:Anthropic 最强 Sonnet 级 agentic 模型上线,限时定价窗口如何影响路由策略
Claude Sonnet 5 以 $2/$10(每百万 token)的限时定价上线,截止 8 月 31 日后将回调至 $3/$15。该模型取代 Sonnet 4.6 成为 Anthropic 默认模型,并在 Sonnet 级定价下实现接近 Opus 的 agentic 性能。以下是路由团队的应对策略。

Anthropic 于 2026 年 6 月 30 日发布 Claude Sonnet 5,该模型从三个维度改变了 AI 工程团队的路由决策:新的默认模型 ID、有时间限制的限时定价窗口,以及 Sonnet 与 Opus 之间重新划定的成本-性能 Pareto 边界。
发生了什么
Claude Sonnet 5 即日起在 Anthropic 全平台上线,API 调用者可通过模型标识符 claude-sonnet-5 访问。它现在是 Free 和 Pro 计划的默认模型,取代了 Sonnet 4.6。
API 定价:
| 时间段 | 输入(每百万 token) | 输出(每百万 token) |
|---|---|---|
| 现在 → 2026 年 8 月 31 日 | $2.00 | $10.00 |
| 2026 年 9 月 1 日起 | $3.00 | $15.00 |
与 Sonnet 4.6($3/$15)相比,限时定价在输入和输出两端均享有 33% 的折扣——在能力更强的前提下,价格与 Sonnet 4.6 9 月后的价格相当。
相比 Sonnet 4.6 的关键 benchmark 提升:
- BrowseComp(agentic 搜索)和 OSWorld-Verified(计算机操作)在相同 effort 级别下得分更高。
- 幻觉率和谄媚行为率更低。
- 在 agentic 上下文中,对 prompt 注入和恶意请求的抵抗能力更强。
在更高 effort 设置下,Sonnet 5 的性能接近 Opus 4.8,而 token 成本仅为后者的 60–80%。
对 AI 工程团队的影响
模型 ID 迁移已经生效。 任何硬编码 claude-sonnet-4-6 的系统将保持使用旧模型。路由到通用别名 claude-sonnet-latest 或依赖 gateway 模型别名系统的团队将自动获得 Sonnet 5。请验证你的路由配置实际解析的是哪个模型 ID。
限时窗口带来两个月的成本优势。 在 $2/$10 的价格下,Sonnet 5 比原价 $3/$15 的 Sonnet 4.6 便宜——且输出质量更好。一直在等待内部评估周期再升级 Sonnet 4.6 的团队,现在有了立即迁移的成本动力。
Effort 级别路由成为新的调节旋钮。 Anthropic 的 BrowseComp 对比图显示,Sonnet 5 在中等 effort 下的表现优于 Sonnet 4.6 在最高 effort 下的表现。这意味着许多团队正确的路由策略不再是"成本用 Sonnet,质量用 Opus",而是"大多数任务用 Sonnet 5 配合合理 effort,只有任务明确需要时才使用 Opus 4.8"。这缩小了 Opus 的使用场景。
编程 agent 和多步骤自动化工作负载是主要受益者。 发布公告中引用的合作伙伴反馈涵盖:复杂 PR 审查不再中途停止、多系统任务端到端自动化、无需重复 prompt 的持续调试。如果你运行 Cursor、Claude Code 或自定义编程 agent,此前需要 Opus 才能保证执行连贯性,Sonnet 5 是第一个值得以完全自主模式重测的 Sonnet 级模型。
Router/operator 视角
何时路由到 Sonnet 5,何时保留 Opus 4.8
基于发布数据的最清晰决策框架:
- Sonnet 5(高 effort):长周期编程任务、计算机操作、多步骤工具链、法律/研究分析、棕地调试。该模型在这些场景下接近 Opus 级质量。
- Sonnet 5(中等 effort):单轮生成、摘要、结构化输出、分类。最佳成本性能组合。
- Opus 4.8:Sonnet 5 在高 effort 下仍无法达到你的评估标准的任务——通常是需要顶级推理能力处理全新问题,或需要超长、不间断上下文链的任务。保留为 fallback 或高级档,而非默认路由。
定价窗口:何时锁定 Sonnet 5
8 月 31 日的截止日期对有使用协议或预谈判费率的团队很重要。如果能在 9 月 1 日前将流量切换到 Sonnet 5,限时 $2/$10 费率即可生效。此后 Sonnet 5 恢复至 $3/$15——与 Sonnet 4.6 发布时的价格一致。9 月 1 日后不再有长期折扣优势,迁移决策将完全基于能力评估。
模型命名与别名规范
Anthropic 的模型命名延续数字后缀模式(4.6 → 5)。如果路由配置使用精确版本字符串,立即将其固定为 claude-sonnet-5,并规划好在 Anthropic 发布下一个版本前的复审周期。如果使用 claude-sonnet-latest,验证你的 provider 能否将其正确解析为 Sonnet 5 而非缓存的历史别名。
TheRouter 用户应关注或尝试的内容
通过支持 Anthropic API 的 AI gateway 进行路由的团队,可以立即将 provider 模型配置更新为 claude-sonnet-5,开始享受限时定价窗口。如果你使用 fallback 链路由(例如,Sonnet 出错或超时时 fallback 至 Opus),考虑 Sonnet 5 改进的 agentic 可靠性是否会降低 Opus fallback 的实际触发频率。更低的 fallback 率直接转化为更低的单次请求成本。
如果你的 provider 支持 Anthropic 的 thinking 参数和 reasoning_effort 字段,请检查 effort 级别设置——Sonnet 5 的性能提升在中高 effort 下最为显著,以固定低 effort 路由会低估该模型的实际能力。
Claude API 模型概览中,claude-sonnet-5 为当前模型 ID。
本文涉及的模型
相关阅读
AI 路由新闻与供应商动态 →
Claude Fable 5 正式发布:新模型 ID、拒绝语义与 Token 计费变化对路由层的影响
Anthropic 于 6 月 9 日发布 claude-fable-5,这是迄今面向公众开放的能力最强的 Claude 模型。以下是路由层需要关注的所有变化:新模型 ID、自适应思考强制开启、stop_reason refusal 新语义、fallbacks 参数,以及强制 30 天数据留存。

Claude Code Origin Story Routing:Anthropic 终端 Agent 历史为什么重要
Claude Code origin story routing 把 Anthropic 官方历史转成终端 Agent 的 operator 清单:权限、context、并行 swarm 与 gateway 治理。

Claude Opus Fast Mode:路由团队必须立即核查的两种不同故障模式
Anthropic 已从 Opus 4.6 静默移除 fast mode,并将于 7 月 24 日以硬错误方式从 Opus 4.7 下线。两种不同的故障模式,同一个 25 天窗口,必须立即处理。