Claude Mythos Preview Waitlist 与 Opus 4.7:Anthropic 隐藏模型层级详解及路由策略影响

Anthropic 已确认 Claude Mythos Preview 位于 Opus 4.7 之上,但目前需通过 Waitlist 和网络安全审查才能获得访问权限。Mythos 层级对你的路由策略、从 Opus 4.6 的升级路径及回退阈值意味着什么。

发布于 来源 Anthropic

归档条目:由 AI 根据所引信源辅助生成,发布时未经逐篇审阅。责任编辑:Joe Werner。

抽象路由图,展示 Claude Opus 4.7 与 Claude Mythos Preview 之间的模型层级选择路径与路由策略决策点

2026 年 4 月 Anthropic 发布 Claude Opus 4.7 时,表面上的重点是性能提升:更强的编程能力、更好的视觉理解、更精准的指令遵循。但公告中埋藏着一个对路由团队更重要的信号——官方首次明确确认 Claude Mythos Preview 作为比 Opus 4.7 能力更强的模型层级存在,目前因高级网络安全能力而处于受控限量访问状态。

这在 Anthropic API 中造成了三层现实,你的路由策略现在需要将其纳入考量。

发生了什么

Claude Opus 4.7 已在 Anthropic 全 API 体系中正式上线:直接 API、Amazon Bedrock、Google Cloud Vertex AI 和 Microsoft Foundry。模型标识符为 claude-opus-4-7。

定价与 Opus 4.6 完全相同:输入 $5/百万 tokens,输出 $25/百万 tokens。这是一次零计费影响的直接升级。

能力提升集中在对长时运行智能体工作负载最关键的方面:

  • 长任务连贯性。 多家企业测试团队反映,Opus 4.7 在持续运行的复杂多步骤任务中不再出现 Opus 4.6 的质量下滑。有平台描述:"低投入 Opus 4.7 大致等同于中投入 Opus 4.6。"
  • 自我验证。 Opus 4.7 在报告结果前会对自身输出进行检查,在规划阶段就能捕获逻辑错误——对 CI/CD 和异步自动化流水线(延迟人工复核的场景)是实质性改进。
  • 智能体编程基准大幅提升。 一家集成团队在 93 个编程任务基准测试中,Opus 4.7 比 Opus 4.6 分辨率提升 13%,包括 Opus 4.6 和 Sonnet 4.6 均无法完成的任务。
  • 视觉能力增强。 支持更高图像分辨率,适用于处理技术图表、截图或文档密集型工作流的团队。

Mythos 层级。 公告明确指出 Claude Opus 4.7 的能力"不如我们最强大的模型 Claude Mythos Preview",后者因高级网络安全能力目前仍处于有限受控发布。Anthropic 正在 Opus 4.7 上部署网络安全防护作为最终推出 Mythos 的验证场。

为何对 AI 工程团队重要

价格不变,性能提升——迁移是纯粹的工程决策。 由于定价与 Opus 4.6 完全相同,已路由到 Opus 的团队可以零预算影响完成升级。决策变为纯粹的性能问题:你现有的流水线能从更强的自我纠错和长任务连贯性中受益吗?对于运行多步骤智能体工作流、代码审查流水线或长上下文研究任务的团队,答案几乎一定是肯定的。

Mythos 层级重构了你的模型选择逻辑。 在此公告之前,Anthropic API 用户的模型栈是 Sonnet → Opus,性能上限清晰。现在存在一个 Opus 4.7 之上的确认层级,大多数团队无法访问。这有两个重要含义:

  1. 基准测试现在是相对层级的。 当把 Opus 4.7 与其他供应商的前沿模型比较时,请记住 Anthropic 内部有一个更强大的模型未纳入公开比较。对于绝对前沿推理任务,你的多供应商路由可能需要考虑这一能力差距。

  2. 访问不平等引入新的运营风险。 如果 Mythos Preview 以差异化定价或访问模式(纯企业版、等待名单、受监管使用)开放,没有访问权限的团队将面临与同行的能力差距。路由团队应像跟踪定价公告一样跟踪 Anthropic 的 Mythos 访问路线图。

Opus 4.7 的网络安全防护是新的行为变量。 Anthropic 部署了实时网络安全防护,自动检测并拦截与禁止或高风险网络安全用途相关的请求。对于开展合规渗透测试、漏洞研究或红队工作的安全团队,新的网络安全验证计划是访问路径。对于通用工程团队,该防护层实际上是不可见的。但如果你在安全相邻上下文中观察到边缘情况提示词被意外拒绝,防护层是首先需要排查的对象。

路由/运营视角

1. 升级路径成本中性——机械化完成迁移。 由于 Opus 4.7 是 Opus 4.6 的同价直接替代,迁移仅需替换模型标识符:claude-opus-4-6 → claude-opus-4-7。无需预算调整。运营核查清单:

  • 在路由配置或供应商别名中替换模型 ID。
  • 对 Opus 4.7 运行现有评估套件以验证基线行为。
  • 检查输出详细程度或指令遵循的差异——Opus 4.7 更"有主见",不那么迎合用户,这可能影响专为 Opus 4.6 顺从风格设计的提示词。

2. 重新评估 Sonnet → Opus 回退阈值。 如果你使用质量导向路由启发——将"困难"任务路由至 Opus,"简单"任务路由至 Sonnet——Opus 4.7 在复杂任务上的提升意味着该阈值可以调整。以前需要 Opus 才能可靠解决的任务,现在可能在 Sonnet 上就能有良好结果,因为你的 Opus 回退基准质量已提升。在你的实际任务分布上测量这一点——不要假设旧的路由阈值仍然是最优的。

3. 将 Mythos 访问纳入路由层级监控。

目前 Mythos Preview 不能作为通用 API 模型使用。但如果 Anthropic 以分层或企业方式开放,它将成为质量上高于 Opus 4.7 但可能以溢价定价的新路由选项。在你的供应商目录中为 Mythos 添加占位符跟踪,以便访问开放时能迅速响应。

4. 审计 Opus 使用场景以找到智能体流水线的受益点。 Opus 4.7 的自我验证和长任务连贯性改进在模型长时间自主运行、无人工检查点的工作流中价值最高。如果你当前在短上下文或单轮模式中使用 Opus 4.6,可能不会看到显著收益。优先升级智能体流水线、代码自动化和研究任务。

TheRouter 用户应关注或尝试的事项

对于通过 TheRouter 路由到 Anthropic 的团队:

  • 模型别名更新。 在供应商配置中将 claude-opus-4-6 替换为 claude-opus-4-7。由于定价相同,计费账本无需调整。
  • 评估自我纠错行为。 模型在完成任务前验证自身输出的倾向是相对 4.6 的行为变化。在现有提示词模板上测试,尤其是那些依赖 Opus 4.6 直接输出特定格式而无纠错的场景。
  • 追踪回退触发指标。 如果你对路由层从 Anthropic Opus 回退到备用供应商的频率有可观测性,现在是建立新基线的时机。Opus 4.7 更强的指令遵循应能减少对格式良好提示词的意外拒绝。
  • 网络安全使用场景。 如果你的团队将 Opus 用于任何安全相邻工作负载,请查阅 Anthropic 的网络安全验证计划以确保持续访问。

Mythos 层级是这里更大的长期故事。Opus 4.7 是一次稳健的成本中性升级。但 Anthropic 明确承认其上方存在能力更强的受限模型,这一信号表明:前沿进展正比公共 API 访问快得多——路由团队应据此规划供应商策略。

本文涉及的模型

帮助与联系