Claude Code 2.1.268:一个沉默三个版本的网关故障,以及四项新的运营控制
从 2.1.265 起,所有通过第三方 Anthropic 兼容端点的请求都在以 HTTP 400 失败。2.1.268 修复了这个问题,并新增了 gatewayInternalNetworks CIDR 策略、gateway.yaml 定价同步,以及 Bedrock/Vertex/Foundry 提示词缓存字节稳定性改进。

如果你的 Claude Code 接的是第三方 Anthropic 兼容端点,无论是自托管代理、AI gateway,还是 ANTHROPIC_BASE_URL 后面的任何服务,从版本 2.1.265 开始,每一轮对话都在返回 HTTP 400。不是部分请求,是每一条。
2.1.268 今天发布,修复了这个问题,同时带来四项面向运营商的控制变更,涵盖网络访问配置、定价可见性和提示词缓存行为。
HTTP 400 回归:三个版本,每轮请求都失败
这个回归在 2.1.265 悄无声息地进入了代码库。Artifact 工具的 JSON schema 里加了一条正则表达式,Anthropic 自己的端点能处理,但第三方端点把它当作无效属性拒掉了。结果是彻底的,服务端在 Claude 产出任何内容之前就返回 400。
运行 ANTHROPIC_BASE_URL 代理或 gateway 的团队,从用户自动更新到受影响版本那一刻起,就会看到 400 错误持续出现。CHANGELOG 把这条写成一般 bugfix,没有注明"自 x.x.x 版本起的回归",所以不做版本钉选或详细错误日志分析,很难确定受影响的窗口,也就是 2.1.265 到 2.1.267 这三个版本。
首先要做的是升到 2.1.268。如果你管理一个 gateway 并在过去一周看到 400 错误率上升,原因就在这里。
对于在托管部署里钉选版本的团队,需要审查 Claude Code 的版本下限。2.1.265 到 2.1.267 之间的任何版本,都在默默地打断所有第三方端点流量。
gatewayInternalNetworks:把登录路径和 API 访问分开管理
此前,Claude apps gateway 的 /login 端点要么要求来访地址在 access_control.allow_cidrs 里,要么在外部地址上被完全屏蔽。对于把 gateway 跑在公共 IPv4 段上的组织,比如使用可路由地址的云 VPC,想在不把 allow_cidrs 开放给整个公网的情况下允许内部登录,配置上相当别扭。
新的 gatewayInternalNetworks managed setting 让管理员可以把组织自有的公共 IPv4 段标记为"内部"。这些地址上的客户端可以访问 /login,无需出现在通用 allow_cidrs 列表里。同时,gateway 现在会在启动时记录一条警告,当 allow_cidrs 为空时提示潜在暴露风险,第一次收到公共地址请求时也会输出一次单次警告,让暴露面变得可见。
配置写在 gateway.yaml 的 managed_settings 下。
managed_settings:
gatewayInternalNetworks:
- 203.0.113.0/24 # 组织自有的公共地址段
allow_cidrs 管所有经过认证的 API 流量,gatewayInternalNetworks 单独管登录路径。在企业内网里使用公共 IP 段的团队,现在有了干净的分离,不需要放宽 allow_cidrs。
定价同步:/cost 和遥测数据现在能匹配计费表
当 gateway 运营商在 gateway.yaml 里设置了 pricing: 时,Claude Code 的 /cost 命令和遥测输出此前反映的是 Anthropic 公布的标准价格,而不是 gateway 实际应用的费率。这制造了一个对账缺口,计费表显示一个数字,客户端显示另一个。
从 2.1.268 起,通过配置了 pricing: 的 Claude apps gateway 登录的客户端,会把这些费率作为 managed setting 收到。/cost 和会话遥测现在反映运营商配置的定价。对于运行内部成本分摊或向用户展示费用仪表板的团队,这个修复让客户端的输出变得可信。
Bedrock、Vertex 和 Foundry:提示词缓存字节稳定性
这个变更比看起来重要得多。2.1.268 之前,Bedrock、Vertex 和 Foundry 上的会话把系统提示词内联发送,完整的环境、模型和设置块嵌入其中。因为这个块可能随请求变化(时间戳、动态上下文),缓存前缀从来没有稳定过,即使对话内容没有改变,这几个云平台上的提示词缓存命中率也参差不齐。
这次同时落地两项变更。
第一,Bedrock、Vertex 和 Foundry 上的系统提示词现在把环境、模型和设置详情作为附件发送,和一方 Claude.ai 会话的方式保持一致。核心系统提示词文本在请求之间保持稳定。
第二,工具列表现在在整个对话中字节稳定,延迟连接的工具改为延迟加载,不再就地重写工具块。
两项变更叠加,长时间运行的 Bedrock/Vertex/Foundry 会话现在可以达到和一方会话相同的提示词缓存命中率。在这些云平台上运行大量 agentic 工作负载的团队,升级后请求成本会自动下降,不需要任何配置改动。
有一项行为变化值得注意。SDK 会话里 excludeDynamicSections 不再在每次请求时重新渲染第一条消息。如果你有检测逻辑期望在请求日志里看到第一条消息出现两次,升级后不会再有这种情况。
任务追踪工具按模型系列限制
TaskCreate、TaskGet、TaskUpdate、TaskList 和 TodoWrite 这五个任务追踪工具现在只在 Claude 3.x 以及特定的 Opus 4/Sonnet 4/Haiku 4 变体上提供,范围有所收窄。在其他模型版本上,这些工具默认关闭。
如果你的用户在不在上述列表里的模型(比如 Fable 5.1 或 Mythos 5.1)上运行这些工具,它们将不再出现。可以用 CLAUDE_CODE_ENABLE_TODO_TOOLS=1 重新启用,但默认是限制性的。
网关运营商现在要做什么
立即执行 把所有 Claude Code 部署升到 2.1.268。ANTHROPIC_BASE_URL 的修复是关键,2.1.265 到 2.1.267 的客户端在第三方端点上已经静默损坏。审查所有托管或钉选部署的版本下限。
本周内 如果你的 gateway 用公共 IPv4 段处理内部流量,评估 gatewayInternalNetworks 把登录访问从通用 allow_cidrs 策略里分离出来。如果 gateway.yaml 里有 pricing: 配置,验证 /cost 输出现在是否匹配预期费率。
Bedrock/Vertex/Foundry 部署 提示词缓存改进升级后自动生效,无需任何操作。如果你为容量规划跟踪请求大小,预期系统提示词的发送形式会有变化,从内联改为附件,假设内联发送的解析逻辑可能需要调整。
网关回归是这次发布的主要新闻,但 Bedrock/Vertex/Foundry 提示词缓存稳定性改进,才是长期影响最大的变更,特别是对在云平台基础设施上运行生产 agentic 工作负载的团队。
相关阅读
AI 路由新闻与供应商动态 →
Claude Code 2.1.273:五个新网关提示头和 Bedrock、Vertex、Foundry 上的分类器切换
Claude Code 2.1.273 推出可选开启的网关提示头,向任何 LLM 代理暴露请求类型、agent 类型和上下文压缩状态,同时在 Bedrock、Vertex AI 和 Foundry 上静默切换 auto 模式分类器为本地模式。两个变更一起落地,但只有其中一个有回退路径。

Claude Code 2.1.267:运营商层面的 Effort 上限控制、提示词缓存稳定性修复与市场容器绕过漏洞补丁
2.1.267 带来三项运营商相关变更:跨 Bedrock、Vertex、Foundry 生效的 maxEffortLevel 上限配置;禁止系统提示词快照复用的新标志;以及一个通过反斜杠绕过市场容器检查的安全修复。此外包含十二项提示词缓存稳定性改进,直接影响 Token 成本。

Claude Code 2.1.269:一个 60 项修复包里藏着的三个 operator 级变更
Claude Code 2.1.269 新增了 gateway 发现超时覆盖参数、并发 workflow agent 上限,以及一个跨配置源默默生效的 deny rule 漏洞修复。这三项变更直接影响规模化运营 Claude Code 的团队。