Claude Code 2.1.243 的三个托管配置项,影响模型菜单、缓存计费和成本归因
2.1.243 新增 modelPicker、promptCacheTtl 和 modelPricing 三项托管配置,分别解决模型菜单管控、双层缓存 TTL 和合同价成本核算三个长期缺口。
归档条目:由 AI 根据所引信源辅助生成,发布时未经逐篇审阅。责任编辑:Joe Werner。

Claude Code 2.1.243 发布了三项托管配置,对于集中管理 Claude Code 部署的团队来说,这三项配置需要在下次成本审查或模型切换之前完成设置。三个配置分别针对不同的控制层面,单独看都有用,组合起来补上了企业托管设置支持以来一直存在的几个缺口。
三个配置项分别做什么
modelPicker 允许组织把 /model 选择器(开发者在会话中切换模型的交互菜单)限定为一份有序的、带标签的已批准模型 ID 列表。模型 ID 拼写不限,包括 Vertex AI 和 Amazon Bedrock 的 ID 格式。这份列表可以追加到内置选项后面,也可以直接替换内置列表。同版本还修复了一个 bug,此前从选择器里选 Ultracode 会静默失效。这个修复本身意义有限,在 modelPicker 能可靠填充选择器之后才真正有用。
promptCacheTtl 和 subagentPromptCacheTtl 是两个独立的 TTL 配置项。使用 API key 或云服务商的用户现在可以让主对话持有一小时的 prompt cache,而 subagent 继续保持默认的五分钟窗口。两个计时器独立运行,长时间运行的 orchestrator 会话可以积累热缓存,而频繁创建销毁的 subagent(通常是短命的高周转任务)则保持轻量,避免占用缓存槽的浪费。
modelPricing 是一个托管配置,接受一张按模型区分的价格表和一个可选的折扣倍数。配置生效后,Claude Code 在计算 /cost 输出、状态栏成本显示和遥测数据导出时,统一使用这些数字替代官方标价。有企业协议、批量折扣或 BYOK 方案的团队,此前每次看到成本数字都需要在心里做换算,这个配置在源头关掉了这个问题。
为什么运营者现在就需要处理
modelPicker 的缺口是网关运营者长期反馈的摩擦点。Claude Code 在启动时会查询网关的 /v1/models 端点,把返回的模型加进选择器。动态发现这个机制存在有一段时间了,但如果组织需要一份固定、有标签、有顺序的列表,比如把 gpt-5.6-sol 显示为"Ultrafast(预览版)"而不是原始模型 ID,或者把 Bedrock ARN 映射成开发者友好的名称,此前在托管配置里没有办法做到。现在有了。
双层缓存 TTL 的意义在于 Anthropic 的 prompt cache 按缓存 token 小时计费。subagent 如果在五分钟内创建、运行、退出,产生的缓存槽在第二次调用到来之前就已经过期,费用白付。把 subagentPromptCacheTtl 设短,可以减少被收费但没被复用的缓存窗口。反过来,主会话通常受益于更长的窗口,因为多轮对话会积累一个值得缓存的大 system prompt 前缀。之前只有单个 TTL 的时候只能做折中,拆开之后两层各自优化。
modelPricing 直接影响企业内部的费用分摊和团队成本可视化。很多组织谈到的单模型价格比标价低得多,有时候有承诺使用层级会有 30% 到 50% 的折扣。Claude Code 以标价输出 /cost 的时候,每个任务的成本数字都是系统性虚高,要么让内部报告里 AI 费用看起来偏高,要么让财务团队手工做修正。遥测数据走的也是同一套价格,给下游的 dashboard 和费用分配系统都带来了失真。
路由和运营角度怎么看
三个配置面向三个不同的控制层面。
modelPicker 是模型管控层面,决定开发者在会话内能选哪些模型。对于通过网关路由 Claude Code、且网关暴露了一套精选模型目录的运营者来说,选择器必须和目录对齐。没有 modelPicker 的时候,开发者可以在内置列表里选到网关没有暴露的模型,请求在运行时才会失败。有了这个配置,选择器就变成了运营者审批模型列表的投影。
promptCacheTtl 和 subagentPromptCacheTtl 是缓存经济学层面,控制各 agent 层的缓存 token 状态能保留多久。合适的值取决于工作负载形态。一个持续 30 分钟分析代码库的会话能从一小时主 TTL 里受益,一批做文件搜索的短命 subagent 就不需要这么长。
modelPricing 是成本归因层面,消除了 Anthropic 向运营者收取的实际价格(合同价)和 Claude Code 对外展示的价格(标价)之间的落差。它不改变 Anthropic 的账单,改变的是 Claude Code 显示和导出的数字。对成本核算流水线来说,遥测导出现在需要在合同价变化时同步更新托管配置,才能保持数据准确。
建议的配置步骤
如果你的部署使用托管配置(managed-settings.json 或云托管的托管配置源),需要处理以下几项。
- 在
modelPicker里加上你批准的模型列表,包含网关暴露的所有 Vertex 或 Bedrock 模型 ID。用label字段给每个模型写一个和内部文档对应的可读名称。 - 把
promptCacheTtl设为 3600(一小时),适用于长时间运行的分析会话。评估你的 subagent 工作负载,判断是否需要把subagentPromptCacheTtl设得更短,默认 300 秒对快速周转任务依然有效。 - 在下次内部成本审查之前,用合同价和折扣倍数填好
modelPricing。更新生效后,检查所有消费 Claude Code 遥测数据导出的 dashboard,成本数字会随托管配置生效而变化。
2.1.243 版本还新增了 /usage 的 Loops 明细(每轮运行次数、总 token 数、每次运行的 token 数、最近运行时间),用来发现失控或过度调用的 /loop 任务。对于把 Claude Code 当 orchestrator 运行自主循环的团队来说,这项改动值得关注。
Claude Code 2.1.243 现在可以通过 npm install -g @anthropic-ai/claude-code@latest 更新。托管配置在下次会话启动后生效。
相关阅读
AI 路由新闻与供应商动态 →
Claude Code 2.1.269:一个 60 项修复包里藏着的三个 operator 级变更
Claude Code 2.1.269 新增了 gateway 发现超时覆盖参数、并发 workflow agent 上限,以及一个跨配置源默默生效的 deny rule 漏洞修复。这三项变更直接影响规模化运营 Claude Code 的团队。

Claude Code 2.1.268:一个沉默三个版本的网关故障,以及四项新的运营控制
从 2.1.265 起,所有通过第三方 Anthropic 兼容端点的请求都在以 HTTP 400 失败。2.1.268 修复了这个问题,并新增了 gatewayInternalNetworks CIDR 策略、gateway.yaml 定价同步,以及 Bedrock/Vertex/Foundry 提示词缓存字节稳定性改进。

Claude Code 2.1.207:Auto Mode 在 Bedrock、Vertex AI 和 Foundry 上默认开启——立即审查你的 Operator 设置
Claude Code 2.1.207 移除了 Bedrock、Vertex AI 和 Foundry 上的 CLAUDE_CODE_ENABLE_AUTO_MODE 环境变量要求。Auto mode 现在对所有托管 provider 默认开启——operator 必须添加 disableAutoMode 才能恢复原有行为。