Claude Code 2.1.243 的三个托管配置项,影响模型菜单、缓存计费和成本归因

2.1.243 新增 modelPicker、promptCacheTtl 和 modelPricing 三项托管配置,分别解决模型菜单管控、双层缓存 TTL 和合同价成本核算三个长期缺口。

发布于 来源 Anthropic

归档条目:由 AI 根据所引信源辅助生成,发布时未经逐篇审阅。责任编辑:Joe Werner。

抽象图示,三个控制旋钮分别标记 Model Picker、Cache TTL 和 Cost Attribution,连接到中心 AI 路由网关节点

Claude Code 2.1.243 发布了三项托管配置,对于集中管理 Claude Code 部署的团队来说,这三项配置需要在下次成本审查或模型切换之前完成设置。三个配置分别针对不同的控制层面,单独看都有用,组合起来补上了企业托管设置支持以来一直存在的几个缺口。

三个配置项分别做什么

modelPicker 允许组织把 /model 选择器(开发者在会话中切换模型的交互菜单)限定为一份有序的、带标签的已批准模型 ID 列表。模型 ID 拼写不限,包括 Vertex AI 和 Amazon Bedrock 的 ID 格式。这份列表可以追加到内置选项后面,也可以直接替换内置列表。同版本还修复了一个 bug,此前从选择器里选 Ultracode 会静默失效。这个修复本身意义有限,在 modelPicker 能可靠填充选择器之后才真正有用。

promptCacheTtl 和 subagentPromptCacheTtl 是两个独立的 TTL 配置项。使用 API key 或云服务商的用户现在可以让主对话持有一小时的 prompt cache,而 subagent 继续保持默认的五分钟窗口。两个计时器独立运行,长时间运行的 orchestrator 会话可以积累热缓存,而频繁创建销毁的 subagent(通常是短命的高周转任务)则保持轻量,避免占用缓存槽的浪费。

modelPricing 是一个托管配置,接受一张按模型区分的价格表和一个可选的折扣倍数。配置生效后,Claude Code 在计算 /cost 输出、状态栏成本显示和遥测数据导出时,统一使用这些数字替代官方标价。有企业协议、批量折扣或 BYOK 方案的团队,此前每次看到成本数字都需要在心里做换算,这个配置在源头关掉了这个问题。

为什么运营者现在就需要处理

modelPicker 的缺口是网关运营者长期反馈的摩擦点。Claude Code 在启动时会查询网关的 /v1/models 端点,把返回的模型加进选择器。动态发现这个机制存在有一段时间了,但如果组织需要一份固定、有标签、有顺序的列表,比如把 gpt-5.6-sol 显示为"Ultrafast(预览版)"而不是原始模型 ID,或者把 Bedrock ARN 映射成开发者友好的名称,此前在托管配置里没有办法做到。现在有了。

双层缓存 TTL 的意义在于 Anthropic 的 prompt cache 按缓存 token 小时计费。subagent 如果在五分钟内创建、运行、退出,产生的缓存槽在第二次调用到来之前就已经过期,费用白付。把 subagentPromptCacheTtl 设短,可以减少被收费但没被复用的缓存窗口。反过来,主会话通常受益于更长的窗口,因为多轮对话会积累一个值得缓存的大 system prompt 前缀。之前只有单个 TTL 的时候只能做折中,拆开之后两层各自优化。

modelPricing 直接影响企业内部的费用分摊和团队成本可视化。很多组织谈到的单模型价格比标价低得多,有时候有承诺使用层级会有 30% 到 50% 的折扣。Claude Code 以标价输出 /cost 的时候,每个任务的成本数字都是系统性虚高,要么让内部报告里 AI 费用看起来偏高,要么让财务团队手工做修正。遥测数据走的也是同一套价格,给下游的 dashboard 和费用分配系统都带来了失真。

路由和运营角度怎么看

三个配置面向三个不同的控制层面。

modelPicker 是模型管控层面,决定开发者在会话内能选哪些模型。对于通过网关路由 Claude Code、且网关暴露了一套精选模型目录的运营者来说,选择器必须和目录对齐。没有 modelPicker 的时候,开发者可以在内置列表里选到网关没有暴露的模型,请求在运行时才会失败。有了这个配置,选择器就变成了运营者审批模型列表的投影。

promptCacheTtl 和 subagentPromptCacheTtl 是缓存经济学层面,控制各 agent 层的缓存 token 状态能保留多久。合适的值取决于工作负载形态。一个持续 30 分钟分析代码库的会话能从一小时主 TTL 里受益,一批做文件搜索的短命 subagent 就不需要这么长。

modelPricing 是成本归因层面,消除了 Anthropic 向运营者收取的实际价格(合同价)和 Claude Code 对外展示的价格(标价)之间的落差。它不改变 Anthropic 的账单,改变的是 Claude Code 显示和导出的数字。对成本核算流水线来说,遥测导出现在需要在合同价变化时同步更新托管配置,才能保持数据准确。

建议的配置步骤

如果你的部署使用托管配置(managed-settings.json 或云托管的托管配置源),需要处理以下几项。

  • 在 modelPicker 里加上你批准的模型列表,包含网关暴露的所有 Vertex 或 Bedrock 模型 ID。用 label 字段给每个模型写一个和内部文档对应的可读名称。
  • 把 promptCacheTtl 设为 3600(一小时),适用于长时间运行的分析会话。评估你的 subagent 工作负载,判断是否需要把 subagentPromptCacheTtl 设得更短,默认 300 秒对快速周转任务依然有效。
  • 在下次内部成本审查之前,用合同价和折扣倍数填好 modelPricing。更新生效后,检查所有消费 Claude Code 遥测数据导出的 dashboard,成本数字会随托管配置生效而变化。

2.1.243 版本还新增了 /usage 的 Loops 明细(每轮运行次数、总 token 数、每次运行的 token 数、最近运行时间),用来发现失控或过度调用的 /loop 任务。对于把 Claude Code 当 orchestrator 运行自主循环的团队来说,这项改动值得关注。

Claude Code 2.1.243 现在可以通过 npm install -g @anthropic-ai/claude-code@latest 更新。托管配置在下次会话启动后生效。

帮助与联系