OpenAI Spend Controls 与 Cost API:企业 AI 路由需要关注的按模型额度管控

OpenAI 的 ChatGPT Enterprise 支出管控新增按模型额度上限、用户/团队覆盖规则和 Cost API 导出能力,给路由团队做 API 账单对账、fallback 与费用分摊提供了新信号。

TheRouter Newsroom来源 OpenAI
展示企业 AI 路由层跨模型信用额度用量分析和支出管控的控制台界面

2026 年 6 月 18 日,OpenAI 为 ChatGPT 企业版推出了信用额度用量分析和更新后的支出管控功能,填补了企业级 AI 账单可观测性的重要空白。对于已在运行多 provider 路由的团队来说,这次变更引入了新的计费信号层——与路由网关的作用互补,但不能相互替代。

具体变化

ChatGPT 企业版管理员现获得三项新能力:

  • 按模型、按用户、按团队组的精细信用额度追踪:在 Global Admin Console 中统一展示 ChatGPT 和 Codex 的用量。
  • 层级化支出限额:可设置工作区默认上限、团队组级别覆盖,以及个人用户级别覆盖。员工可附带说明申请追加额度,管理员可在不提升全局限额的前提下单独审批。
  • Cost API 访问权限:同一套信用额度使用数据可通过统一的 Cost API 以编程方式导出,用于财务系统或 BI 工具的下游对账。

模型层级拆分是本次最关键的新信号。此前企业级账单仅显示汇总消费;现在管理员可识别是哪个模型层级(GPT-5.5、o3、Codex 等)推高了成本,并在该层级而非用户维度执行限额管控。

对 AI 工程团队的影响

大多数企业 AI 部署目前都存在"双轨计费"架构:一侧是供应商账单,另一侧是内部费用分摊。供应商侧(OpenAI、Anthropic、Google)展示 token 级别的消费;内部侧展示团队级别的归因。中间的空白——使用了哪个模型层级、哪位用户在用、对应什么业务工作负载——历史上需要手动解析日志或自定义中间件来填补。

OpenAI 的新 Cost API 为 ChatGPT 企业版工作负载解决了这个问题。如果你的团队同时运行 Codex 智能体、ChatGPT Enterprise 自定义角色和直接 API 调用,现在可以通过统一的对账端点处理 ChatGPT/Codex 侧的数据。

该方案尚未覆盖的范围:

  • 通过 chat.completions 或 Responses API 的纯 API 工作负载(仍在开发者账单控制台,而非 Admin Console)。
  • 跨 provider 消费(Anthropic、Google、Bedrock、Vertex——各有独立的成本数据面)。
  • 路由层的决策(模型选择、fallback、延迟权重路由)。

这正是计费治理在路由层仍属独立关注点的原因。

路由器/运营商视角

ChatGPT 企业版的支出管控在 ChatGPT 产品层运行——它规定哪些用户可以在 ChatGPT 模型菜单中花多少额度。路由网关则运行在其下方的 API 层,管理每个请求实际命中哪个模型端点,并执行 fallback、延迟阈值、单请求成本上限和跨 provider 预算拆分等策略。

两者互补,而非替代。举一个典型场景:

  • ChatGPT Enterprise 中一位用户触达 GPT-5.5 额度上限,收到"申请追加容量"的提示。
  • 通过路由网关发起 API 调用的开发者团队面对的是另一套管控:per-key 速率限制、模型层级路由规则,或预算触发的从 GPT-5.5 fallback 到 GPT-5.4-mini 策略。

对于同时拥有 API 开发者和 ChatGPT 终端用户的团队,新的 Cost API 为 ChatGPT Enterprise 侧提供了对账端点。要构建完整的计费视图,仍需从 API 侧单独拉取用量数据,并在跨 provider 维度上进行规范化处理。

路由团队现在需要审查的三个要点:

  1. ChatGPT Enterprise 的信用额度是否已按模型层级追踪? 新的拆分功能支持将成本按模型层级分摊到业务部门——如果团队间使用的模型存在价格差异,值得立即配置。
  2. 你的 Cost API 管道是否覆盖了 API 侧的工作负载? OpenAI 于 5 月 26 日发布的 Admin API 提供了 API 端的消费告警和账单明细——这是针对 API 团队的对应方案。
  3. 当某个团队组触达额度上限时,你的 fallback 模型是什么? ChatGPT Enterprise 的额度耗尽不会自动触发 API 层的 fallback。如果你的 API 路由配置假设 ChatGPT Enterprise 始终可用作 fallback,一次额度事件可能会悄无声息地破坏这一假设。

TheRouter 用户需要关注的方向

企业 AI 的计费治理正变得越来越多层化。各供应商的计费数据面(OpenAI Admin API、ChatGPT Enterprise Cost API、Anthropic 账单、DashScope 用量 API)各自以不同 schema 暴露消费数据的局部视图。路由网关是规范化层——跨 provider 的 token 成本、模型层级路由决策和内部分配标签在这里汇聚。

如果你的团队正在构建计费对账管道,可先参考 TheRouter 文档 了解 API 侧的 token 记账层,再规划如何在此之上接入 ChatGPT Enterprise Cost API。

6 月 18 日的变更是企业 AI 计费走向成熟的信号。供应商正在为运营商提供更好的按模型可观测性。剩余的集成工作——跨 provider、跨数据面的规范化——仍然在路由层完成。

帮助与联系