OpenAI Spend Controls 与 Cost API:企业 AI 路由需要关注的按模型额度管控
OpenAI 的 ChatGPT Enterprise 支出管控新增按模型额度上限、用户/团队覆盖规则和 Cost API 导出能力,给路由团队做 API 账单对账、fallback 与费用分摊提供了新信号。

2026 年 6 月 18 日,OpenAI 为 ChatGPT 企业版推出了信用额度用量分析和更新后的支出管控功能,填补了企业级 AI 账单可观测性的重要空白。对于已在运行多 provider 路由的团队来说,这次变更引入了新的计费信号层——与路由网关的作用互补,但不能相互替代。
具体变化
ChatGPT 企业版管理员现获得三项新能力:
- 按模型、按用户、按团队组的精细信用额度追踪:在 Global Admin Console 中统一展示 ChatGPT 和 Codex 的用量。
- 层级化支出限额:可设置工作区默认上限、团队组级别覆盖,以及个人用户级别覆盖。员工可附带说明申请追加额度,管理员可在不提升全局限额的前提下单独审批。
- Cost API 访问权限:同一套信用额度使用数据可通过统一的 Cost API 以编程方式导出,用于财务系统或 BI 工具的下游对账。
模型层级拆分是本次最关键的新信号。此前企业级账单仅显示汇总消费;现在管理员可识别是哪个模型层级(GPT-5.5、o3、Codex 等)推高了成本,并在该层级而非用户维度执行限额管控。
对 AI 工程团队的影响
大多数企业 AI 部署目前都存在"双轨计费"架构:一侧是供应商账单,另一侧是内部费用分摊。供应商侧(OpenAI、Anthropic、Google)展示 token 级别的消费;内部侧展示团队级别的归因。中间的空白——使用了哪个模型层级、哪位用户在用、对应什么业务工作负载——历史上需要手动解析日志或自定义中间件来填补。
OpenAI 的新 Cost API 为 ChatGPT 企业版工作负载解决了这个问题。如果你的团队同时运行 Codex 智能体、ChatGPT Enterprise 自定义角色和直接 API 调用,现在可以通过统一的对账端点处理 ChatGPT/Codex 侧的数据。
该方案尚未覆盖的范围:
- 通过
chat.completions或 Responses API 的纯 API 工作负载(仍在开发者账单控制台,而非 Admin Console)。 - 跨 provider 消费(Anthropic、Google、Bedrock、Vertex——各有独立的成本数据面)。
- 路由层的决策(模型选择、fallback、延迟权重路由)。
这正是计费治理在路由层仍属独立关注点的原因。
路由器/运营商视角
ChatGPT 企业版的支出管控在 ChatGPT 产品层运行——它规定哪些用户可以在 ChatGPT 模型菜单中花多少额度。路由网关则运行在其下方的 API 层,管理每个请求实际命中哪个模型端点,并执行 fallback、延迟阈值、单请求成本上限和跨 provider 预算拆分等策略。
两者互补,而非替代。举一个典型场景:
- ChatGPT Enterprise 中一位用户触达 GPT-5.5 额度上限,收到"申请追加容量"的提示。
- 通过路由网关发起 API 调用的开发者团队面对的是另一套管控:per-key 速率限制、模型层级路由规则,或预算触发的从 GPT-5.5 fallback 到 GPT-5.4-mini 策略。
对于同时拥有 API 开发者和 ChatGPT 终端用户的团队,新的 Cost API 为 ChatGPT Enterprise 侧提供了对账端点。要构建完整的计费视图,仍需从 API 侧单独拉取用量数据,并在跨 provider 维度上进行规范化处理。
路由团队现在需要审查的三个要点:
- ChatGPT Enterprise 的信用额度是否已按模型层级追踪? 新的拆分功能支持将成本按模型层级分摊到业务部门——如果团队间使用的模型存在价格差异,值得立即配置。
- 你的 Cost API 管道是否覆盖了 API 侧的工作负载? OpenAI 于 5 月 26 日发布的 Admin API 提供了 API 端的消费告警和账单明细——这是针对 API 团队的对应方案。
- 当某个团队组触达额度上限时,你的 fallback 模型是什么? ChatGPT Enterprise 的额度耗尽不会自动触发 API 层的 fallback。如果你的 API 路由配置假设 ChatGPT Enterprise 始终可用作 fallback,一次额度事件可能会悄无声息地破坏这一假设。
TheRouter 用户需要关注的方向
企业 AI 的计费治理正变得越来越多层化。各供应商的计费数据面(OpenAI Admin API、ChatGPT Enterprise Cost API、Anthropic 账单、DashScope 用量 API)各自以不同 schema 暴露消费数据的局部视图。路由网关是规范化层——跨 provider 的 token 成本、模型层级路由决策和内部分配标签在这里汇聚。
如果你的团队正在构建计费对账管道,可先参考 TheRouter 文档 了解 API 侧的 token 记账层,再规划如何在此之上接入 ChatGPT Enterprise Cost API。
6 月 18 日的变更是企业 AI 计费走向成熟的信号。供应商正在为运营商提供更好的按模型可观测性。剩余的集成工作——跨 provider、跨数据面的规范化——仍然在路由层完成。
相关阅读
AI 路由新闻与供应商动态 →
OpenAI API Key 费用归因现已可编程:每个路由运营商必须做出的改变
OpenAI 于 8 月 4 日在用量与费用 API 中新增了 api_key 维度。对于在同一组织下运行多个 API Key 的路由团队而言,这填补了按路径费用归因的最大空白——无需再创建独立组织。

OpenAI 发布官方 Terraform Provider:AI 网关团队期待已久的 IaC 治理方案
OpenAI 于 7 月 29 日发布官方 Terraform provider,支持以代码方式管理项目、服务账户、速率限制、模型控制与支出告警。本文提供适合路由层团队的拓扑设计模式。

OpenAI 硬性消费上限现已中断 API 请求:每个网关运营商必须完成的审查清单
OpenAI 7 月 22 日的 API 更新新增了硬性月度消费上限,触发后将返回 429 insufficient_quota 错误。对于通过网关路由流量的团队而言,这是一种新的故障模式——标准重试逻辑对其处理方式存在根本缺陷,以下是审查清单。