
OpenAI API 密钥创建治理:服务账号专属模式如何堵上影子路由的漏洞
OpenAI 于 9 月 15 日推出组织级 API 密钥创建管控功能,管理员现在可以限制哪类密钥可以被创建——仅限服务账号、仅限项目密钥,或完全禁止创建。这是 OpenAI 首个从结构上阻止团队成员创建绕过网关路由策略的个人密钥的管控机制。

OpenAI 于 9 月 15 日推出组织级 API 密钥创建管控功能,管理员现在可以限制哪类密钥可以被创建——仅限服务账号、仅限项目密钥,或完全禁止创建。这是 OpenAI 首个从结构上阻止团队成员创建绕过网关路由策略的个人密钥的管控机制。

OpenAI 9 月 10 日更新允许管理员在组织或项目层面强制设置 Key 最大有效期。现有 Key 不会被追溯缩短,但策略生效后新建的每个 Key 都必须在限制范围内到期——而你的 API 网关很可能是全部 Key 中寿命最长、风险最高的那个。

OpenAI 的 Prompt Cache Diagnostics 工具在 Responses API 正式发布,新增 comparison_response_id 和 reason 字段用于定位缓存未命中原因。若网关层剥离 prompt_cache_options,诊断信号会静默丢失。

OpenAI 的 Agents API 公测版引入了 client.beta.agents 这个独立命名空间,它根本不经过 /v1/chat/completions。对于通过 AI 网关路由流量的团队来说,这意味着账单盲区、缺失的审计记录,以及一个需要单独管理的 API key 权限范围。

OpenAI 现在对两种此前看起来相同的 429 返回不同的错误码——发包速率过快得到 slow_down,模型饱和返回 503。你的重试逻辑必须分开处理它们。

GPT-6 Astra 拒绝通过 Chat Completions 路径进行工具调用,丢弃 temperature 和 top_p,新增两个必须处理的错误码,并运行异步失准监控,改变了 Responses API 用户的延迟契约。本文梳理实际会出问题的地方,以及迁移代码长什么样。

OpenAI 的双向 TLS 和 X.509 工作负载身份联合于 8 月 29 日正式发布。组织一旦激活 mTLS,所有转发该组织 API 流量的代理或网关都必须出示有效的客户端证书,否则请求在 TLS 握手阶段就会被拒绝。

OpenAI 于 8 月 20 日为 gpt-image-2 添加了透明背景支持(预览版),覆盖 Images API 和 Responses API 图像生成工具。一个新参数、一个 jpeg 的静默失败模式,以及 ZDR 运营商需要关注的预览状态说明。

OpenAI 现在允许通过切换 base_url 前缀,用单个 Global 项目 Key 按请求选择处理地区。多地区网关架构随之改变:一个凭证即可按请求路由到 us.api.openai.com 或 eu.api.openai.com,不再需要为每个地区维护独立 Key。

OpenAI Ultrafast mode routing 给 GPT-5.6 Sol 增加了一个最高 14 倍于 Standard 的限量预览层,网关运营者需要把低延迟流量和成本敏感的 fallback 流量拆开。

OpenAI Daybreak 现在有两个受限 API 层级,Blue 和 Red,两个都不走 v1/chat/completions。任何代理标准 OpenAI 兼容流量的网关运营方需要搞清楚哪些地方会出问题、哪些需要单独申请资格,以及这套架构和 Anthropic 的受限模型方案有何不同。

GPT-5.6 Sol、Terra 和 Luna 的 Fast mode 现在支持超过 272K token 的请求,迫使大上下文工作负载走 Standard tier 的历史结束了,但 ramp rate limit 仍然存在。

OpenAI 于 8 月 4 日在用量与费用 API 中新增了 api_key 维度。对于在同一组织下运行多个 API Key 的路由团队而言,这填补了按路径费用归因的最大空白——无需再创建独立组织。

Priority Processing 更名为 Fast 模式,GPT-5.6 Luna 降价 80%,Terra 降价 20%——流量加速限制意味着批处理作业可能悄然降级为标准速度。

OpenAI 在 7 月 30 日将 GPT-5.6 Luna 降价 80%、Terra 降价 20%,同时将 Priority Processing 更名为 Fast mode。Luna 在每百万 token 0.20/1.20 美元的价格下,现在直接与 DeepSeek V4 Flash 和 Qwen 模型竞争。以下是每位运营者必须重新计算的路由层级成本。

OpenAI 的 ARC-AGI-3 工程文章揭示:Responses API 中的 retained reasoning 与 compaction 将 GPT-5.6 Sol 得分提升 3 倍,同时将输出 token 减少 6 倍。这不是 benchmark 数字游戏——而是你的路由层必须正确处理的 API 语义差异。

OpenAI 于 7 月 29 日发布官方 Terraform provider,支持以代码方式管理项目、服务账户、速率限制、模型控制与支出告警。本文提供适合路由层团队的拓扑设计模式。

OpenAI 在 7 月 28 日发布了 gpt-transcribe 和 gpt-live-transcribe,取代 gpt-4o-transcribe 成为新的默认推荐模型。两个新模型在 endpoint、定价和能力上各不相同——时间戳、说话人分离、实时流式各有专属模型 ID。

OpenAI 于 7 月 20 日弃用九个遗留 audio、realtime 和 transcription 模型 ID,将于 2027 年 1 月 20 日下线。大多数情况下,迁移只需替换模型字符串,但路由 gpt-4o-audio、gpt-4o-realtime 和 gpt-audio 系列流量的运营商需要完成审计清单。

OpenAI 7 月 22 日的 API 更新新增了硬性月度消费上限,触发后将返回 429 insufficient_quota 错误。对于通过网关路由流量的团队而言,这是一种新的故障模式——标准重试逻辑对其处理方式存在根本缺陷,以下是审查清单。

OpenAI 发布了一套四维评估框架——「每美元有效智能(Useful Intelligence per Dollar)」,将模型评估从每 token 成本重构为每次成功任务成本。以下是每位路由运营者今天需要做出的改变。

OpenAI 最新企业指南明确将模型路由列为共享基础设施。本文将其五步投资框架翻译成 AI 工程团队可落地的路由策略。

OpenAI Python SDK v2.46.0 新增端点,支持为单个项目服务账号创建并列出作用域 API 密钥。对多项目 AI 路由团队而言,这一更新补上了迫使流水线使用全组织密钥的凭证蔓延漏洞。

OpenAI 的 GPT-Red 对抗训练器让 GPT-5.6 Sol 对提示注入的抵抗力比此前最优模型提高了 6 倍。对于运行会接触邮件、网页或第三方工具调用的 Agent 流水线的 operator 而言,这一差距现在已成为路由决策依据。

GPT-5.6 Sol、Terra 和 Luna 正式上线,定价确认。Responses API 新增 Programmatic Tool Calling 功能,将工具调度逻辑移入模型内部,绕过网关层的工具编排路径,AI 路由团队需立即审查架构影响。

GPT-Live 语音 API 路由正在成为新的运营决策:OpenAI 将全双工语音、后台模型委派和实时安全控制推向开发者场景。

OpenAI 于 7 月 6 日发布了 GPT-Realtime-2.1 和 GPT-Realtime-2.1-mini。双层模型结构、可配置的推理力度与新的音频定价基准,正在改变运营商路由语音 agent 流量的方式。

7 月 23 日,OpenAI 将关闭 gpt-5-codex、o3-deep-research、computer-use-preview 等 14 个模型别名。若路由配置仍指向这些模型,请求将直接报错。本文列出完整的迁移清单。

OpenAI 以三个独立层级发布了 GPT-5.6 预览版——Sol、Terra 和 Luna。对路由运营商而言,关键变化是 Terra:以 GPT-5.5 同等性能实现半价。以下是正式上线前更新路由策略的完整指南。

OpenAI 的 Codex 工作研究说明:agent router 需要为长程任务设置策略通道,按时长、风险、部门预算和 fallback 连续性路由,而不是只增加席位。

Codex Record and Replay 会记录一次 macOS workflow 并生成可复用 skill。真正的路由问题是 approval、fallback、recovery 和按 skill 计量成本。

OpenAI Patch the Planet Codex Security routing 把 AI 安全工作变成围绕已验证发现、补丁和 fallback policy 的受控修复通道。

OpenAI safety_identifier 参数(Realtime API 中对应 openai-safety-identifier header)用于为每次请求附加用户哈希标识。Safety Usage Dashboard 按该字段展示被拦截请求,将安全事件转化为 API 团队的路由与治理信号。

三星电子正在将 Codex 部署至全球全体员工——这是 OpenAI 有史以来最大规模的企业级上线之一。以下是每个运营团队在达到这一规模之前必须具备的 routing 与治理架构。

OpenAI 与 Broadcom 联合发布 Jalapeño,OpenAI 首款自研 LLM 推理加速芯片。本文分析自主硅片对 API 容量、定价走势和多提供商路由决策的实际影响。

Codex 0.143.0 新增可配置的 rollout token 预算、per-thread 多智能体委托策略及 URL 白名单网页搜索——三项运营商自 Codex 进入多智能体时代后一直缺失的治理控制。

如何围绕 Codex CLI rate-limit-reset-credits、remote executors 与加密 Noise relays 设计 host、MCP、policy 和 billing routing。

Codex Record and Replay 会录制 macOS workflow 并生成可复用 skill。团队应按 approval、permissions、fallback recovery 和成本遥测治理每次 replay。

OpenAI Assistants API 已废弃并转向 Responses API。用这份 2026 官方迁移清单审计 beta threads/runs、Agent Builder 依赖、工具、路由代理和模型 fallback 策略。

OpenAI 的 ChatGPT Enterprise 支出管控新增按模型额度上限、用户/团队覆盖规则和 Cost API 导出能力,给路由团队做 API 账单对账、fallback 与费用分摊提供了新信号。

OpenAI 已弃用六个初代 gpt-5 和 o3 模型快照,全部将于2026年12月11日停止服务。仍在路由策略中使用带日期 model ID 的团队有六个月时间迁移——完整审查清单在此。

OpenAI Partner Network 于 2026 年 6 月 14 日发布,包含 Select、Advanced、Elite 三级伙伴、1.5 亿美元生态投资和 Codex 专项认证。本文用架构图和清单拆解直接 OpenAI API key 与 SI 托管交付、委托凭据、配额归属和 fallback 控制。

OpenAI 宣布收购 Ona,将持久化、客户可控的云端执行能力引入 Codex。对于运营 API 网关和 Agent 编排的团队,这意味着会话生命周期、成本模型和凭证治理的根本性变化。

OpenAI Responses API 的 web_search 现在会随文字引用返回图片搜索结果。了解何时从 web_search_preview 迁移,以及如何路由需要视觉锚定的 workload。

Codex rust-v0.138.0:plugin .mcp.json JSON 自动化、MCP OAuth 凭证预刷新、/app CLI 到 Desktop handoff,以及 AGENTS.md 符号链接修复。

OpenAI 现支持在 Responses API 单次调用中同时返回用户输入和模型输出的 moderation 评分。对多 provider 路由团队来说,这消除了独立安全检测的额外请求,并改变了网关层内容治理的设计方式。

GitHub Copilot 6月1日正式切换令牌计费,真实账单已经来了——部分用户反映预计费用从此前的$39-$44固定月费飙升至$754-$847。这就是2026年5月定价变革在生产环境中的真实面貌,也是路由架构至关重要的原因。

OpenAI Codex CLI 0.137.0 推出多智能体 v2,支持每个生成的子智能体独立选择模型和 API provider。本文从路由网关运维角度解读这一变化对成本核算、provider 选择和治理策略的影响。

OpenAI evals platform 弃用、Agent Builder 关闭及 v1/prompts API 下线均定于 2026 年 11 月 30 日。本文梳理运营商需迁移的内容,以及 routing 层如何承接这一缺口。

OpenAI 现在会为非 ZDR 组织将符合条件的 GPT-5 提示缓存默认保留 24 小时。了解 GPT-5.5、prompt_cache_key 与网关路由选择如何影响 API 成本和数据策略。

OpenAI Codex 现已推出面向分析师、营销人员、销售团队、设计师、投资者和银行家的六款角色专属插件,以及可将提示词直接部署为互动式 Web 应用的 Sites 功能。对路由团队而言,从单一开发者场景向多角色编程智能体的转变,将从根本上改变上下文预算、工具调用模式和上游模型需求。

OpenAI 容器会话现已对 Hosted Shell 与 Code Interpreter 采用按分钟计费,并设有 5 分钟最低收费。本文解释何时复用 container_reference、避免重复创建 container_auto 会话,以及如何按内存层级控制路由成本。

面向仍在使用 gpt-image-1、gpt-image-1.5、gpt-image-1-mini 或 chatgpt-image-latest 的团队:在 2026 年 Q4 API 停服前完成 OpenAI gpt-image-2 迁移的官方检查清单。

Amazon Bedrock 现在通过 AWS IAM 凭证、区域端点和 openai.gpt-5.5 等模型 ID 提供 OpenAI GPT-5.5、GPT-5.4 与 Codex。本文说明这对路由层、Codex 配置、fallback 策略和 OpenAI 兼容网关设计意味着什么。

OpenAI 发布了关于可信第三方评测设计的详细指南。核心 operator 结论:harness 选择会改变测量到的模型能力,因此 benchmark 分数在用于路由分层决策之前必须结合上下文解读。

OpenAI 4 月 22 日弃用公告涵盖 25+ 个模型 ID,分两批硬关停:2026 年 7 月 23 日和 10 月 23 日。如果你的路由配置仍引用 gpt-4、gpt-3.5-turbo、o1、o3-mini 或 o4-mini,日历上已经有一个破坏性变更在等着你。

OpenAI Workload Identity Federation 让 CI/CD 流水线和 Coding Agent 用 OIDC token 换取短期 API key,无需存储长期凭证、无需手动轮换。Admin API 新增项目级模型白名单、邮件消费告警和细粒度账单明细。完整 Operator 配置清单见内文。

OpenAI 将 Codex Computer Use 扩展到 Windows,并加入跨设备操控与带 token 活动的 Codex Profiles。工程团队应重新检查 Windows SSH 主机、Codex entries 与多操作系统 agent 路由策略。

OpenAI Frontier Governance Framework 提醒API运营商:EU AI Act执法前,需要供应商尽调、合规fallback策略和每请求模型审计记录。

Codex eval 基础设施是区分“能用的 Agent”与“能自进化的 Agent”的关键。OpenAI 税务 Agent 将生产轨迹转化为结构化 eval 目标,并由 Codex 自动迭代修复。这套架构与模型无关,适用于任何基于 API 网关构建 Agent 的团队。

一个匿名 OpenAI 推理模型自主证伪了一个存在 80 年的离散几何猜想。对运营团队而言,信号不在于数学本身,而在于「推理层」模型选择与路由策略的重新校准。

OpenAI 与 Dell 联手,将 Codex 引入企业数据中心。当编码智能体可以在私有环境运行时,数据本地化、会话亲和性、成本核算与治理控制都需要重新设计——这是工程团队现在就该开始规划的架构问题。

面向企业团队的 Codex dispatch 网关清单:程序化访问 Token、Remote SSH、CI Agent 如何进入统一路由;如何覆盖 devbox 出口、拆分 Token 台账,并提前发现后台 Agent 成本。

OpenAI 正式获得 C2PA 合规认证,并与 Google 合作为所有 API 生成图片嵌入 SynthID 水印。每张图片现在默认携带加密溯源指纹,直接影响内容管道完整性、审计追踪和多 Provider 路由策略。

Codex 供应链攻击源于 TanStack npm 包被入侵:Mini Shai-Hulud 攻击命中两名 OpenAI 员工,Codex CLI、ChatGPT Desktop、Atlas 代码签名证书泄露并已完成轮换。macOS 开发者须在 2026 年 6 月 12 日前更新,否则应用无法启动。