OpenAI 发布 GPT-5.1-Codex-Max,具备压缩功能和 xhigh 推理
GPT-5.1-Codex-Max 成为 Codex 默认模型,引入了原生上下文压缩功能以支持 24 小时以上的多窗口会话,xhigh 推理努力在 SWE-bench Verified 上达到 77.9%,中等推理努力下思考 token 比前代减少 30%。首个支持 Windows 环境的 Codex 模型。
Version of GPT-5.1 Codex optimized for long-running tasks.
GPT-5.1-Codex-Max 是 OpenAI 的前沿 agentic 编程模型,专为跨小时甚至天数执行的长时间软件工程任务而设计。它于 2025 年 11 月 18–19 日发布,是首个原生支持跨多个上下文窗口的 OpenAI 模型,通过称为压缩(compaction)的过程,在单个任务中自动修剪历史记录同时保留最重要的上下文,从而在大规模 token 范围内连贯工作。它取代 GPT-5.1-Codex 成为 Codex 界面(CLI、IDE 扩展、云端沙箱和代码审查)的默认模型。
GPT-5.1-Codex-Max 基于 OpenAI 基础推理模型的更新版本构建,在真实软件工程任务上进行了训练:PR 创建、代码审查、前端编码、问答,以及首次支持的 Windows 环境操作。该模型引入了 xhigh(‘Extra High’)推理努力级别,为非延迟敏感任务分配更多思考时间。压缩功能支持 24 小时以上的自主会话——当上下文窗口接近满时自动压缩,释放空间继续执行任务,反复进行直至完成。
从 TheRouter 运营者的角度看,GPT-5.1-Codex-Max 标记为 active 状态,可通过标准 /v1/chat/completions 端点访问,支持完整的 OpenAI 兼容参数(temperature、max_tokens、tools、tool_choice、response_format、reasoning、stop)。它共享 GPT-5.1 的 400K 上下文窗口和 128K 最大输出,定价为 $1.25/M 输入 token、$10/M 输出 token、$0.125/M 缓存读取。此模型最适合通过 Codex 或类似工具链路由的 agentic 编程工作流——通用推理任务请路由到 openai/gpt-5.1。
| 类型 | 费率 |
|---|---|
| 输入 | $1.35 每百万 Tokens |
| 输出 | $10.80 每百万 Tokens |
| 发布日期 | 2025-11-18openai.com ↗ | 已核实 |
| OpenAI API 模型 id | gpt-5.1-codex-maxopenai.com ↗ | 已核实 |
| 模型类型 | 前沿 agentic 编程模型,原生支持压缩——首个为多窗口上下文操作训练的 OpenAI 模型openai.com ↗ | 已核实 |
| 推理类型 | 自适应——支持 ‘none’、‘low’、‘medium’、‘high’ 和 ‘xhigh’(Extra High)推理努力级别;xhigh 为非延迟敏感任务分配最大思考时间openai.com ↗ | 已核实 |
| 上下文压缩 | 原生多窗口压缩——自动修剪会话历史同时保留关键上下文,支持持续 24 小时以上数百万 token 的连贯工作openai.com ↗ | 已核实 |
| Windows 环境支持 | 首个支持 Windows 环境的 Codex 模型openai.com ↗ | 已核实 |
| 网络安全能力(Preparedness Framework) | OpenAI 迄今部署的网络安全能力最强的模型——未达到 High 阈值但正在快速演进;生物学分类为 High;专用网络监控已启用openai.com ↗ | 已核实 |
| 许可 | 专有(OpenAI API 服务条款 / ChatGPT 订阅) | 已核实 |
| Benchmark | Distribution | Score | Source |
|---|---|---|---|
SWE-bench Verified xhigh 推理努力,n=500——GPT-5.1-Codex(high)得分为 73.7%。相同 ‘medium’ 努力下思考 token 比 GPT-5.1-Codex 少 30%。 | 77.9%% | openai.com ↗ | |
SWE-Lancer IC SWE xhigh 推理努力——GPT-5.1-Codex(high)得分为 66.3%。 | 79.9%% | openai.com ↗ | |
Terminal-Bench 2.0 xhigh 推理努力——GPT-5.1-Codex(high)得分为 52.8%。 | 58.1%% | openai.com ↗ |
所有新集成都应使用下方示例中的全球端点 api.therouter.ai;旧中国加速端点已下线。
curl https://api.therouter.ai/v1/chat/completions -H "Content-Type: application/json" -H "Authorization: Bearer $THE_ROUTER_API_KEY" -d '{
"model": "openai/gpt-5.1-codex-max",
"messages": [
{"role": "user", "content": "Summarize the key points from this input."}
]
}'GPT-5.1-Codex-Max 通过标准 chat completions 端点访问。对于 agentic 编程工作流,请通过 Codex 或兼容框架路由以利用 apply_patch 和 shell 工具。
curl https://api.therouter.ai/v1/chat/completions \
-H "Authorization: Bearer $THEROUTER_API_KEY" \
-H "Content-Type: application/json" \
-d '{"model":"openai/gpt-5.1-codex-max","messages":[{"role":"user","content":"Write a Python script that monitors CPU usage and logs to a file"}],"reasoning_effort":"medium"}'GPT-5.1-Codex-Max 成为 Codex 默认模型,引入了原生上下文压缩功能以支持 24 小时以上的多窗口会话,xhigh 推理努力在 SWE-bench Verified 上达到 77.9%,中等推理努力下思考 token 比前代减少 30%。首个支持 Windows 环境的 Codex 模型。
GPT-5.1-Codex-Max 是升级后的默认 Codex 模型,有三个关键区别:(1) 原生上下文压缩,支持 24 小时以上的自主编程会话;(2) xhigh 推理努力级别,适用于非延迟敏感任务;(3) 显著更高的基准分数(SWE-bench Verified 77.9% 对 73.7%)。在相同中等推理努力下,思考 token 减少 30%。通过 TheRouter API 访问的价格与 GPT-5.1-Codex 相同($1.25/M 输入、$10/M 输出)。
OpenAI 首先为 Codex 界面发布了 GPT-5.1-Codex-Max(CLI、IDE 扩展、云端、代码审查),API 访问即将推出。TheRouter 已将 openai/gpt-5.1-codex-max 标记为 active 可用模型,可通过标准 /v1/chat/completions 端点访问。这意味着即使 Codex 原生功能(压缩、apply_patch、shell)需要 Codex 兼容框架,您今天就可以通过 TheRouter 路由基于 API 的工作流。
OpenAI 明确建议不要将 Codex 家族模型用于通用推理或非编程对话。GPT-5.1 (openai/gpt-5.1) 是通用变体,以相同价格更适合这些工作负载。请将 Codex-Max 专用于通过 Codex 或类 Codex 框架进行的 agentic 编程工作流。
| 来源 | URL | 采集于 | |
|---|---|---|---|
| 发布日期 | openai.com ↗ | 2026-05-28 | 已核实 |
| OpenAI API 模型 id | openai.com ↗ | 2026-05-28 | 已核实 |
| 模型类型 | openai.com ↗ | 2026-05-28 | 已核实 |
| 推理类型 | openai.com ↗ | 2026-05-28 | 已核实 |
| 上下文压缩 | openai.com ↗ | 2026-05-28 | 已核实 |
| Windows 环境支持 | openai.com ↗ | 2026-05-28 | 已核实 |
| 网络安全能力(Preparedness Framework) | openai.com ↗ | 2026-05-28 | 已核实 |
| 许可 | — | — | 已核实 |
| SWE-bench Verified | openai.com ↗ | 2026-05-28 | 已核实 |
| SWE-Lancer IC SWE | openai.com ↗ | 2026-05-28 | 已核实 |
| Terminal-Bench 2.0 | openai.com ↗ | 2026-05-28 | 已核实 |
| OpenAI 发布 GPT-5.1-Codex-Max,具备压缩功能和 xhigh 推理 | openai.com ↗ | 2026-05-28 | 已核实 |
| GPT-5.1-Codex-Max 与 GPT-5.1-Codex 有何不同? | openai.com ↗ | 2026-05-28 | 待核实 |
| GPT-5.1-Codex-Max 可通过 OpenAI API 访问,还是仅在 Codex 中可用? | openai.com ↗ | 2026-05-28 | 待核实 |
| GPT-5.1-Codex-Max 可以用于通用推理任务吗? | openai.com ↗ | 2026-05-28 | 待核实 |