返回模型列表

GPT-5.1-Codex-Max 是 OpenAI 的前沿 agentic 编程模型,专为跨小时甚至天数执行的长时间软件工程任务而设计。它于 2025 年 11 月 18–19 日发布,是首个原生支持跨多个上下文窗口的 OpenAI 模型,通过称为压缩(compaction)的过程,在单个任务中自动修剪历史记录同时保留最重要的上下文,从而在大规模 token 范围内连贯工作。它取代 GPT-5.1-Codex 成为 Codex 界面(CLI、IDE 扩展、云端沙箱和代码审查)的默认模型。

GPT-5.1-Codex-Max 基于 OpenAI 基础推理模型的更新版本构建,在真实软件工程任务上进行了训练:PR 创建、代码审查、前端编码、问答,以及首次支持的 Windows 环境操作。该模型引入了 xhigh(‘Extra High’)推理努力级别,为非延迟敏感任务分配更多思考时间。压缩功能支持 24 小时以上的自主会话——当上下文窗口接近满时自动压缩,释放空间继续执行任务,反复进行直至完成。

从 TheRouter 运营者的角度看,GPT-5.1-Codex-Max 标记为 active 状态,可通过标准 /v1/chat/completions 端点访问,支持完整的 OpenAI 兼容参数(temperature、max_tokens、tools、tool_choice、response_format、reasoning、stop)。它共享 GPT-5.1 的 400K 上下文窗口和 128K 最大输出,定价为 $1.25/M 输入 token、$10/M 输出 token、$0.125/M 缓存读取。此模型最适合通过 Codex 或类似工具链路由的 agentic 编程工作流——通用推理任务请路由到 openai/gpt-5.1。

适合使用
  • • 长时间自主编程会话(24 小时以上)——压缩功能使 GPT-5.1-Codex-Max 能够迭代实现、修复测试失败并交付结果,无需人工干预且能处理数百万 token 的任务
  • • 项目级大规模重构——通过跨窗口压缩保持连贯工作,处理以前因上下文窗口限制而失败的重构任务
  • • Token 高效的 agentic 编程——在 ‘medium’ 推理努力下,比 GPT-5.1-Codex 获得更高 SWE-bench 得分,同时思考 token 减少 30%;节省的成本直接转化为开发者的实际节省
  • • SWE-bench、SWE-Lancer 和 Terminal-Bench 基准测试——在 GPT-5.1 Codex 家族中得分最高,分别为 77.9%、79.9% 和 58.1%(xhigh 推理努力)
不适合使用
  • • 通用推理和非编程对话——GPT-5.1 (openai/gpt-5.1) 更适合这些工作负载且价格相同,请通过 TheRouter 路由
  • • 亚秒级交互式编程——GPT-5.1-Codex-Mini (openai/gpt-5.1-codex-mini) 仅 $0.25/M 输入、$2/M 输出,为快速编辑和代码补全提供更快的响应
  • • 追求绝对最高 SWE-bench 分数——Claude Opus 4.7 (anthropic/claude-opus-4.7) 和 GPT-5.2-Codex (openai/gpt-5.2-codex) 获得更高 SWE-bench 成绩;基准追逐型工作负载可考虑它们
  • • 不使用 agentic 工具的简单聊天补全——压缩和 xhigh 推理的开销被浪费;请路由到更便宜的模型如 GPT-5 Mini 或 GPT-5 Nano
上下文长度
400K
最大输出
128K
输入价格每百万 tokens
$1.35每百万 Tokens
输出价格每百万 tokens
$10.80每百万 Tokens

模态能力

文本图像→文本

能力

视觉理解

价格明细

类型费率
输入$1.35 每百万 Tokens
输出$10.80 每百万 Tokens

支持参数

temperaturemax_tokenstop_ptoolstool_choiceresponse_formatreasoningstop

模型规格

发布日期2025-11-18openai.com ↗已核实
OpenAI API 模型 idgpt-5.1-codex-maxopenai.com ↗已核实
模型类型前沿 agentic 编程模型,原生支持压缩——首个为多窗口上下文操作训练的 OpenAI 模型openai.com ↗已核实
推理类型自适应——支持 ‘none’、‘low’、‘medium’、‘high’ 和 ‘xhigh’(Extra High)推理努力级别;xhigh 为非延迟敏感任务分配最大思考时间openai.com ↗已核实
上下文压缩原生多窗口压缩——自动修剪会话历史同时保留关键上下文,支持持续 24 小时以上数百万 token 的连贯工作openai.com ↗已核实
Windows 环境支持首个支持 Windows 环境的 Codex 模型openai.com ↗已核实
网络安全能力(Preparedness Framework)OpenAI 迄今部署的网络安全能力最强的模型——未达到 High 阈值但正在快速演进;生物学分类为 High;专用网络监控已启用openai.com ↗已核实
许可专有(OpenAI API 服务条款 / ChatGPT 订阅)已核实

基准成绩

BenchmarkDistributionScoreSource
SWE-bench Verified
xhigh 推理努力,n=500——GPT-5.1-Codex(high)得分为 73.7%。相同 ‘medium’ 努力下思考 token 比 GPT-5.1-Codex 少 30%。
77.9%%openai.com ↗
SWE-Lancer IC SWE
xhigh 推理努力——GPT-5.1-Codex(high)得分为 66.3%。
79.9%%openai.com ↗
Terminal-Bench 2.0
xhigh 推理努力——GPT-5.1-Codex(high)得分为 52.8%。
58.1%%openai.com ↗

API 使用示例

所有新集成都应使用下方示例中的全球端点 api.therouter.ai;旧中国加速端点已下线。

cURL
curl https://api.therouter.ai/v1/chat/completions   -H "Content-Type: application/json"   -H "Authorization: Bearer $THE_ROUTER_API_KEY"   -d '{
    "model": "openai/gpt-5.1-codex-max",
    "messages": [
      {"role": "user", "content": "Summarize the key points from this input."}
    ]
  }'

API 使用指南

完整 API 参考 →

Chat 调用

GPT-5.1-Codex-Max 通过标准 chat completions 端点访问。对于 agentic 编程工作流,请通过 Codex 或兼容框架路由以利用 apply_patch 和 shell 工具。

cURL
curl https://api.therouter.ai/v1/chat/completions \
  -H "Authorization: Bearer $THEROUTER_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{"model":"openai/gpt-5.1-codex-max","messages":[{"role":"user","content":"Write a Python script that monitors CPU usage and logs to a file"}],"reasoning_effort":"medium"}'

openai 其他模型

同类模型

跨供应商的相似能力档位

动态与变更

2025-11-18

OpenAI 发布 GPT-5.1-Codex-Max,具备压缩功能和 xhigh 推理

GPT-5.1-Codex-Max 成为 Codex 默认模型,引入了原生上下文压缩功能以支持 24 小时以上的多窗口会话,xhigh 推理努力在 SWE-bench Verified 上达到 77.9%,中等推理努力下思考 token 比前代减少 30%。首个支持 Windows 环境的 Codex 模型。

TheRouter 编辑重写openai.com ↗

常见问题

GPT-5.1-Codex-Max 与 GPT-5.1-Codex 有何不同?

GPT-5.1-Codex-Max 是升级后的默认 Codex 模型,有三个关键区别:(1) 原生上下文压缩,支持 24 小时以上的自主编程会话;(2) xhigh 推理努力级别,适用于非延迟敏感任务;(3) 显著更高的基准分数(SWE-bench Verified 77.9% 对 73.7%)。在相同中等推理努力下,思考 token 减少 30%。通过 TheRouter API 访问的价格与 GPT-5.1-Codex 相同($1.25/M 输入、$10/M 输出)。

GPT-5.1-Codex-Max 可通过 OpenAI API 访问,还是仅在 Codex 中可用?

OpenAI 首先为 Codex 界面发布了 GPT-5.1-Codex-Max(CLI、IDE 扩展、云端、代码审查),API 访问即将推出。TheRouter 已将 openai/gpt-5.1-codex-max 标记为 active 可用模型,可通过标准 /v1/chat/completions 端点访问。这意味着即使 Codex 原生功能(压缩、apply_patch、shell)需要 Codex 兼容框架,您今天就可以通过 TheRouter 路由基于 API 的工作流。

GPT-5.1-Codex-Max 可以用于通用推理任务吗?

OpenAI 明确建议不要将 Codex 家族模型用于通用推理或非编程对话。GPT-5.1 (openai/gpt-5.1) 是通用变体,以相同价格更适合这些工作负载。请将 Codex-Max 专用于通过 Codex 或类 Codex 框架进行的 agentic 编程工作流。

事实档案 — 本页每条断言可在此回溯来源
来源URL采集于
发布日期openai.com ↗2026-05-28已核实
OpenAI API 模型 idopenai.com ↗2026-05-28已核实
模型类型openai.com ↗2026-05-28已核实
推理类型openai.com ↗2026-05-28已核实
上下文压缩openai.com ↗2026-05-28已核实
Windows 环境支持openai.com ↗2026-05-28已核实
网络安全能力(Preparedness Framework)openai.com ↗2026-05-28已核实
许可——已核实
SWE-bench Verifiedopenai.com ↗2026-05-28已核实
SWE-Lancer IC SWEopenai.com ↗2026-05-28已核实
Terminal-Bench 2.0openai.com ↗2026-05-28已核实
OpenAI 发布 GPT-5.1-Codex-Max,具备压缩功能和 xhigh 推理openai.com ↗2026-05-28已核实
GPT-5.1-Codex-Max 与 GPT-5.1-Codex 有何不同?openai.com ↗2026-05-28待核实
GPT-5.1-Codex-Max 可通过 OpenAI API 访问,还是仅在 Codex 中可用?openai.com ↗2026-05-28待核实
GPT-5.1-Codex-Max 可以用于通用推理任务吗?openai.com ↗2026-05-28待核实
帮助与联系