OpenAI 发布 GPT-5.3-Codex — 最强的编程 agent 模型
OpenAI 宣布了 GPT-5.3-Codex,它融合了 GPT-5.2-Codex 的编程能力和 GPT-5.2 的推理能力。在 SWE-Bench Pro 和 Terminal-Bench 2.0 上实现 SOTA,速度比前代快约 25%。值得关注的是,它是首个参与了自身构建的 OpenAI 模型——早期版本协助调试了自己的训练和部署。
Most capable agentic coding model to date.
GPT-5.3-Codex 是 OpenAI 最强的编程 agent 模型,于 2026 年 2 月 5 日发布。它融合了 GPT-5.2-Codex 的前沿编程能力和 GPT-5.2 的推理与专业知识,速度相比前代提升了 25%。OpenAI 称它是首个参与了自身创建的模型——Codex 团队使用早期版本来调试训练、管理部署和分析评估结果。
从 TheRouter 路由层视角看,此模型专为长周期 agent 编程任务而生——多文件重构、自动漏洞修复、全栈应用从零开发。它支持视觉输入(文本+图像)、工具/函数调用、结构化输出(response_format),以及通过 reasoning 参数实现的扩展推理。在 TheRouter 上,输入每百万 token $5,输出每百万 token $40,上下文窗口 400K——比 GPT-5.2-Codex 贵不少,但吞吐量快了约 25%,且已达到 agent 基准测试的 SOTA 水平。
| 类型 | 费率 |
|---|---|
| 输入 | $1.89 每百万 Tokens |
| 输出 | $15.12 每百万 Tokens |
| 发布日期 | 2026-02-05openai.com ↗ | 已核实 |
| 训练数据截止 | 未公开披露 | 未知 |
| 许可 | 专有 — OpenAI API 服务条款openai.com ↗ | 已核实 |
| 相比 GPT-5.2-Codex 速度提升 | 约 25%openai.com ↗ | 已核实 |
| 网络安全风险等级 | 高(预防性分类 — 按 Preparedness Framework)openai.com ↗ | 已核实 |
| Benchmark | Distribution | Score | Source |
|---|---|---|---|
SWE-Bench Pro 多语言严格评估;发布时未公布精确百分比 | State-of-the-art | openai.com ↗ | |
Terminal-Bench 2.0 SOTA;使用的 token 少于任何前代模型 | 77.3%% | llm-stats.com ↗ | |
OSWorld-Verified 计算机使用基准测试;人类基线约 72% | 64.7%% | llm-stats.com ↗ | |
SWE-Lancer IC Diamond | 81.4%% | llm-stats.com ↗ | |
GDPval 44 个职业;真实世界知识工作任务 | Matches GPT-5.2 | openai.com ↗ |
所有新集成都应使用下方示例中的全球端点 api.therouter.ai;旧中国加速端点已下线。
curl https://api.therouter.ai/v1/chat/completions -H "Content-Type: application/json" -H "Authorization: Bearer $THE_ROUTER_API_KEY" -d '{
"model": "openai/gpt-5.3-codex",
"messages": [
{"role": "user", "content": "Summarize the key points from this input."}
]
}'标准 chat completions 调用。GPT-5.3-Codex 擅长开放式编程 agent 对话。
curl https://api.therouter.ai/v1/chat/completions \
-H "Authorization: Bearer $THEROUTER_API_KEY" \
-H "Content-Type: application/json" \
-d '{"model":"openai/gpt-5.3-codex","messages":[{"role":"user","content":"Write a Python script to monitor system CPU and memory usage"}]}'OpenAI 宣布了 GPT-5.3-Codex,它融合了 GPT-5.2-Codex 的编程能力和 GPT-5.2 的推理能力。在 SWE-Bench Pro 和 Terminal-Bench 2.0 上实现 SOTA,速度比前代快约 25%。值得关注的是,它是首个参与了自身构建的 OpenAI 模型——早期版本协助调试了自己的训练和部署。
GPT-5.3-Codex 将 GPT-5.2-Codex 的编程能力与 GPT-5.2 的推理和专业知识融合到一个模型中,使其在超出纯代码生成的任务中更加通用——例如研究、工具使用和复杂执行。它比 GPT-5.2-Codex 快约 25%,并在 Terminal-Bench 2.0 和 SWE-Bench Pro 上获得 SOTA 成绩。但在 TheRouter 上,它每百万 token 定价 $5/$40,而 GPT-5.2-Codex 是 $1.25/$10,因此对成本敏感的路线应根据任务复杂度进行比较。
支持。GPT-5.3-Codex 接受文本和图像输入(根据 standard-models.yaml,模态为 text + image)。它不生成图像——输出仅为文本。对于截图、图表或 UI 原型等图像分析任务,模型可作为编程 agent 工作流的一部分处理它们。
| 来源 | URL | 采集于 | |
|---|---|---|---|
| 发布日期 | openai.com ↗ | 2026-05-28 | 已核实 |
| 训练数据截止 | — | — | 未知 |
| 许可 | openai.com ↗ | 2026-05-28 | 已核实 |
| 相比 GPT-5.2-Codex 速度提升 | openai.com ↗ | 2026-05-28 | 已核实 |
| 网络安全风险等级 | openai.com ↗ | 2026-05-28 | 已核实 |
| SWE-Bench Pro | openai.com ↗ | 2026-05-28 | 已核实 |
| Terminal-Bench 2.0 | llm-stats.com ↗ | 2026-05-28 | 待核实 |
| OSWorld-Verified | llm-stats.com ↗ | 2026-05-28 | 待核实 |
| SWE-Lancer IC Diamond | llm-stats.com ↗ | 2026-05-28 | 待核实 |
| GDPval | openai.com ↗ | 2026-05-28 | 已核实 |
| OpenAI 发布 GPT-5.3-Codex — 最强的编程 agent 模型 | openai.com ↗ | 2026-05-28 | 已核实 |
| GPT-5.3-Codex 与 GPT-5.2-Codex 有什么区别? | openai.com ↗ | 2026-05-28 | 待核实 |
| GPT-5.3-Codex 支持视觉输入吗? | openai.com ↗ | 2026-05-28 | 待核实 |