返回模型列表

o3-pro

openaiopenai/o3-pro

Version of o3 with more compute for better, more precise responses. Best for complex reasoning tasks where accuracy is paramount.

o3-pro 是 OpenAI 在 GPT-5 发布之前的推理专用模型,于 2025 年 6 月 10 日发布,作为 o3 的更高算力变体。它与 o3 共用底层权重,但在每一步推理阶段投入显著更多的推理时算力,OpenAI 将其形容为「思考得更努力」,以提供持续更精确的回答。在 TheRouter 上,openai/o3-pro 被映射到标准 chat completions endpoint,定价为每百万输入 Token $20、每百万输出 Token $80,提供 200K 上下文窗口、最多 100K 输出 Token。

o3-pro 在 ChatGPT 中取代了 o1-pro,是 OpenAI 为「准确性比延迟更重要」的场景推荐的模型——人工评估在所有测试类别中(尤其是科学、教育、编程、商业和写作帮助)都更偏好 o3-pro 的回答而非 o3。模型拥有完整的工具访问能力(网页搜索、文件分析、视觉理解、Python、记忆),但无法生成图像、不支持 Canvas,单次回答可能需要数分钟。在 GPT-5 Pro 于 2025 DevDay 发布后,对于需要深度推理但不愿支付 GPT-5 Pro $18.75/$150 价格的团队,o3-pro 成为了更具性价比的替代方案。

适合使用
  • • 数学密集型推理:在 OpenAI 内部测试中 AIME 2024 取得 93%,在同一数学竞赛基准上明显领先 Gemini 2.5 Pro
  • • 博士级科学问答——GPQA Diamond 取得 84%,按 OpenAI 发布对比领先 Anthropic 的 Claude 4 Opus
  • • 受益于额外推理算力和完整工具调用(Python、网页搜索、文件分析)的长篇细致编程/调试任务
  • • 多步骤研究与分析场景,能够接受分钟级延迟以换取更高的回答质量
  • • 原本使用 o1-pro 的工作流——o3-pro 是其在 ChatGPT 和 API 中的直接继任者
不适合使用
  • • 对延迟敏感的产品链路——单次请求可能耗时数分钟;请改用 openai/o3、openai/o4-mini 或 openai/gpt-5
  • • 图像生成——o3-pro 仅输出文本;请用 openai/gpt-image-2 或 openai/chatgpt-image-latest 生成图像
  • • 大批量打分或短文本分类——以 $80/百万输出 Token 加上每次都做深度推理计费,成本扩展不利。请用 openai/gpt-5-mini、openai/gpt-5-nano 或 openai/o4-mini。
  • • 需要 OpenAI 当前最前沿智能时——GPT-5 Pro 是更新的顶级推理层级;o3-pro 属于上一代。
上下文长度
200K
最大输出
100K
输入价格每百万 tokens
$21.60每百万 Tokens
输出价格每百万 tokens
$86.40每百万 Tokens

模态能力

文本图像→文本

能力

视觉理解

价格明细

类型费率
输入$21.60 每百万 Tokens
输出$86.40 每百万 Tokens

支持参数

max_tokenstoolstool_choiceresponse_formatreasoningstop

模型规格

发布日期2025-06-10techcrunch.com ↗已核实
知识截止日期2024 年 5 月llm-stats.com ↗已核实
推理模式默认开启高算力推理;与 o3 共用底层模型但推理时算力更多platform.openai.com ↗已核实
原生 API原生仅支持 Responses API;TheRouter 通过 chat completions endpoint 暴露platform.openai.com ↗已核实
工具支持支持网页搜索、文件分析、视觉理解、Python、记忆;不支持图像生成;不支持 Canvastechcrunch.com ↗已核实
许可OpenAI Terms of Use(闭源,仅 API)已核实

基准成绩

BenchmarkDistributionScoreSource
AIME 2024
OpenAI 在发布对比中报告 o3-pro 在 2024 年美国数学邀请赛上领先 Google 的 Gemini 2.5 Pro。发布当天的社区汇总将该成绩定在约 93%(同一图表上 Gemini 2.5 Pro 0605 约 89%)。
93%%r/singularity launch-day benchmarks thread ↗
GPQA Diamond
博士级科学问答。OpenAI 发布数据显示 o3-pro 在该基准上领先 Anthropic 的 Claude 4 Opus,约 84%(社区汇总同时引用 Gemini 2.5 Pro 0605 在同一图上约 86%)。
84%%techcrunch.com ↗
4-for-4 reliability (AIME 2024)
OpenAI 的「可靠性」指标要求模型连续四次正确回答同一问题。o3-pro 在更严格的衡量下于 AIME 2024 达到 90%,说明额外的推理算力不仅提升平均准确率,也降低了方差。
90%%OpenAI launch chart summary ↗
4-for-4 reliability (GPQA Diamond)
在同一 4-for-4 可靠性测试中,o3-pro 在 GPQA Diamond 上有 76% 的尝试连续四次回答正确——明显高于 o3 在同一测试装置上的成绩。
76%%OpenAI launch chart summary ↗

API 使用示例

所有新集成都应使用下方示例中的全球端点 api.therouter.ai;旧中国加速端点已下线。

cURL
curl https://api.therouter.ai/v1/chat/completions   -H "Content-Type: application/json"   -H "Authorization: Bearer $THE_ROUTER_API_KEY"   -d '{
    "model": "openai/o3-pro",
    "messages": [
      {"role": "user", "content": "Summarize the key points from this input."}
    ]
  }'

API 使用指南

完整 API 参考 →

Chat 调用

通过 TheRouter 的标准 chat completions endpoint 调用 openai/o3-pro。推理过程在服务端进行,模型在单条消息中返回最终答案。难题可能需要几分钟——请将客户端超时调高到至少 600 秒。

cURL
curl https://api.therouter.ai/v1/chat/completions \
  -H "Authorization: Bearer $THEROUTER_API_KEY" \
  -H "Content-Type: application/json" \
  --max-time 900 \
  -d '{
    "model": "openai/o3-pro",
    "messages": [
      {"role": "user", "content": "Prove that for every prime p > 2, p^2 - 1 is divisible by 24. Show every step."}
    ]
  }'

openai 其他模型

同类模型

跨供应商的相似能力档位

动态与变更

2025-10-06

GPT-5 Pro 在 OpenAI DevDay 2025 上发布

OpenAI 在 2025 DevDay 发布 GPT-5 Pro 作为下一代深度推理旗舰,取代 o3-pro 成为 OpenAI 性能最高的模型。o3-pro 仍可通过 API 使用,未宣布弃用,但新 UI 构建团队应评估 GPT-5 Pro 以获得最佳推理质量。

TheRouter 编辑重写openai.com ↗
2025-06-10

o3-pro 发布,取代 o1-pro

OpenAI 于 2025 年 6 月 10 日向所有 API 层级开放 o3-pro。该模型在 ChatGPT Pro 和 Team 中取代了 o1-pro,完整的工具访问能力(网页、文件、视觉、Python、记忆),价格为每百万 Token $20/$80。人工评估在所有测试类别(特别是科学、教育和商业写作)中均高于 o3。

TheRouter 编辑重写techcrunch.com ↗
2025-04-16

o3 与 o4-mini 发布,o3-pro 预览计划公布

OpenAI 发布了 o 系列推理模型 o3 和 o4-mini,并预览了 o3-pro 计划在「几周后」推出,定位为 o3 之上应对最困难问题的级别。

TheRouter 编辑重写openai.com ↗

常见问题

o3-pro 还是 OpenAI 最强的推理模型吗?

GPT-5 Pro(2025 年 10 月发布)在 OpenAI 推理基准上超越了 o3-pro,是当前推荐的旗舰模型。o3-pro 依然是非常强大的模型,且定价远低于 GPT-5 Pro($20/$80 vs $18.75/$150),对不需要绝对最高性能的团队来说是很好的性价比选择。

TheRouter 编辑重写
o3-pro 与 o3 有什么不同?

两者共用相同的底层模型权重。o3-pro 在每一步使用更多推理时算力——OpenAI 称为「思考得更努力」。结果是硬问题上更高精度和更低方差(可通过 OpenAI 的 4-for-4 可靠性指标衡量),代价是每次请求延迟更长以及 $20/$80 的更高定价。

TheRouter 编辑重写
o3-pro 支持 OpenAI Chat Completions API 吗?

o3-pro 原生仅支持 Responses API。TheRouter 将其映射到标准 chat completions endpoint,因此你可以用熟悉的 /v1/chat/completions 路径、使用现有的 OpenAI 兼容客户端调用。API 同往常一样接受图像、工具、reasoning 参数和角色消息。

TheRouter 编辑重写
o3-pro 的响应需要多长时间?

OpenAI 警告「某些请求可能需要数分钟才能完成」。LLM-Stats 第三方数据显示典型短 prompt 约 30 秒,约 25 字符/秒吞吐。在真正困难的推理任务(跨多页代码审计、复杂数学证明、多文档研究)上,预计需要 3 到 10 分钟。在 TheRouter 上,请将客户端超时设为至少 600–900 秒,延迟敏感时考虑将超大问题拆分到多个请求。

TheRouter 编辑重写platform.openai.com ↗
o3-pro 能生成图像吗?

不能。o3-pro 仅输出文本。它可以接收图像输入(用于对示意图、图表和代码截屏进行推理),但生成图像请使用 openai/gpt-image-2 或 openai/chatgpt-image-latest。

TheRouter 编辑重写
事实档案 — 本页每条断言可在此回溯来源
来源URL采集于
发布日期techcrunch.com ↗2026-06-01已核实
知识截止日期llm-stats.com ↗2026-06-01已核实
推理模式platform.openai.com ↗2026-06-01已核实
原生 APIplatform.openai.com ↗2026-06-01已核实
工具支持techcrunch.com ↗2026-06-01已核实
许可——已核实
AIME 2024r/singularity launch-day benchmarks thread ↗2026-06-01待核实
GPQA Diamondtechcrunch.com ↗2026-06-01待核实
4-for-4 reliability (AIME 2024)OpenAI launch chart summary ↗2026-06-01待核实
4-for-4 reliability (GPQA Diamond)OpenAI launch chart summary ↗2026-06-01待核实
GPT-5 Pro 在 OpenAI DevDay 2025 上发布openai.com ↗2026-06-01已核实
o3-pro 发布,取代 o1-protechcrunch.com ↗2026-06-01已核实
o3 与 o4-mini 发布,o3-pro 预览计划公布openai.com ↗2026-06-01已核实
o3-pro 的响应需要多长时间?platform.openai.com ↗2026-06-01待核实
帮助与联系