GPT-5 Pro 在 OpenAI DevDay 2025 上发布
OpenAI 在 2025 DevDay 发布 GPT-5 Pro 作为下一代深度推理旗舰,取代 o3-pro 成为 OpenAI 性能最高的模型。o3-pro 仍可通过 API 使用,未宣布弃用,但新 UI 构建团队应评估 GPT-5 Pro 以获得最佳推理质量。
Version of o3 with more compute for better, more precise responses. Best for complex reasoning tasks where accuracy is paramount.
o3-pro 是 OpenAI 在 GPT-5 发布之前的推理专用模型,于 2025 年 6 月 10 日发布,作为 o3 的更高算力变体。它与 o3 共用底层权重,但在每一步推理阶段投入显著更多的推理时算力,OpenAI 将其形容为「思考得更努力」,以提供持续更精确的回答。在 TheRouter 上,openai/o3-pro 被映射到标准 chat completions endpoint,定价为每百万输入 Token $20、每百万输出 Token $80,提供 200K 上下文窗口、最多 100K 输出 Token。
o3-pro 在 ChatGPT 中取代了 o1-pro,是 OpenAI 为「准确性比延迟更重要」的场景推荐的模型——人工评估在所有测试类别中(尤其是科学、教育、编程、商业和写作帮助)都更偏好 o3-pro 的回答而非 o3。模型拥有完整的工具访问能力(网页搜索、文件分析、视觉理解、Python、记忆),但无法生成图像、不支持 Canvas,单次回答可能需要数分钟。在 GPT-5 Pro 于 2025 DevDay 发布后,对于需要深度推理但不愿支付 GPT-5 Pro $18.75/$150 价格的团队,o3-pro 成为了更具性价比的替代方案。
| 类型 | 费率 |
|---|---|
| 输入 | $21.60 每百万 Tokens |
| 输出 | $86.40 每百万 Tokens |
| 发布日期 | 2025-06-10techcrunch.com ↗ | 已核实 |
| 知识截止日期 | 2024 年 5 月llm-stats.com ↗ | 已核实 |
| 推理模式 | 默认开启高算力推理;与 o3 共用底层模型但推理时算力更多platform.openai.com ↗ | 已核实 |
| 原生 API | 原生仅支持 Responses API;TheRouter 通过 chat completions endpoint 暴露platform.openai.com ↗ | 已核实 |
| 工具支持 | 支持网页搜索、文件分析、视觉理解、Python、记忆;不支持图像生成;不支持 Canvastechcrunch.com ↗ | 已核实 |
| 许可 | OpenAI Terms of Use(闭源,仅 API) | 已核实 |
| Benchmark | Distribution | Score | Source |
|---|---|---|---|
AIME 2024 OpenAI 在发布对比中报告 o3-pro 在 2024 年美国数学邀请赛上领先 Google 的 Gemini 2.5 Pro。发布当天的社区汇总将该成绩定在约 93%(同一图表上 Gemini 2.5 Pro 0605 约 89%)。 | 93%% | r/singularity launch-day benchmarks thread ↗ | |
GPQA Diamond 博士级科学问答。OpenAI 发布数据显示 o3-pro 在该基准上领先 Anthropic 的 Claude 4 Opus,约 84%(社区汇总同时引用 Gemini 2.5 Pro 0605 在同一图上约 86%)。 | 84%% | techcrunch.com ↗ | |
4-for-4 reliability (AIME 2024) OpenAI 的「可靠性」指标要求模型连续四次正确回答同一问题。o3-pro 在更严格的衡量下于 AIME 2024 达到 90%,说明额外的推理算力不仅提升平均准确率,也降低了方差。 | 90%% | OpenAI launch chart summary ↗ | |
4-for-4 reliability (GPQA Diamond) 在同一 4-for-4 可靠性测试中,o3-pro 在 GPQA Diamond 上有 76% 的尝试连续四次回答正确——明显高于 o3 在同一测试装置上的成绩。 | 76%% | OpenAI launch chart summary ↗ |
所有新集成都应使用下方示例中的全球端点 api.therouter.ai;旧中国加速端点已下线。
curl https://api.therouter.ai/v1/chat/completions -H "Content-Type: application/json" -H "Authorization: Bearer $THE_ROUTER_API_KEY" -d '{
"model": "openai/o3-pro",
"messages": [
{"role": "user", "content": "Summarize the key points from this input."}
]
}'通过 TheRouter 的标准 chat completions endpoint 调用 openai/o3-pro。推理过程在服务端进行,模型在单条消息中返回最终答案。难题可能需要几分钟——请将客户端超时调高到至少 600 秒。
curl https://api.therouter.ai/v1/chat/completions \
-H "Authorization: Bearer $THEROUTER_API_KEY" \
-H "Content-Type: application/json" \
--max-time 900 \
-d '{
"model": "openai/o3-pro",
"messages": [
{"role": "user", "content": "Prove that for every prime p > 2, p^2 - 1 is divisible by 24. Show every step."}
]
}'OpenAI 在 2025 DevDay 发布 GPT-5 Pro 作为下一代深度推理旗舰,取代 o3-pro 成为 OpenAI 性能最高的模型。o3-pro 仍可通过 API 使用,未宣布弃用,但新 UI 构建团队应评估 GPT-5 Pro 以获得最佳推理质量。
OpenAI 于 2025 年 6 月 10 日向所有 API 层级开放 o3-pro。该模型在 ChatGPT Pro 和 Team 中取代了 o1-pro,完整的工具访问能力(网页、文件、视觉、Python、记忆),价格为每百万 Token $20/$80。人工评估在所有测试类别(特别是科学、教育和商业写作)中均高于 o3。
OpenAI 发布了 o 系列推理模型 o3 和 o4-mini,并预览了 o3-pro 计划在「几周后」推出,定位为 o3 之上应对最困难问题的级别。
GPT-5 Pro(2025 年 10 月发布)在 OpenAI 推理基准上超越了 o3-pro,是当前推荐的旗舰模型。o3-pro 依然是非常强大的模型,且定价远低于 GPT-5 Pro($20/$80 vs $18.75/$150),对不需要绝对最高性能的团队来说是很好的性价比选择。
两者共用相同的底层模型权重。o3-pro 在每一步使用更多推理时算力——OpenAI 称为「思考得更努力」。结果是硬问题上更高精度和更低方差(可通过 OpenAI 的 4-for-4 可靠性指标衡量),代价是每次请求延迟更长以及 $20/$80 的更高定价。
o3-pro 原生仅支持 Responses API。TheRouter 将其映射到标准 chat completions endpoint,因此你可以用熟悉的 /v1/chat/completions 路径、使用现有的 OpenAI 兼容客户端调用。API 同往常一样接受图像、工具、reasoning 参数和角色消息。
OpenAI 警告「某些请求可能需要数分钟才能完成」。LLM-Stats 第三方数据显示典型短 prompt 约 30 秒,约 25 字符/秒吞吐。在真正困难的推理任务(跨多页代码审计、复杂数学证明、多文档研究)上,预计需要 3 到 10 分钟。在 TheRouter 上,请将客户端超时设为至少 600–900 秒,延迟敏感时考虑将超大问题拆分到多个请求。
不能。o3-pro 仅输出文本。它可以接收图像输入(用于对示意图、图表和代码截屏进行推理),但生成图像请使用 openai/gpt-image-2 或 openai/chatgpt-image-latest。
| 来源 | URL | 采集于 | |
|---|---|---|---|
| 发布日期 | techcrunch.com ↗ | 2026-06-01 | 已核实 |
| 知识截止日期 | llm-stats.com ↗ | 2026-06-01 | 已核实 |
| 推理模式 | platform.openai.com ↗ | 2026-06-01 | 已核实 |
| 原生 API | platform.openai.com ↗ | 2026-06-01 | 已核实 |
| 工具支持 | techcrunch.com ↗ | 2026-06-01 | 已核实 |
| 许可 | — | — | 已核实 |
| AIME 2024 | r/singularity launch-day benchmarks thread ↗ | 2026-06-01 | 待核实 |
| GPQA Diamond | techcrunch.com ↗ | 2026-06-01 | 待核实 |
| 4-for-4 reliability (AIME 2024) | OpenAI launch chart summary ↗ | 2026-06-01 | 待核实 |
| 4-for-4 reliability (GPQA Diamond) | OpenAI launch chart summary ↗ | 2026-06-01 | 待核实 |
| GPT-5 Pro 在 OpenAI DevDay 2025 上发布 | openai.com ↗ | 2026-06-01 | 已核实 |
| o3-pro 发布,取代 o1-pro | techcrunch.com ↗ | 2026-06-01 | 已核实 |
| o3 与 o4-mini 发布,o3-pro 预览计划公布 | openai.com ↗ | 2026-06-01 | 已核实 |
| o3-pro 的响应需要多长时间? | platform.openai.com ↗ | 2026-06-01 | 待核实 |