返回模型列表

GPT-4o

openaiopenai/gpt-4o

OpenAI's versatile, high-intelligence flagship model. Accepts text and image inputs, produces text outputs including structured outputs. Best model for most tasks outside reasoning-heavy use cases.

GPT-4o('omni')于 2024 年 5 月 13 日发布,是 OpenAI 旗舰级多模态模型,支持文本、图像和音频输入,并生成文本与音频输出。它以 GPT-4 Turbo 级别的智能水平、半价成本和接近实时的语音对话延迟——为生产环境 AI 负载的可及性与成本效率带来了质的飞跃。GPT-4o MMLU 达 88.7 %,HumanEval 超过 90 %,在图像、PDF 和图表输入的视觉理解方面树立了新标准。

从 TheRouter 路由层视角看,GPT-4o 占据独特位置:它是无需链式推理(由 o 系列覆盖)或极端成本效益(由 GPT-4o Mini 覆盖)的混合模态工作负载中最广泛适用的单一模型。截至 2026 年 5 月,GPT-4o 在 TheRouter 上广泛可调用,且在 OpenAI API 中仍保持活跃,尽管已于 2026 年 2 月 13 日从 ChatGPT 退役以推广 GPT-5.2。其继任者 GPT-4.1 在智能评测中匹配或超越 GPT-4o,同时延迟降低近一半、成本降低 83 %——使得 GPT-4o 主要适合依赖其特定提示兼容性画像或语音/多模态管线稳定性的工作流。

适合使用
  • • 多模态视觉+语言工作负载——包含图表、手写、表格和照片的文档场景,图像理解质量大于推理深度
  • • 语音驱动的 agent 和实时音频应用——利用 GPT-4o 原生音频模态(接收音频、思考、232 ms 内返回音频)
  • • 高吞吐结构化输出管线(JSON、工具调用)——$2.50/$10/百万 token 具备竞争力,新模型降价不足以覆盖迁移成本时
  • • 基准测试与回归连续性——围绕 GPT-4o 特定输出分布构建了广泛评估套件的团队,可从持续 API 可用性中受益
不适合使用
  • • 复杂多步推理或代码生成任务——需要链式推理的场景请路由到 openai/o3 或 o4-mini 以获得最佳结果
  • • 成本敏感的高吞吐对话——GPT-4o Mini($0.15/$0.60)或 GPT-4.1(比 GPT-4o 便宜 20 %/token)在不错的质量下提供显著更低的成本
  • • 延迟敏感亚秒级分类——GPT-4.1 nano 在单轮结构化任务上提供高达 4 倍更快的响应时间且成本更低
上下文长度
128K
最大输出
16K
输入价格每百万 tokens
$2.70每百万 Tokens
输出价格每百万 tokens
$10.80每百万 Tokens

模态能力

文本图像→文本

能力

视觉理解

价格明细

类型费率
输入$2.70 每百万 Tokens
输出$10.80 每百万 Tokens

支持参数

temperaturemax_tokenstop_ptoolstool_choiceresponse_formatstop

模型规格

发布日期2024-05-13openai.com ↗已核实
最新快照版本gpt-4o-2024-11-20(2024 年 11 月);早期版本 gpt-4o-2024-08-06;原始版本 gpt-4o-2024-05-13developers.openai.com ↗已核实
训练数据截止未公开披露(估计 2023 年 10 月)单一来源
输入模态文本、图像(含 PDF 和图表)、音频openai.com ↗已核实
输出模态文本(默认)、音频(realtime API)、结构化 JSON(response_format)openai.com ↗已核实
结构化输出支持——原生 response_format(json_schema、json_object)platform.openai.com ↗已核实
最大输出 token16 384(标准);4 096(realtime API 音频模式)developers.openai.com ↗已核实
部署平台OpenAI API、Azure OpenAI、Amazon Bedrock、Google Cloud Vertex AI、Microsoft Foundryopenai.com ↗已核实
许可OpenAI 服务条款(闭源,仅 API)已核实

基准成绩

BenchmarkDistributionScoreSource
MMLU
OpenAI 发布时报告的成绩——57 个学科接近专家水平。
88.7%openai.com ↗
HumanEval
GPT-4o 在多种提示复杂度下达到接近专家的 Python 代码生成水平。
~90.2%openai.com ↗
MMMU
大型多学科多模态理解基准——衡量 6 个学科的视觉语言推理能力。
69.1%openai.com ↗
MATH
OpenAI 系统卡报告的成绩。零样本 chain-of-thought 提示。
76.6%openai.com ↗
GSM8K
小学数学应用题——八样本 chain-of-thought。GPT-4o 与 GPT-4 Turbo 水平相当。
90.5%openai.com ↗

API 使用示例

所有新集成都应使用下方示例中的全球端点 api.therouter.ai;旧中国加速端点已下线。

cURL
curl https://api.therouter.ai/v1/chat/completions   -H "Content-Type: application/json"   -H "Authorization: Bearer $THE_ROUTER_API_KEY"   -d '{
    "model": "openai/gpt-4o",
    "messages": [
      {"role": "user", "content": "Summarize the key points from this input."}
    ]
  }'

API 使用指南

完整 API 参考 →

Chat 调用

通过 TheRouter 的 OpenAI 兼容端点进行标准对话或文本输入输出。

cURL
curl https://api.therouter.ai/v1/chat/completions \
  -H "Authorization: Bearer $THEROUTER_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{"model":"openai/gpt-4o","messages":[{"role":"user","content":"Explain what GPT-4o is in one sentence."}]}'

openai 其他模型

同类模型

跨供应商的相似能力档位

动态与变更

2026-02-13

GPT-4o 从 ChatGPT 退役

OpenAI 于 2026 年 2 月 13 日将 GPT-4o 从 ChatGPT 退役(与 GPT-4.1、GPT-4.1 mini 和 o4-mini 一同),以推广 GPT-5.2。该模型在 OpenAI API 和 TheRouter 上仍可用,未宣布 API 弃用时间表。

TheRouter 编辑重写openai.com ↗
2025-03-11

GPT-4.1 发布:GPT-4o 的直接继任者

OpenAI 发布 GPT-4.1,在智能评测中匹配或超越 GPT-4o,同时延迟降低近一半、成本降低 83%。GPT-4.1 家族包括 GPT-4.1 mini 和 GPT-4.1 nano 作为更小、更便宜的替代方案。

TheRouter 编辑重写openai.com ↗
2024-11-20

GPT-4o 2024 年 11 月快照发布

OpenAI 发布 gpt-4o-2024-11-20 快照,性能提升、延迟降低。截至 2026 年 5 月,这是新集成推荐的快照版本。

TheRouter 编辑重写openai.com ↗

常见问题

GPT-4o 在 API 中是否仍可用?

是的。GPT-4o 于 2026 年 2 月 13 日从 ChatGPT 退役,但在 OpenAI API 和 TheRouter 上仍完全可用,未宣布 API 弃用日期。推荐使用 gpt-4o-2024-11-20 快照版本。

GPT-4o 和 GPT-4o Mini 有什么区别?

GPT-4o 是旗舰级多模态模型,具有完整的视觉、音频和结构化输出能力,定价 $2.50/$10/百万 token。GPT-4o Mini 是轻量级文本聚焦变体,定价 $0.15/$0.60/百万 token(便宜 17 倍),智能水平较低但在简单任务上性能出色。两者均支持 128K 上下文。

GPT-4o 可以处理音频输入吗?

GPT-4o 原生支持音频输入,可近实时输出音频(语音到语音延迟低至 232 ms)。但音频输入/输出需要使用 OpenAI 的 Realtime API 端点(/v1/realtime),而非标准 /v1/chat/completions 端点。在 TheRouter 上,使用 openai/realtime-preview 或 openai/gpt-4o-audio-preview 模型别名用于语音应用。

GPT-4o 是推理模型吗?

不是。GPT-4o 是通用多模态模型,不具备显式链式推理能力。对于复杂多步推理、代码或数学任务,请路由到 openai/o3、o4-mini 或 o3-pro,这些模型专为扩展思考设计。

事实档案 — 本页每条断言可在此回溯来源
来源URL采集于
发布日期openai.com ↗2026-05-28已核实
最新快照版本developers.openai.com ↗2026-05-28已核实
训练数据截止——单一来源
输入模态openai.com ↗2026-05-28已核实
输出模态openai.com ↗2026-05-28已核实
结构化输出platform.openai.com ↗2026-05-28已核实
最大输出 tokendevelopers.openai.com ↗2026-05-28已核实
部署平台openai.com ↗2026-05-28已核实
许可——已核实
MMLUopenai.com ↗2026-05-28已核实
HumanEvalopenai.com ↗2026-05-28已核实
MMMUopenai.com ↗2026-05-28已核实
MATHopenai.com ↗2026-05-28已核实
GSM8Kopenai.com ↗2026-05-28已核实
GPT-4o 从 ChatGPT 退役openai.com ↗2026-05-28已核实
GPT-4.1 发布:GPT-4o 的直接继任者openai.com ↗2026-05-28已核实
GPT-4o 2024 年 11 月快照发布openai.com ↗2026-05-28已核实
GPT-4o 在 API 中是否仍可用?openai.com ↗2026-05-28待核实
GPT-4o 和 GPT-4o Mini 有什么区别?openai.com ↗2026-05-28待核实
GPT-4o 可以处理音频输入吗?openai.com ↗2026-05-28待核实
GPT-4o 是推理模型吗?openai.com ↗2026-05-28待核实
帮助与联系