返回模型列表

GPT-4o Mini

openaiopenai/gpt-4o-mini

Fast, affordable small model for focused tasks. Accepts text and image inputs, produces text outputs. Ideal for fine-tuning and cost-efficient workloads.

GPT-4o Mini 是 OpenAI 最具性价比的小型模型,于 2024 年 7 月 18 日发布。作为 GPT-3.5 Turbo 的直接替代者,它在聊天偏好上达到了 GPT-4 级别的表现,而价格不到后者的一半——每百万输入 token 仅 $0.15,每百万输出 token 仅 $0.60。它是 2024 年重塑 API 定价格局的成本效率浪潮的奠基模型,至今仍是生产环境中部署最广泛的小型号之一,广泛应用于结构化数据提取、对话智能体、分类和高吞吐批量处理等场景。

GPT-4o Mini 引入了 OpenAI 的指令层级(Instruction Hierarchy)技术——一种优先执行系统提示指令而非用户消息的方法,使其成为首款在模型级别内建抗提示注入、越狱和系统提示提取防护能力的 API 模型。对于 TheRouter 的操作者而言,它是成本敏感型生产管线的默认「基础」模型:擅长并行调用链式组合、通过 128K 上下文窗口处理长对话历史,且无需特殊路由配置。其后继版本 GPT-4.1 Mini(2025 年 4 月)在编码和指令跟随上有所提升,但 GPT-4o Mini 仍然是 GPT-4o 家族中最经得起实战检验、行为最可预测的高吞吐部署选择。

适合使用
  • • 高容量客服聊天机器人 — GPT-4o Mini 的低延迟和每轮不到一美分的成本使其成为处理数百万日交互量的实时对话智能体的理想选择
  • • 文档结构化数据提取 — 合作伙伴 Ramp 发现 GPT-4o Mini 在从收据和发票中提取结构化数据方面显著优于 GPT-3.5 Turbo
  • • 长上下文分类与摘要 — 128K 上下文窗口可处理完整代码库、长对话线程或文档集合,适用于批量分类和摘要管线
  • • 多步推理链式管线 — 串联多个 GPT-4o Mini 实例执行任务分解,成本仅为大模型的几分之一
  • • Batch API 批量作业 — GPT-4o Mini 的 50% 批量折扣(每百万 token $0.075/$0.30)使其成为 OpenAI 平台上非实时工作负载中最便宜的文本生成模型
不适合使用
  • • 复杂多步 Agent 编码 — GPT-4o Mini 不具备自主软件工程所需的推理深度;请将重代码的 agent 工作路由至 o4-mini、GPT-4.1 或 GPT-5
  • • 前沿级别的数学与科学推理 — 基准测试显示 o4-mini 和 GPT-5 系列在 MMLU-Pro、GPQA 和高等数学任务上明显优于 GPT-4o Mini
  • • 音频或视频处理 — GPT-4o Mini 仅支持文本和图像输入;音频请路由至 TheRouter 上的 gpt-4o-mini-audio-preview 或 gpt-4o-mini-realtime-preview 变体
上下文长度
128K
最大输出
16K
输入价格每百万 tokens
$0.162每百万 Tokens
输出价格每百万 tokens
$0.648每百万 Tokens

模态能力

文本图像→文本

能力

视觉理解

价格明细

类型费率
输入$0.162 每百万 Tokens
输出$0.648 每百万 Tokens

支持参数

temperaturemax_tokenstop_ptoolstool_choiceresponse_formatstop

模型规格

发布日期2024 年 7 月 18 日openai.com ↗已核实
知识截止日期2023 年 10 月openai.com ↗已核实
最大输出 token16,384 tokensopenai.com ↗已核实
输入模态文本、图像(视觉)openai.com ↗已核实
输出模态文本openai.com ↗已核实
许可协议专有许可(仅 API)已核实
安全技术指令层级(Instruction Hierarchy)— 首个应用系统提示优先越狱防御的模型openai.com ↗已核实

基准成绩

BenchmarkDistributionScoreSource
MMLU
文本智能与推理基准 — 对比 Gemini Flash 77.9% 和 Claude Haiku 73.8%
82.0%%openai.com ↗
MGSM
多语言小学数学推理 — 对比 Gemini Flash 75.5% 和 Claude Haiku 71.7%
87.0%%openai.com ↗
HumanEval
Python 编码基准 — 对比 Gemini Flash 71.5% 和 Claude Haiku 75.9%
87.2%%openai.com ↗
MMMU
多模态推理评估 — 对比 Gemini Flash 56.1% 和 Claude Haiku 50.2%
59.4%%openai.com ↗
LMSYS Chatbot Arena
发布时在 LMSYS 榜单的聊天偏好上超越 GPT-4(2024 年 7 月)
Arena ELO — outranks GPT-4 at launchopenai.com ↗

API 使用示例

所有新集成都应使用下方示例中的全球端点 api.therouter.ai;旧中国加速端点已下线。

cURL
curl https://api.therouter.ai/v1/chat/completions   -H "Content-Type: application/json"   -H "Authorization: Bearer $THE_ROUTER_API_KEY"   -d '{
    "model": "openai/gpt-4o-mini",
    "messages": [
      {"role": "user", "content": "Summarize the key points from this input."}
    ]
  }'

API 使用指南

完整 API 参考 →

Chat 调用

GPT-4o Mini 支持标准 chat completion,可选视觉/图像输入、工具调用、JSON 模式和流式输出。直接使用您已有的 OpenAI SDK — 只需更换模型名和 base URL。

cURL
curl https://api.therouter.ai/v1/chat/completions \
  -H "Authorization: Bearer $THEROUTER_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "openai/gpt-4o-mini",
    "messages": [
      {"role": "system", "content": "You are a helpful assistant."},
      {"role": "user", "content": "Extract the date, vendor name, and total from this receipt in JSON."}
    ],
    "response_format": {"type": "json_object"}
  }'

openai 其他模型

同类模型

跨供应商的相似能力档位

动态与变更

2025-04-14

GPT-4.1、GPT-4.1 Mini 和 GPT-4.1 Nano 在 API 中发布

OpenAI 发布了 GPT-4.1 Mini 和 GPT-4.1 Nano,分别是 GPT-4o Mini 和 GPT-4o Nano 的直接后继版本。GPT-4.1 Mini 在所有主要编码和指令跟随基准上全面超越 GPT-4o Mini。GPT-4o Mini 仍可继续使用,在不需要 4.1 Mini 额外能力时仍然是最具成本效益的选择。

TheRouter 编辑重写openai.com ↗
2024-07-18

GPT-4o Mini 发布 — 替代 GPT-3.5 Turbo

OpenAI 发布了最具性价比的小型模型 GPT-4o Mini,定价每百万 token $0.15/$0.60,支持 128K 上下文、视觉输入和指令层级安全技术。发布时在聊天偏好上超越 GPT-4。

TheRouter 编辑重写openai.com ↗

常见问题

GPT-4.1 Mini 发布后,GPT-4o Mini 还能继续使用吗?

仍然支持。GPT-4o Mini 在 OpenAI API 和 TheRouter 上保持完全可用。当您不需要 GPT-4.1 Mini 增强的编码和指令跟随能力时,它仍然是最具成本效益的选择。OpenAI 尚未公布 GPT-4o Mini 的废弃日期。

TheRouter 编辑重写openai.com ↗
GPT-4o Mini 是否支持函数/工具调用?

支持。GPT-4o Mini 通过 Chat Completions API 支持工具调用、tool_choice 和 response_format。OpenAI 发布时展示其函数调用表现优异,合作伙伴 Ramp 将其用于收据的结构化数据提取。

TheRouter 编辑重写openai.com ↗
GPT-4o Mini 的知识截止日期是什么时候?

GPT-4o Mini 的知识截止日期为 2023 年 10 月,由 OpenAI 在发布时正式公布。

能否对 GPT-4o Mini 进行微调?

可以。OpenAI 在 API 首次发布后不久就宣布了对 GPT-4o Mini 的微调支持。微调后的版本也可通过 TheRouter 访问。请查看 OpenAI 的微调文档和 TheRouter 模型列表确认可用性。

TheRouter 编辑重写
GPT-4o Mini 比之前的小模型更安全体现在哪些方面?

GPT-4o Mini 是首个应用 OpenAI 指令层级(Instruction Hierarchy)技术的 API 模型,该技术优先执行系统提示指令而非用户消息。这使得它在抵抗越狱、提示注入和系统提示提取方面具有天然优势。此外,它还经历了与 GPT-4o 相同框架的 Preparedness 评估。

TheRouter 编辑重写openai.com ↗
事实档案 — 本页每条断言可在此回溯来源
来源URL采集于
发布日期openai.com ↗2026-05-28已核实
知识截止日期openai.com ↗2026-05-28已核实
最大输出 tokenopenai.com ↗2026-05-28已核实
输入模态openai.com ↗2026-05-28已核实
输出模态openai.com ↗2026-05-28已核实
许可协议——已核实
安全技术openai.com ↗2026-05-28已核实
MMLUopenai.com ↗2026-05-28已核实
MGSMopenai.com ↗2026-05-28已核实
HumanEvalopenai.com ↗2026-05-28已核实
MMMUopenai.com ↗2026-05-28已核实
LMSYS Chatbot Arenaopenai.com ↗2026-05-28已核实
GPT-4.1、GPT-4.1 Mini 和 GPT-4.1 Nano 在 API 中发布openai.com ↗2026-05-28已核实
GPT-4o Mini 发布 — 替代 GPT-3.5 Turboopenai.com ↗2026-05-28已核实
GPT-4.1 Mini 发布后,GPT-4o Mini 还能继续使用吗?openai.com ↗2026-05-28待核实
GPT-4o Mini 是否支持函数/工具调用?openai.com ↗2026-05-28待核实
GPT-4o Mini 的知识截止日期是什么时候?openai.com ↗2026-05-28待核实
GPT-4o Mini 比之前的小模型更安全体现在哪些方面?openai.com ↗2026-05-28待核实
帮助与联系