返回模型列表

GPT-4.1 Nano

openaiopenai/gpt-4.1-nano

Fastest, most cost-efficient version of GPT-4.1. Excels at instruction following and tool calling with a 1M token context window and minimal latency.

GPT-4.1 Nano 是 OpenAI 最快且最具成本效益的模型,于 2025 年 4 月与 GPT-4.1 及 GPT-4.1 Mini 同期发布。作为 GPT-4.1 系列中最小的成员,它专为延迟和单 token 成本至关重要的场景而设计——分类、自动补全、实体提取以及高吞吐量数据管线——同时仍支持 100 万 token 上下文窗口和图像输入。

尽管体积紧凑,GPT-4.1 Nano 在 MMLU 上得分 80.1%、GPQA 上 50.3%、Aider 多语言编码基准上 9.8%——在每项指标上均超越 GPT-4o Mini。对于路由运营方来说,当你需要一个能力尚可、成本绝对最低的指令执行模型时,尤其是在每一步都必须快且廉价的代理循环中,GPT-4.1 Nano 是首选。

适合使用
  • • 需要低于 200ms 延迟的实时分类和意图路由
  • • IDE 或搜索框中的大规模自动补全和内联建议
  • • 利用 100 万 token 上下文窗口从文档中提取结构化数据和识别实体
  • • 每步都需快速且低成本的高频代理循环——如工具选择路由、日志分类、工单标记
不适合使用
  • • 复杂多步推理或高难度数学——请使用 o3、o4-mini 或 GPT-5
  • • 需要细腻风格和个性化的创意长文写作——GPT-4.1 或 GPT-5 更合适
  • • 视觉密集型多模态分析——GPT-4.1 或 GPT-5 的图像理解能力显著更强
  • • 大规模代码生成或代理式编码任务——GPT-4.1 Mini 在这类场景下性价比更高
上下文长度
1.0M
最大输出
33K
输入价格每百万 tokens
$0.108每百万 Tokens
输出价格每百万 tokens
$0.432每百万 Tokens

模态能力

文本图像→文本

能力

视觉理解

价格明细

类型费率
输入$0.108 每百万 Tokens
输出$0.432 每百万 Tokens

支持参数

temperaturemax_tokenstop_ptoolstool_choiceresponse_formatstop

模型规格

发布日期2025-04-14openai.com ↗已核实
知识截止日期2024 年 6 月openai.com ↗已核实
训练数据截止2024 年 6 月openai.com ↗已核实
许可专有 — 仅通过 OpenAI API 使用openai.com ↗已核实
系列定位GPT-4.1 系列中最小最快(Nano < Mini < 4.1)openai.com ↗已核实

基准成绩

BenchmarkDistributionScoreSource
MMLU
GPT-4.1 发布公告中报告的数据;高于 GPT-4o Mini
80.1%%openai.com ↗
GPQA
研究生级问答基准;在 nano 级模型中表现突出
50.3%%openai.com ↗
Aider Polyglot
多语言编码基准;高于 GPT-4o Mini
9.8%%openai.com ↗

API 使用示例

所有新集成都应使用下方示例中的全球端点 api.therouter.ai;旧中国加速端点已下线。

cURL
curl https://api.therouter.ai/v1/chat/completions   -H "Content-Type: application/json"   -H "Authorization: Bearer $THE_ROUTER_API_KEY"   -d '{
    "model": "openai/gpt-4.1-nano",
    "messages": [
      {"role": "user", "content": "Summarize the key points from this input."}
    ]
  }'

API 使用指南

完整 API 参考 →

Chat 调用

cURL
curl https://api.therouter.ai/v1/chat/completions \
  -H "Authorization: Bearer $THEROUTER_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{"model":"openai/gpt-4.1-nano","messages":[{"role":"user","content":"Hello"}]}'

openai 其他模型

同类模型

跨供应商的相似能力档位

动态与变更

2025-04-14

GPT-4.1 系列发布,首次推出 Nano 模型

OpenAI 发布 GPT-4.1、GPT-4.1 Mini 和 GPT-4.1 Nano,均支持 100 万 token 上下文。Nano 是 OpenAI 首个明确面向超低延迟、超低成本级别的模型——MMLU 80.1%,编码基准超越 GPT-4o Mini,在 API 延迟曲线上定位为最快模型。

TheRouter 编辑重写openai.com ↗

常见问题

GPT-4.1 Nano 与 GPT-4o Mini 相比如何?

GPT-4.1 Nano 在 MMLU(80.1%)、GPQA(50.3%)和 Aider 多语言编码(9.8%)上均超越 GPT-4o Mini,同时支持 100 万 token 上下文(GPT-4o Mini 为 128K),且单 token 成本更低。它被定位为最低成本 API 层级中替代 GPT-4o Mini 的模型。

GPT-4.1 Nano 最适合用于什么?

OpenAI 建议将 GPT-4.1 Nano 用于延迟优先的任务——分类、自动补全、实体提取和高吞吐量数据管线。它也非常适合作为代理系统中快速路由步骤:用 Nano 分类意图或选择工具,再将复杂任务路由给 GPT-4.1 或 o3。

GPT-4.1 Nano 能处理视觉任务吗?

可以——GPT-4.1 Nano 支持图像输入,适合低成本、高吞吐量的图像分类或 OCR 预处理。如需精细的图像理解或复杂视觉推理,GPT-4.1 或 GPT-5 效果更好。

如何通过 TheRouter 调用 GPT-4.1 Nano?

使用标准 OpenAI SDK,将 baseURL 设为 https://api.therouter.ai/v1,model 设为 "openai/gpt-4.1-nano"。TheRouter 完全兼容 OpenAI——除了 base URL 和模型名称外无需更改 SDK。请参阅上方 API 指南部分获取 curl、TypeScript 和 Python 示例。

事实档案 — 本页每条断言可在此回溯来源
来源URL采集于
发布日期openai.com ↗2026-05-28已核实
知识截止日期openai.com ↗2026-05-28已核实
训练数据截止openai.com ↗2026-05-28已核实
许可openai.com ↗2026-05-28已核实
系列定位openai.com ↗2026-05-28已核实
MMLUopenai.com ↗2026-05-28已核实
GPQAopenai.com ↗2026-05-28已核实
Aider Polyglotopenai.com ↗2026-05-28已核实
GPT-4.1 系列发布,首次推出 Nano 模型openai.com ↗2026-05-28已核实
GPT-4.1 Nano 与 GPT-4o Mini 相比如何?openai.com ↗2026-05-28待核实
GPT-4.1 Nano 最适合用于什么?openai.com ↗2026-05-28待核实
帮助与联系