返回模型列表

GPT OSS 120B

openaiopenai/gpt-oss-120b

OpenAI's open-source 120B model with hybrid reasoning, extended thinking, efficient code generation, agentic search, computer use, and tool use capabilities.

GPT OSS 120B 是 OpenAI 自 GPT-2 以来首个开源权重的语言模型,于 2025 年 8 月以 Apache 2.0 许可证发布。它是一款 1170 亿参数的混合专家(MoE)Transformer 模型,每次前向传播仅激活 51 亿参数,可在单张 80GB GPU(NVIDIA H100 或 AMD MI300X)上部署。该模型采用了与 OpenAI o 系列推理模型相同的思维链强化学习技术进行后训练,支持可配置的推理努力级别(低/中/高)、完整 CoT 可见性、工具调用和结构化输出。

在生产环境中,GPT OSS 120B 是高推理强度、需要自主托管的 Agent 场景的有力候选——例如企业内部部署、敏感数据处理或政府机构使用。它在核心推理基准上接近 OpenAI o4-mini 的水平,同时在几乎所有评估中超越 o3-mini。该模型可通过 OpenAI Responses API 调用,也可通过 TheRouter 的路由基础设施使用,让那些希望享受托管 API 体验但保留开源选项的用户灵活选择。

适合使用
  • • 高推理强度自主部署——在单张 H100 或 MI300X 上本地部署,完全掌控数据主权。
  • • Agent 工具调用工作流——函数调用、网页搜索集成、Agent 循环中的 Python 代码执行。
  • • 竞赛编程与数学——Codeforces 等级分约 2620,AIME 2024 带工具正确率 96.6%。
  • • 医疗健康推理——在 HealthBench 上接近 o3,超越 o1、o4-mini 和 GPT-4o。
  • • 针对特定领域微调——Apache 2.0 许可证允许无限制定制。
不适合使用
  • • 延迟敏感的实时应用——高推理模式会产生很长的 CoT 痕迹;建议使用 gpt-oss-20b 的 low 推理模式。
  • • 多模态任务——这是一个纯文本模型。视觉或音频任务请通过 TheRouter 使用 GPT-4o 或 GPT-4o-mini。
  • • 边缘或移动设备部署——60.8 GiB 的检查点太大;建议使用 gpt-oss-20b (12.8 GiB)。
上下文长度
128K
最大输出
16K
输入价格每百万 tokens
$0.162每百万 Tokens
输出价格每百万 tokens
$0.648每百万 Tokens

模态能力

文本→文本

价格明细

类型费率
输入$0.162 每百万 Tokens
输出$0.648 每百万 Tokens

支持参数

temperaturemax_tokenstop_ptoolstool_choiceresponse_formatreasoningstop

模型规格

发布日期2025-08-05openai.com ↗已核实
架构MoE Transformer — 36 层,128 个专家,Top-4 激活,1168 亿总 / 51 亿活跃参数arxiv.org ↗已核实
许可Apache 2.0openai.com ↗已核实
知识截止日期2024 年 6 月arxiv.org ↗已核实
分词器o200k_harmony (201,088 个词元)arxiv.org ↗已核实
量化MXFP4 (MoE 权重 4.25 bits/参数)arxiv.org ↗已核实
检查点大小60.8 GiBarxiv.org ↗已核实
训练算力210 万 H100 小时arxiv.org ↗已核实
推理模式低 / 中 / 高(系统提示词中配置)openai.com ↗已核实

基准成绩

BenchmarkDistributionScoreSource
MMLU
高推理模式
90.0%%arxiv.org ↗
AIME 2024
含工具,高推理模式
96.6%%arxiv.org ↗
AIME 2025
含工具,高推理模式
97.9%%arxiv.org ↗
Codeforces Elo
估计 Elo 等级分;高推理模式含终端工具
~2620openai.com ↗
SWE-Bench Verified
高推理模式
62.4%%arxiv.org ↗
GPQA Diamond
含工具,高推理模式
80.9%%arxiv.org ↗
HLE
含工具,高推理模式。HLE 是难度极高的基准。
19.0%%arxiv.org ↗
HealthBench
高推理模式。接近 o3,超越 o1、GPT-4o、o3-mini 和 o4-mini。
57.6%%arxiv.org ↗
HealthBench Hard
高推理模式,HealthBench 的困难子集
30.0%%arxiv.org ↗
Tau-Bench Retail
高推理模式——Agent 函数调用评估
67.8%%arxiv.org ↗
MMMLU (Average)
14 语言平均,高推理模式
81.3%%arxiv.org ↗

API 使用示例

所有新集成都应使用下方示例中的全球端点 api.therouter.ai;旧中国加速端点已下线。

cURL
curl https://api.therouter.ai/v1/chat/completions   -H "Content-Type: application/json"   -H "Authorization: Bearer $THE_ROUTER_API_KEY"   -d '{
    "model": "openai/gpt-oss-120b",
    "messages": [
      {"role": "user", "content": "Summarize the key points from this input."}
    ]
  }'

API 使用指南

完整 API 参考 →

Chat 调用

通过 TheRouter 使用标准 OpenAI 兼容的 chat completion。模型使用 harmony 聊天格式;TheRouter 会自动转换。

cURL
curl https://api.therouter.ai/v1/chat/completions \
  -H "Authorization: Bearer $THEROUTER_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "openai/gpt-oss-120b",
    "messages": [
      {"role": "user", "content": "Explain the benefits of Mixture-of-Experts architecture in large language models."}
    ]
  }'

openai 其他模型

同类模型

跨供应商的相似能力档位

常见问题

我能否通过 TheRouter 的 API 使用 GPT OSS 120B,而无需自行托管?

可以。TheRouter 通过托管基础设施路由 gpt-oss-120b 的请求。你可以通过 https://api.therouter.ai/v1 的标准 OpenAI 兼容 API 使用这个开源权重模型,无需管理自己的 GPU 硬件。

TheRouter 编辑重写openai.com ↗
GPT OSS 120B 使用什么许可证?

Apache 2.0——一种宽松的许可证,允许商业使用、修改、分发和再许可,没有 Copyleft 限制或专利风险。

TheRouter 编辑重写openai.com ↗
GPT OSS 120B 与 GPT-4o 相比如何?

GPT OSS 120B 是专注于推理的开源权重模型,在数学(AIME)、编程(Codeforces)和健康(HealthBench)基准上超越 GPT-4o。但 GPT-4o 是多模态模型(视觉、音频),而 GPT OSS 120B 纯文本。多模态任务请通过 TheRouter 使用 GPT-4o 或 GPT-4o-mini。

TheRouter 编辑重写arxiv.org ↗
自行托管 GPT OSS 120B 需要什么硬件?

单张 80GB GPU,如 NVIDIA H100 或 AMD MI300X。量化后的检查点为 60.8 GiB。通过 MXFP4 量化和 MoE 架构,每次前向传播仅激活 51 亿参数,可在消费级 GPU 上进行高效推理。

TheRouter 编辑重写github.com ↗
事实档案 — 本页每条断言可在此回溯来源
来源URL采集于
发布日期openai.com ↗2026-05-29已核实
架构arxiv.org ↗2026-05-29已核实
许可openai.com ↗2026-05-29已核实
知识截止日期arxiv.org ↗2026-05-29已核实
分词器arxiv.org ↗2026-05-29已核实
量化arxiv.org ↗2026-05-29已核实
检查点大小arxiv.org ↗2026-05-29已核实
训练算力arxiv.org ↗2026-05-29已核实
推理模式openai.com ↗2026-05-29已核实
MMLUarxiv.org ↗2026-05-29已核实
AIME 2024arxiv.org ↗2026-05-29已核实
AIME 2025arxiv.org ↗2026-05-29已核实
Codeforces Eloopenai.com ↗2026-05-29待核实
SWE-Bench Verifiedarxiv.org ↗2026-05-29已核实
GPQA Diamondarxiv.org ↗2026-05-29已核实
HLEarxiv.org ↗2026-05-29已核实
HealthBencharxiv.org ↗2026-05-29已核实
HealthBench Hardarxiv.org ↗2026-05-29已核实
Tau-Bench Retailarxiv.org ↗2026-05-29已核实
MMMLU (Average)arxiv.org ↗2026-05-29已核实
我能否通过 TheRouter 的 API 使用 GPT OSS 120B,而无需自行托管?openai.com ↗2026-05-29待核实
GPT OSS 120B 使用什么许可证?openai.com ↗2026-05-29待核实
GPT OSS 120B 与 GPT-4o 相比如何?arxiv.org ↗2026-05-29待核实
自行托管 GPT OSS 120B 需要什么硬件?github.com ↗2026-05-29待核实
帮助与联系