GPT OSS 120B
OpenAI's open-source 120B model with hybrid reasoning, extended thinking, efficient code generation, agentic search, computer use, and tool use capabilities.
GPT OSS 120B 是 OpenAI 自 GPT-2 以来首个开源权重的语言模型,于 2025 年 8 月以 Apache 2.0 许可证发布。它是一款 1170 亿参数的混合专家(MoE)Transformer 模型,每次前向传播仅激活 51 亿参数,可在单张 80GB GPU(NVIDIA H100 或 AMD MI300X)上部署。该模型采用了与 OpenAI o 系列推理模型相同的思维链强化学习技术进行后训练,支持可配置的推理努力级别(低/中/高)、完整 CoT 可见性、工具调用和结构化输出。
在生产环境中,GPT OSS 120B 是高推理强度、需要自主托管的 Agent 场景的有力候选——例如企业内部部署、敏感数据处理或政府机构使用。它在核心推理基准上接近 OpenAI o4-mini 的水平,同时在几乎所有评估中超越 o3-mini。该模型可通过 OpenAI Responses API 调用,也可通过 TheRouter 的路由基础设施使用,让那些希望享受托管 API 体验但保留开源选项的用户灵活选择。
- • 高推理强度自主部署——在单张 H100 或 MI300X 上本地部署,完全掌控数据主权。
- • Agent 工具调用工作流——函数调用、网页搜索集成、Agent 循环中的 Python 代码执行。
- • 竞赛编程与数学——Codeforces 等级分约 2620,AIME 2024 带工具正确率 96.6%。
- • 医疗健康推理——在 HealthBench 上接近 o3,超越 o1、o4-mini 和 GPT-4o。
- • 针对特定领域微调——Apache 2.0 许可证允许无限制定制。
- • 延迟敏感的实时应用——高推理模式会产生很长的 CoT 痕迹;建议使用 gpt-oss-20b 的 low 推理模式。
- • 多模态任务——这是一个纯文本模型。视觉或音频任务请通过 TheRouter 使用 GPT-4o 或 GPT-4o-mini。
- • 边缘或移动设备部署——60.8 GiB 的检查点太大;建议使用 gpt-oss-20b (12.8 GiB)。
模态能力
价格明细
| 类型 | 费率 |
|---|---|
| 输入 | $0.162 每百万 Tokens |
| 输出 | $0.648 每百万 Tokens |
支持参数
模型规格
| 发布日期 | 2025-08-05openai.com ↗ | 已核实 |
| 架构 | MoE Transformer — 36 层,128 个专家,Top-4 激活,1168 亿总 / 51 亿活跃参数arxiv.org ↗ | 已核实 |
| 许可 | Apache 2.0openai.com ↗ | 已核实 |
| 知识截止日期 | 2024 年 6 月arxiv.org ↗ | 已核实 |
| 分词器 | o200k_harmony (201,088 个词元)arxiv.org ↗ | 已核实 |
| 量化 | MXFP4 (MoE 权重 4.25 bits/参数)arxiv.org ↗ | 已核实 |
| 检查点大小 | 60.8 GiBarxiv.org ↗ | 已核实 |
| 训练算力 | 210 万 H100 小时arxiv.org ↗ | 已核实 |
| 推理模式 | 低 / 中 / 高(系统提示词中配置)openai.com ↗ | 已核实 |
基准成绩
| Benchmark | Distribution | Score | Source |
|---|---|---|---|
MMLU 高推理模式 | 90.0%% | arxiv.org ↗ | |
AIME 2024 含工具,高推理模式 | 96.6%% | arxiv.org ↗ | |
AIME 2025 含工具,高推理模式 | 97.9%% | arxiv.org ↗ | |
Codeforces Elo 估计 Elo 等级分;高推理模式含终端工具 | ~2620 | openai.com ↗ | |
SWE-Bench Verified 高推理模式 | 62.4%% | arxiv.org ↗ | |
GPQA Diamond 含工具,高推理模式 | 80.9%% | arxiv.org ↗ | |
HLE 含工具,高推理模式。HLE 是难度极高的基准。 | 19.0%% | arxiv.org ↗ | |
HealthBench 高推理模式。接近 o3,超越 o1、GPT-4o、o3-mini 和 o4-mini。 | 57.6%% | arxiv.org ↗ | |
HealthBench Hard 高推理模式,HealthBench 的困难子集 | 30.0%% | arxiv.org ↗ | |
Tau-Bench Retail 高推理模式——Agent 函数调用评估 | 67.8%% | arxiv.org ↗ | |
MMMLU (Average) 14 语言平均,高推理模式 | 81.3%% | arxiv.org ↗ |
API 使用示例
所有新集成都应使用下方示例中的全球端点 api.therouter.ai;旧中国加速端点已下线。
curl https://api.therouter.ai/v1/chat/completions -H "Content-Type: application/json" -H "Authorization: Bearer $THE_ROUTER_API_KEY" -d '{
"model": "openai/gpt-oss-120b",
"messages": [
{"role": "user", "content": "Summarize the key points from this input."}
]
}'API 使用指南
完整 API 参考 →Chat 调用
通过 TheRouter 使用标准 OpenAI 兼容的 chat completion。模型使用 harmony 聊天格式;TheRouter 会自动转换。
curl https://api.therouter.ai/v1/chat/completions \
-H "Authorization: Bearer $THEROUTER_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "openai/gpt-oss-120b",
"messages": [
{"role": "user", "content": "Explain the benefits of Mixture-of-Experts architecture in large language models."}
]
}'openai 其他模型
同类模型
跨供应商的相似能力档位常见问题
我能否通过 TheRouter 的 API 使用 GPT OSS 120B,而无需自行托管?
可以。TheRouter 通过托管基础设施路由 gpt-oss-120b 的请求。你可以通过 https://api.therouter.ai/v1 的标准 OpenAI 兼容 API 使用这个开源权重模型,无需管理自己的 GPU 硬件。
GPT OSS 120B 使用什么许可证?
Apache 2.0——一种宽松的许可证,允许商业使用、修改、分发和再许可,没有 Copyleft 限制或专利风险。
GPT OSS 120B 与 GPT-4o 相比如何?
GPT OSS 120B 是专注于推理的开源权重模型,在数学(AIME)、编程(Codeforces)和健康(HealthBench)基准上超越 GPT-4o。但 GPT-4o 是多模态模型(视觉、音频),而 GPT OSS 120B 纯文本。多模态任务请通过 TheRouter 使用 GPT-4o 或 GPT-4o-mini。
自行托管 GPT OSS 120B 需要什么硬件?
单张 80GB GPU,如 NVIDIA H100 或 AMD MI300X。量化后的检查点为 60.8 GiB。通过 MXFP4 量化和 MoE 架构,每次前向传播仅激活 51 亿参数,可在消费级 GPU 上进行高效推理。
事实档案 — 本页每条断言可在此回溯来源
| 来源 | URL | 采集于 | |
|---|---|---|---|
| 发布日期 | openai.com ↗ | 2026-05-29 | 已核实 |
| 架构 | arxiv.org ↗ | 2026-05-29 | 已核实 |
| 许可 | openai.com ↗ | 2026-05-29 | 已核实 |
| 知识截止日期 | arxiv.org ↗ | 2026-05-29 | 已核实 |
| 分词器 | arxiv.org ↗ | 2026-05-29 | 已核实 |
| 量化 | arxiv.org ↗ | 2026-05-29 | 已核实 |
| 检查点大小 | arxiv.org ↗ | 2026-05-29 | 已核实 |
| 训练算力 | arxiv.org ↗ | 2026-05-29 | 已核实 |
| 推理模式 | openai.com ↗ | 2026-05-29 | 已核实 |
| MMLU | arxiv.org ↗ | 2026-05-29 | 已核实 |
| AIME 2024 | arxiv.org ↗ | 2026-05-29 | 已核实 |
| AIME 2025 | arxiv.org ↗ | 2026-05-29 | 已核实 |
| Codeforces Elo | openai.com ↗ | 2026-05-29 | 待核实 |
| SWE-Bench Verified | arxiv.org ↗ | 2026-05-29 | 已核实 |
| GPQA Diamond | arxiv.org ↗ | 2026-05-29 | 已核实 |
| HLE | arxiv.org ↗ | 2026-05-29 | 已核实 |
| HealthBench | arxiv.org ↗ | 2026-05-29 | 已核实 |
| HealthBench Hard | arxiv.org ↗ | 2026-05-29 | 已核实 |
| Tau-Bench Retail | arxiv.org ↗ | 2026-05-29 | 已核实 |
| MMMLU (Average) | arxiv.org ↗ | 2026-05-29 | 已核实 |
| 我能否通过 TheRouter 的 API 使用 GPT OSS 120B,而无需自行托管? | openai.com ↗ | 2026-05-29 | 待核实 |
| GPT OSS 120B 使用什么许可证? | openai.com ↗ | 2026-05-29 | 待核实 |
| GPT OSS 120B 与 GPT-4o 相比如何? | arxiv.org ↗ | 2026-05-29 | 待核实 |
| 自行托管 GPT OSS 120B 需要什么硬件? | github.com ↗ | 2026-05-29 | 待核实 |