GPT OSS 20B
OpenAI's open-source 20B model with hybrid reasoning, extended thinking, efficient code generation, agentic search, and tool use. Cost-effective alternative to the 120B variant.
GPT OSS 20B 是 OpenAI 自 GPT-2 以来首个开源权重语言模型家族中的较小版本,于 2025 年 8 月以 Apache 2.0 许可证发布。它是一款 210 亿参数的混合专家(MoE)Transformer 模型,每次前向传播仅激活 36 亿参数,可在低至 16GB 内存的设备上部署——包括边缘硬件和消费级笔记本。尽管体积紧凑,它采用了与 120B 版本相同的思维链强化学习流水线进行后训练,支持可配置的推理努力级别(低/中/高)、完整 CoT 可见性、工具调用和结构化输出。
在生产环境中,GPT OSS 20B 非常适合边缘场景、设备端 AI 和 GPU 预算有限或延迟要求最低的快速迭代工作流。它在大多数基准上匹配或超越 OpenAI o3-mini,在竞赛数学和健康推理方面甚至常常优于 o3-mini——对于一个 210 亿总 / 36 亿活跃参数的模型来说非常出色。通过 TheRouter,您可以通过托管式 OpenAI 兼容 API 访问它而无需自行托管;另外,Apache 2.0 许可证允许您完全在自己的基础设施上下载、微调和部署。
- • 边缘和本地推理——可在 16GB 设备上运行,包括笔记本、边缘服务器和单板计算机。
- • 成本敏感的 Agent 工作流——以远低于大型前沿模型的成本使用工具调用、函数调用和 Agent 循环。
- • 快速原型设计和迭代——低推理强度下的快速 CoT,适合在扩展前调试提示词和 Agent 编排。
- • 设备端定制——Apache 2.0 许可证允许无限制的微调和商业部署。
- • 一次成型的高复杂度推理——需要持续深度推理的任务(如高难度 HLE 问题),建议使用 gpt-oss-120b 的高推理模式。
- • 多模态任务——这是一个纯文本模型。视觉或音频任务请通过 TheRouter 使用 GPT-4o 或 GPT-4o-mini。
- • 延迟关键的高吞吐量 API——中/高推理模式仍会产生 CoT 痕迹;为追求最低延迟,可通过 TheRouter 将低推理强度与 Mistral Small 4 或 GPT-4.1 Nano 配合使用。
模态能力
价格明细
| 类型 | 费率 |
|---|---|
| 输入 | $0.0756 每百万 Tokens |
| 输出 | $0.324 每百万 Tokens |
支持参数
模型规格
| 发布日期 | 2025-08-05openai.com ↗ | 已核实 |
| 架构 | MoE Transformer — 24 层,32 个专家,Top-4 激活,210 亿总 / 36 亿活跃参数openai.com ↗ | 已核实 |
| 许可 | Apache 2.0openai.com ↗ | 已核实 |
| 知识截止日期 | 2024 年 6 月arxiv.org ↗ | 已核实 |
| 分词器 | o200k_harmony (201,088 个词元)arxiv.org ↗ | 已核实 |
| 最低内存 | 16 GB(消费级边缘设备部署)openai.com ↗ | 已核实 |
| 量化 | MXFP4 (MoE 权重 4.25 bits/参数)arxiv.org ↗ | 已核实 |
| 检查点大小 | 12.8 GiBhuggingface.co ↗ | 已核实 |
| 推理模式 | 低 / 中 / 高(系统提示词中配置)openai.com ↗ | 已核实 |
基准成绩
| Benchmark | Distribution | Score | Source |
|---|---|---|---|
MMLU 高推理模式 | 85.3%% | arxiv.org ↗ | |
AIME 2024 含工具,高推理模式 | 96.0%% | arxiv.org ↗ | |
AIME 2025 含工具,高推理模式 | 98.7%% | arxiv.org ↗ | |
Codeforces Elo 估计 Elo 等级分;高推理模式含终端工具 | ~2516 | openai.com ↗ | |
SWE-Bench Verified 高推理模式 | 60.7%% | arxiv.org ↗ | |
GPQA Diamond 含工具,高推理模式 | 71.5%% | arxiv.org ↗ | |
HLE 含工具,高推理模式。HLE 是难度极高的基准。 | 17.3%% | arxiv.org ↗ | |
HealthBench 高推理模式。尽管体积较小,在健康推理方面仍优于 o3-mini。 | 42.5%% | arxiv.org ↗ | |
Tau-Bench Retail 高推理模式——Agent 函数调用评估 | 54.8%% | arxiv.org ↗ |
API 使用示例
所有新集成都应使用下方示例中的全球端点 api.therouter.ai;旧中国加速端点已下线。
curl https://api.therouter.ai/v1/chat/completions -H "Content-Type: application/json" -H "Authorization: Bearer $THE_ROUTER_API_KEY" -d '{
"model": "openai/gpt-oss-20b",
"messages": [
{"role": "user", "content": "Summarize the key points from this input."}
]
}'API 使用指南
完整 API 参考 →Chat 调用
通过 TheRouter 使用标准 OpenAI 兼容的 chat completion。模型使用 harmony 聊天格式;TheRouter 会自动转换。
curl https://api.therouter.ai/v1/chat/completions \
-H "Authorization: Bearer $THEROUTER_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "openai/gpt-oss-20b",
"messages": [
{"role": "user", "content": "What makes Mixture-of-Experts models efficient for edge deployment?"}
]
}'openai 其他模型
同类模型
跨供应商的相似能力档位常见问题
我能否通过 TheRouter 的 API 使用 GPT OSS 20B,而无需自行托管?
可以。TheRouter 通过托管基础设施路由 gpt-oss-20b 的请求。你可以通过 https://api.therouter.ai/v1 的标准 OpenAI 兼容 API 使用这个开源权重模型,无需管理自己的 GPU 硬件。20B 版本特别适合快速迭代和边缘规模的工作负载。
GPT OSS 20B 使用什么许可证?
Apache 2.0——一种宽松的许可证,允许商业使用、修改、分发和再许可,没有 Copyleft 限制或专利风险。
GPT OSS 20B 与 GPT OSS 120B 相比如何?
GPT OSS 20B 是 120B(1170 亿总/51 亿活跃)的较小版本(210 亿总/36 亿活跃)。它最低可在 16GB 内存上运行(而非 80GB),而 120B 在困难推理基准(HLE、HealthBench)和 Agent 评估(Tau-Bench)上得分更高。但 20B 在大多数基准上仍匹配或超越 o3-mini——在边缘部署和成本敏感型工作负载中是很好的权衡。
自行托管 GPT OSS 20B 需要什么硬件?
一台 16GB 内存的设备——如 NVIDIA RTX 4060/4070、配备 M 系列芯片和 16GB 统一内存的 Apple Mac,或边缘服务器 GPU。量化后的检查点为 12.8 GiB。通过 MXFP4 量化和 MoE 架构,每次前向传播仅激活 36 亿参数,可在消费级硬件上进行高效本地推理。
事实档案 — 本页每条断言可在此回溯来源
| 来源 | URL | 采集于 | |
|---|---|---|---|
| 发布日期 | openai.com ↗ | 2026-05-29 | 已核实 |
| 架构 | openai.com ↗ | 2026-05-29 | 已核实 |
| 许可 | openai.com ↗ | 2026-05-29 | 已核实 |
| 知识截止日期 | arxiv.org ↗ | 2026-05-29 | 已核实 |
| 分词器 | arxiv.org ↗ | 2026-05-29 | 已核实 |
| 最低内存 | openai.com ↗ | 2026-05-29 | 已核实 |
| 量化 | arxiv.org ↗ | 2026-05-29 | 已核实 |
| 检查点大小 | huggingface.co ↗ | 2026-05-29 | 已核实 |
| 推理模式 | openai.com ↗ | 2026-05-29 | 已核实 |
| MMLU | arxiv.org ↗ | 2026-05-29 | 已核实 |
| AIME 2024 | arxiv.org ↗ | 2026-05-29 | 已核实 |
| AIME 2025 | arxiv.org ↗ | 2026-05-29 | 已核实 |
| Codeforces Elo | openai.com ↗ | 2026-05-29 | 待核实 |
| SWE-Bench Verified | arxiv.org ↗ | 2026-05-29 | 已核实 |
| GPQA Diamond | arxiv.org ↗ | 2026-05-29 | 已核实 |
| HLE | arxiv.org ↗ | 2026-05-29 | 已核实 |
| HealthBench | arxiv.org ↗ | 2026-05-29 | 已核实 |
| Tau-Bench Retail | arxiv.org ↗ | 2026-05-29 | 已核实 |
| 我能否通过 TheRouter 的 API 使用 GPT OSS 20B,而无需自行托管? | openai.com ↗ | 2026-05-29 | 待核实 |
| GPT OSS 20B 使用什么许可证? | openai.com ↗ | 2026-05-29 | 待核实 |
| GPT OSS 20B 与 GPT OSS 120B 相比如何? | openai.com ↗ | 2026-05-29 | 待核实 |
| 自行托管 GPT OSS 20B 需要什么硬件? | github.com ↗ | 2026-05-29 | 待核实 |