返回模型列表

GPT OSS 20B

openaiopenai/gpt-oss-20b

OpenAI's open-source 20B model with hybrid reasoning, extended thinking, efficient code generation, agentic search, and tool use. Cost-effective alternative to the 120B variant.

GPT OSS 20B 是 OpenAI 自 GPT-2 以来首个开源权重语言模型家族中的较小版本,于 2025 年 8 月以 Apache 2.0 许可证发布。它是一款 210 亿参数的混合专家(MoE)Transformer 模型,每次前向传播仅激活 36 亿参数,可在低至 16GB 内存的设备上部署——包括边缘硬件和消费级笔记本。尽管体积紧凑,它采用了与 120B 版本相同的思维链强化学习流水线进行后训练,支持可配置的推理努力级别(低/中/高)、完整 CoT 可见性、工具调用和结构化输出。

在生产环境中,GPT OSS 20B 非常适合边缘场景、设备端 AI 和 GPU 预算有限或延迟要求最低的快速迭代工作流。它在大多数基准上匹配或超越 OpenAI o3-mini,在竞赛数学和健康推理方面甚至常常优于 o3-mini——对于一个 210 亿总 / 36 亿活跃参数的模型来说非常出色。通过 TheRouter,您可以通过托管式 OpenAI 兼容 API 访问它而无需自行托管;另外,Apache 2.0 许可证允许您完全在自己的基础设施上下载、微调和部署。

适合使用
  • • 边缘和本地推理——可在 16GB 设备上运行,包括笔记本、边缘服务器和单板计算机。
  • • 成本敏感的 Agent 工作流——以远低于大型前沿模型的成本使用工具调用、函数调用和 Agent 循环。
  • • 快速原型设计和迭代——低推理强度下的快速 CoT,适合在扩展前调试提示词和 Agent 编排。
  • • 设备端定制——Apache 2.0 许可证允许无限制的微调和商业部署。
不适合使用
  • • 一次成型的高复杂度推理——需要持续深度推理的任务(如高难度 HLE 问题),建议使用 gpt-oss-120b 的高推理模式。
  • • 多模态任务——这是一个纯文本模型。视觉或音频任务请通过 TheRouter 使用 GPT-4o 或 GPT-4o-mini。
  • • 延迟关键的高吞吐量 API——中/高推理模式仍会产生 CoT 痕迹;为追求最低延迟,可通过 TheRouter 将低推理强度与 Mistral Small 4 或 GPT-4.1 Nano 配合使用。
上下文长度
128K
最大输出
16K
输入价格每百万 tokens
$0.0756每百万 Tokens
输出价格每百万 tokens
$0.324每百万 Tokens

模态能力

文本→文本

价格明细

类型费率
输入$0.0756 每百万 Tokens
输出$0.324 每百万 Tokens

支持参数

temperaturemax_tokenstop_ptoolstool_choiceresponse_formatreasoningstop

模型规格

发布日期2025-08-05openai.com ↗已核实
架构MoE Transformer — 24 层,32 个专家,Top-4 激活,210 亿总 / 36 亿活跃参数openai.com ↗已核实
许可Apache 2.0openai.com ↗已核实
知识截止日期2024 年 6 月arxiv.org ↗已核实
分词器o200k_harmony (201,088 个词元)arxiv.org ↗已核实
最低内存16 GB(消费级边缘设备部署)openai.com ↗已核实
量化MXFP4 (MoE 权重 4.25 bits/参数)arxiv.org ↗已核实
检查点大小12.8 GiBhuggingface.co ↗已核实
推理模式低 / 中 / 高(系统提示词中配置)openai.com ↗已核实

基准成绩

BenchmarkDistributionScoreSource
MMLU
高推理模式
85.3%%arxiv.org ↗
AIME 2024
含工具,高推理模式
96.0%%arxiv.org ↗
AIME 2025
含工具,高推理模式
98.7%%arxiv.org ↗
Codeforces Elo
估计 Elo 等级分;高推理模式含终端工具
~2516openai.com ↗
SWE-Bench Verified
高推理模式
60.7%%arxiv.org ↗
GPQA Diamond
含工具,高推理模式
71.5%%arxiv.org ↗
HLE
含工具,高推理模式。HLE 是难度极高的基准。
17.3%%arxiv.org ↗
HealthBench
高推理模式。尽管体积较小,在健康推理方面仍优于 o3-mini。
42.5%%arxiv.org ↗
Tau-Bench Retail
高推理模式——Agent 函数调用评估
54.8%%arxiv.org ↗

API 使用示例

所有新集成都应使用下方示例中的全球端点 api.therouter.ai;旧中国加速端点已下线。

cURL
curl https://api.therouter.ai/v1/chat/completions   -H "Content-Type: application/json"   -H "Authorization: Bearer $THE_ROUTER_API_KEY"   -d '{
    "model": "openai/gpt-oss-20b",
    "messages": [
      {"role": "user", "content": "Summarize the key points from this input."}
    ]
  }'

API 使用指南

完整 API 参考 →

Chat 调用

通过 TheRouter 使用标准 OpenAI 兼容的 chat completion。模型使用 harmony 聊天格式;TheRouter 会自动转换。

cURL
curl https://api.therouter.ai/v1/chat/completions \
  -H "Authorization: Bearer $THEROUTER_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "openai/gpt-oss-20b",
    "messages": [
      {"role": "user", "content": "What makes Mixture-of-Experts models efficient for edge deployment?"}
    ]
  }'

openai 其他模型

同类模型

跨供应商的相似能力档位

常见问题

我能否通过 TheRouter 的 API 使用 GPT OSS 20B,而无需自行托管?

可以。TheRouter 通过托管基础设施路由 gpt-oss-20b 的请求。你可以通过 https://api.therouter.ai/v1 的标准 OpenAI 兼容 API 使用这个开源权重模型,无需管理自己的 GPU 硬件。20B 版本特别适合快速迭代和边缘规模的工作负载。

TheRouter 编辑重写openai.com ↗
GPT OSS 20B 使用什么许可证?

Apache 2.0——一种宽松的许可证,允许商业使用、修改、分发和再许可,没有 Copyleft 限制或专利风险。

TheRouter 编辑重写openai.com ↗
GPT OSS 20B 与 GPT OSS 120B 相比如何?

GPT OSS 20B 是 120B(1170 亿总/51 亿活跃)的较小版本(210 亿总/36 亿活跃)。它最低可在 16GB 内存上运行(而非 80GB),而 120B 在困难推理基准(HLE、HealthBench)和 Agent 评估(Tau-Bench)上得分更高。但 20B 在大多数基准上仍匹配或超越 o3-mini——在边缘部署和成本敏感型工作负载中是很好的权衡。

TheRouter 编辑重写openai.com ↗
自行托管 GPT OSS 20B 需要什么硬件?

一台 16GB 内存的设备——如 NVIDIA RTX 4060/4070、配备 M 系列芯片和 16GB 统一内存的 Apple Mac,或边缘服务器 GPU。量化后的检查点为 12.8 GiB。通过 MXFP4 量化和 MoE 架构,每次前向传播仅激活 36 亿参数,可在消费级硬件上进行高效本地推理。

TheRouter 编辑重写github.com ↗
事实档案 — 本页每条断言可在此回溯来源
来源URL采集于
发布日期openai.com ↗2026-05-29已核实
架构openai.com ↗2026-05-29已核实
许可openai.com ↗2026-05-29已核实
知识截止日期arxiv.org ↗2026-05-29已核实
分词器arxiv.org ↗2026-05-29已核实
最低内存openai.com ↗2026-05-29已核实
量化arxiv.org ↗2026-05-29已核实
检查点大小huggingface.co ↗2026-05-29已核实
推理模式openai.com ↗2026-05-29已核实
MMLUarxiv.org ↗2026-05-29已核实
AIME 2024arxiv.org ↗2026-05-29已核实
AIME 2025arxiv.org ↗2026-05-29已核实
Codeforces Eloopenai.com ↗2026-05-29待核实
SWE-Bench Verifiedarxiv.org ↗2026-05-29已核实
GPQA Diamondarxiv.org ↗2026-05-29已核实
HLEarxiv.org ↗2026-05-29已核实
HealthBencharxiv.org ↗2026-05-29已核实
Tau-Bench Retailarxiv.org ↗2026-05-29已核实
我能否通过 TheRouter 的 API 使用 GPT OSS 20B,而无需自行托管?openai.com ↗2026-05-29待核实
GPT OSS 20B 使用什么许可证?openai.com ↗2026-05-29待核实
GPT OSS 20B 与 GPT OSS 120B 相比如何?openai.com ↗2026-05-29待核实
自行托管 GPT OSS 20B 需要什么硬件?github.com ↗2026-05-29待核实
帮助与联系