Назад к моделям

GPT OSS 20B

openaiopenai/gpt-oss-20b

OpenAI's open-source 20B model with hybrid reasoning, extended thinking, efficient code generation, agentic search, and tool use. Cost-effective alternative to the 120B variant.

GPT OSS 20B — младшая модель в семействе первых открытых моделей OpenAI со времён GPT-2, выпущенных в августе 2025 года под лицензией Apache 2.0. Это 21-миллиардный Mixture-of-Experts (MoE) трансформер, активирующий всего 3,6 млрд параметров за один прямой проход, что позволяет разворачивать его на устройствах с 16GB памяти — включая периферийное оборудование и потребительские ноутбуки. Несмотря на компактный размер, модель дообучена с использованием того же пайплайна RL на основе цепочки рассуждений (CoT), что и версия 120B, обеспечивая настраиваемые уровни рассуждений (низкий/средний/высокий), полную CoT, использование инструментов и структурированные выходные данные.

В продакшене GPT OSS 20B идеален для периферийных сценариев, on-device AI и быстрых итерационных рабочих процессов, где бюджет GPU ограничен или требуется минимизировать задержку. Модель соответствует или превосходит OpenAI o3-mini на большинстве бенчмарков, часто опережая его в соревновательной математике и медицинских рассуждениях — что примечательно для модели с 21B всего / 3,6B активных параметров. Через TheRouter вы можете получить к ней доступ через управляемый API, совместимый с OpenAI, без самостоятельного хостинга; альтернативно, лицензия Apache 2.0 позволяет загрузить, дообучить и развернуть модель полностью на собственной инфраструктуре.

Когда выбирать
  • • Периферийный и локальный инференс — работает на устройствах с 16GB памяти, включая ноутбуки, edge-серверы и одноплатные компьютеры.
  • • Экономичные агентные рабочие процессы — вызов инструментов, функций и агентные циклы по доле стоимости более крупных моделей.
  • • Быстрое прототипирование и итерации — быстрый CoT с низким уровнем рассуждений, идеально для отладки промптов и оркестрации агентов перед масштабированием.
  • • Кастомизация на устройстве — лицензия Apache 2.0 позволяет неограниченное дообучение и коммерческое развёртывание.
Когда не выбирать
  • • Сложные одношаговые рассуждения — для задач, требующих устойчивого глубокого анализа (например, сложные задачи HLE), используйте gpt-oss-120b в режиме высоких рассуждений.
  • • Мультимодальные задачи — это текстовая модель. Для зрения или аудио используйте GPT-4o или GPT-4o-mini через TheRouter.
  • • Высоконагруженные API с критичной задержкой — режимы средних/высоких рассуждений всё ещё генерируют CoT; для минимальной задержки используйте низкий уровень рассуждений с Mistral Small 4 или GPT-4.1 Nano через TheRouter.
Размер контекста
128K
Максимальный вывод
16K
Цена Входза 1M токенов
$0.0756за 1 млн токенов
Цена Выходза 1M токенов
$0.324за 1 млн токенов

Модальности

Текст→Текст

Разбивка цен

ТипСтавка
Вход$0.0756 за 1 млн токенов
Выход$0.324 за 1 млн токенов

Поддерживаемые параметры

temperaturemax_tokenstop_ptoolstool_choiceresponse_formatreasoningstop

Характеристики

Дата релиза2025-08-05openai.com ↗проверено
АрхитектураMoE Transformer — 24 слоя, 32 эксперта, top-4 активны, 21B всего / 3,6B активных параметровopenai.com ↗проверено
ЛицензияApache 2.0openai.com ↗проверено
Дата отсечения знанийИюнь 2024arxiv.org ↗проверено
Токенизаторo200k_harmony (201 088 токенов)arxiv.org ↗проверено
Минимальная память16 ГБ (развёртывание на потребительских периферийных устройствах)openai.com ↗проверено
КвантизацияMXFP4 (4,25 бит/параметр на MoE-весах)arxiv.org ↗проверено
Размер контрольной точки12,8 GiBhuggingface.co ↗проверено
Режимы рассужденийнизкий / средний / высокий (настраивается через system prompt)openai.com ↗проверено

Бенчмарки

BenchmarkDistributionScoreSource
MMLU
Режим высоких рассуждений
85.3%%arxiv.org ↗
AIME 2024
С инструментами, режим высоких рассуждений
96.0%%arxiv.org ↗
AIME 2025
С инструментами, режим высоких рассуждений
98.7%%arxiv.org ↗
Codeforces Elo
Приблизительный рейтинг Elo; режим высоких рассуждений с инструментом терминала
~2516openai.com ↗
SWE-Bench Verified
Режим высоких рассуждений
60.7%%arxiv.org ↗
GPQA Diamond
С инструментами, режим высоких рассуждений
71.5%%arxiv.org ↗
HLE
С инструментами, режим высоких рассуждений. HLE — чрезвычайно сложный бенчмарк.
17.3%%arxiv.org ↗
HealthBench
Режим высоких рассуждений. Превосходит o3-mini в медицинских рассуждениях, несмотря на меньший размер.
42.5%%arxiv.org ↗
Tau-Bench Retail
Режим высоких рассуждений — оценка агентного вызова функций
54.8%%arxiv.org ↗

Примеры API

Для новых интеграций используйте глобальный endpoint api.therouter.ai из примеров ниже; старый China accelerated endpoint выведен из эксплуатации.

cURL
curl https://api.therouter.ai/v1/chat/completions   -H "Content-Type: application/json"   -H "Authorization: Bearer $THE_ROUTER_API_KEY"   -d '{
    "model": "openai/gpt-oss-20b",
    "messages": [
      {"role": "user", "content": "Summarize the key points from this input."}
    ]
  }'

Chat completion

Используйте стандартный совместимый с OpenAI chat completion через TheRouter. Модель использует формат harmony; TheRouter выполняет преобразование автоматически.

cURL
curl https://api.therouter.ai/v1/chat/completions \
  -H "Authorization: Bearer $THEROUTER_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "openai/gpt-oss-20b",
    "messages": [
      {"role": "user", "content": "What makes Mixture-of-Experts models efficient for edge deployment?"}
    ]
  }'

Ещё от openai

Похожие модели

Аналоги в других провайдерах

Частые вопросы

Могу ли я использовать GPT OSS 20B через API TheRouter без самостоятельного хостинга?

Да. TheRouter маршрутизирует запросы к gpt-oss-20b через свою управляемую инфраструктуру. Вы получаете модель с открытыми весами через стандартный совместимый с OpenAI API по адресу https://api.therouter.ai/v1, без управления собственным GPU-оборудованием. Версия 20B особенно хорошо подходит для быстрой итерации и edge-нагрузок.

переработано TheRouteropenai.com ↗
По какой лицензии распространяется GPT OSS 20B?

Apache 2.0 — разрешительная лицензия, позволяющая коммерческое использование, модификацию, распространение и сублицензирование без ограничений copyleft или патентных рисков.

переработано TheRouteropenai.com ↗
Как GPT OSS 20B сравнивается с GPT OSS 120B?

GPT OSS 20B — младшая модель (21B всего / 3,6B активных) по сравнению с 120B (117B всего / 5,1B активных). Она работает на 16GB памяти вместо 80GB, в то время как 120B показывает более высокие результаты на сложных бенчмарках рассуждений (HLE, HealthBench) и агентных оценках (Tau-Bench). При этом 20B всё равно соответствует или превосходит o3-mini на большинстве бенчмарков — отличный компромисс для edge-развёртывания и чувствительных к стоимости нагрузок.

переработано TheRouteropenai.com ↗
Какое оборудование нужно для самостоятельного хостинга GPT OSS 20B?

Устройство с 16GB памяти — например NVIDIA RTX 4060/4070, Apple Mac с M-серией и 16GB унифицированной памяти, или периферийный серверный GPU. Квантизированная контрольная точка — 12,8 GiB. Благодаря квантизации MXFP4 и архитектуре MoE на каждый прямой проход активируется всего 3,6 млрд параметров, что позволяет эффективно выполнять локальный инференс на потребительском оборудовании.

переработано TheRoutergithub.com ↗
Реестр фактов — каждая утверждаемая величина имеет источник
источникURLполучено
Дата релизаopenai.com ↗2026-05-29проверено
Архитектураopenai.com ↗2026-05-29проверено
Лицензияopenai.com ↗2026-05-29проверено
Дата отсечения знанийarxiv.org ↗2026-05-29проверено
Токенизаторarxiv.org ↗2026-05-29проверено
Минимальная памятьopenai.com ↗2026-05-29проверено
Квантизацияarxiv.org ↗2026-05-29проверено
Размер контрольной точкиhuggingface.co ↗2026-05-29проверено
Режимы рассужденийopenai.com ↗2026-05-29проверено
MMLUarxiv.org ↗2026-05-29проверено
AIME 2024arxiv.org ↗2026-05-29проверено
AIME 2025arxiv.org ↗2026-05-29проверено
Codeforces Eloopenai.com ↗2026-05-29к проверке
SWE-Bench Verifiedarxiv.org ↗2026-05-29проверено
GPQA Diamondarxiv.org ↗2026-05-29проверено
HLEarxiv.org ↗2026-05-29проверено
HealthBencharxiv.org ↗2026-05-29проверено
Tau-Bench Retailarxiv.org ↗2026-05-29проверено
Могу ли я использовать GPT OSS 20B через API TheRouter без самостоятельного хостинга?openai.com ↗2026-05-29к проверке
По какой лицензии распространяется GPT OSS 20B?openai.com ↗2026-05-29к проверке
Как GPT OSS 20B сравнивается с GPT OSS 120B?openai.com ↗2026-05-29к проверке
Какое оборудование нужно для самостоятельного хостинга GPT OSS 20B?github.com ↗2026-05-29к проверке
Помощь и контакты