GPT OSS 20B
OpenAI's open-source 20B model with hybrid reasoning, extended thinking, efficient code generation, agentic search, and tool use. Cost-effective alternative to the 120B variant.
GPT OSS 20B — младшая модель в семействе первых открытых моделей OpenAI со времён GPT-2, выпущенных в августе 2025 года под лицензией Apache 2.0. Это 21-миллиардный Mixture-of-Experts (MoE) трансформер, активирующий всего 3,6 млрд параметров за один прямой проход, что позволяет разворачивать его на устройствах с 16GB памяти — включая периферийное оборудование и потребительские ноутбуки. Несмотря на компактный размер, модель дообучена с использованием того же пайплайна RL на основе цепочки рассуждений (CoT), что и версия 120B, обеспечивая настраиваемые уровни рассуждений (низкий/средний/высокий), полную CoT, использование инструментов и структурированные выходные данные.
В продакшене GPT OSS 20B идеален для периферийных сценариев, on-device AI и быстрых итерационных рабочих процессов, где бюджет GPU ограничен или требуется минимизировать задержку. Модель соответствует или превосходит OpenAI o3-mini на большинстве бенчмарков, часто опережая его в соревновательной математике и медицинских рассуждениях — что примечательно для модели с 21B всего / 3,6B активных параметров. Через TheRouter вы можете получить к ней доступ через управляемый API, совместимый с OpenAI, без самостоятельного хостинга; альтернативно, лицензия Apache 2.0 позволяет загрузить, дообучить и развернуть модель полностью на собственной инфраструктуре.
- • Периферийный и локальный инференс — работает на устройствах с 16GB памяти, включая ноутбуки, edge-серверы и одноплатные компьютеры.
- • Экономичные агентные рабочие процессы — вызов инструментов, функций и агентные циклы по доле стоимости более крупных моделей.
- • Быстрое прототипирование и итерации — быстрый CoT с низким уровнем рассуждений, идеально для отладки промптов и оркестрации агентов перед масштабированием.
- • Кастомизация на устройстве — лицензия Apache 2.0 позволяет неограниченное дообучение и коммерческое развёртывание.
- • Сложные одношаговые рассуждения — для задач, требующих устойчивого глубокого анализа (например, сложные задачи HLE), используйте gpt-oss-120b в режиме высоких рассуждений.
- • Мультимодальные задачи — это текстовая модель. Для зрения или аудио используйте GPT-4o или GPT-4o-mini через TheRouter.
- • Высоконагруженные API с критичной задержкой — режимы средних/высоких рассуждений всё ещё генерируют CoT; для минимальной задержки используйте низкий уровень рассуждений с Mistral Small 4 или GPT-4.1 Nano через TheRouter.
Модальности
Разбивка цен
| Тип | Ставка |
|---|---|
| Вход | $0.0756 за 1 млн токенов |
| Выход | $0.324 за 1 млн токенов |
Поддерживаемые параметры
Характеристики
| Дата релиза | 2025-08-05openai.com ↗ | проверено |
| Архитектура | MoE Transformer — 24 слоя, 32 эксперта, top-4 активны, 21B всего / 3,6B активных параметровopenai.com ↗ | проверено |
| Лицензия | Apache 2.0openai.com ↗ | проверено |
| Дата отсечения знаний | Июнь 2024arxiv.org ↗ | проверено |
| Токенизатор | o200k_harmony (201 088 токенов)arxiv.org ↗ | проверено |
| Минимальная память | 16 ГБ (развёртывание на потребительских периферийных устройствах)openai.com ↗ | проверено |
| Квантизация | MXFP4 (4,25 бит/параметр на MoE-весах)arxiv.org ↗ | проверено |
| Размер контрольной точки | 12,8 GiBhuggingface.co ↗ | проверено |
| Режимы рассуждений | низкий / средний / высокий (настраивается через system prompt)openai.com ↗ | проверено |
Бенчмарки
| Benchmark | Distribution | Score | Source |
|---|---|---|---|
MMLU Режим высоких рассуждений | 85.3%% | arxiv.org ↗ | |
AIME 2024 С инструментами, режим высоких рассуждений | 96.0%% | arxiv.org ↗ | |
AIME 2025 С инструментами, режим высоких рассуждений | 98.7%% | arxiv.org ↗ | |
Codeforces Elo Приблизительный рейтинг Elo; режим высоких рассуждений с инструментом терминала | ~2516 | openai.com ↗ | |
SWE-Bench Verified Режим высоких рассуждений | 60.7%% | arxiv.org ↗ | |
GPQA Diamond С инструментами, режим высоких рассуждений | 71.5%% | arxiv.org ↗ | |
HLE С инструментами, режим высоких рассуждений. HLE — чрезвычайно сложный бенчмарк. | 17.3%% | arxiv.org ↗ | |
HealthBench Режим высоких рассуждений. Превосходит o3-mini в медицинских рассуждениях, несмотря на меньший размер. | 42.5%% | arxiv.org ↗ | |
Tau-Bench Retail Режим высоких рассуждений — оценка агентного вызова функций | 54.8%% | arxiv.org ↗ |
Примеры API
Для новых интеграций используйте глобальный endpoint api.therouter.ai из примеров ниже; старый China accelerated endpoint выведен из эксплуатации.
curl https://api.therouter.ai/v1/chat/completions -H "Content-Type: application/json" -H "Authorization: Bearer $THE_ROUTER_API_KEY" -d '{
"model": "openai/gpt-oss-20b",
"messages": [
{"role": "user", "content": "Summarize the key points from this input."}
]
}'Гид по API
Полный API-справочник →Chat completion
Используйте стандартный совместимый с OpenAI chat completion через TheRouter. Модель использует формат harmony; TheRouter выполняет преобразование автоматически.
curl https://api.therouter.ai/v1/chat/completions \
-H "Authorization: Bearer $THEROUTER_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "openai/gpt-oss-20b",
"messages": [
{"role": "user", "content": "What makes Mixture-of-Experts models efficient for edge deployment?"}
]
}'Ещё от openai
Похожие модели
Аналоги в других провайдерахЧастые вопросы
Могу ли я использовать GPT OSS 20B через API TheRouter без самостоятельного хостинга?
Да. TheRouter маршрутизирует запросы к gpt-oss-20b через свою управляемую инфраструктуру. Вы получаете модель с открытыми весами через стандартный совместимый с OpenAI API по адресу https://api.therouter.ai/v1, без управления собственным GPU-оборудованием. Версия 20B особенно хорошо подходит для быстрой итерации и edge-нагрузок.
По какой лицензии распространяется GPT OSS 20B?
Apache 2.0 — разрешительная лицензия, позволяющая коммерческое использование, модификацию, распространение и сублицензирование без ограничений copyleft или патентных рисков.
Как GPT OSS 20B сравнивается с GPT OSS 120B?
GPT OSS 20B — младшая модель (21B всего / 3,6B активных) по сравнению с 120B (117B всего / 5,1B активных). Она работает на 16GB памяти вместо 80GB, в то время как 120B показывает более высокие результаты на сложных бенчмарках рассуждений (HLE, HealthBench) и агентных оценках (Tau-Bench). При этом 20B всё равно соответствует или превосходит o3-mini на большинстве бенчмарков — отличный компромисс для edge-развёртывания и чувствительных к стоимости нагрузок.
Какое оборудование нужно для самостоятельного хостинга GPT OSS 20B?
Устройство с 16GB памяти — например NVIDIA RTX 4060/4070, Apple Mac с M-серией и 16GB унифицированной памяти, или периферийный серверный GPU. Квантизированная контрольная точка — 12,8 GiB. Благодаря квантизации MXFP4 и архитектуре MoE на каждый прямой проход активируется всего 3,6 млрд параметров, что позволяет эффективно выполнять локальный инференс на потребительском оборудовании.
Реестр фактов — каждая утверждаемая величина имеет источник
| источник | URL | получено | |
|---|---|---|---|
| Дата релиза | openai.com ↗ | 2026-05-29 | проверено |
| Архитектура | openai.com ↗ | 2026-05-29 | проверено |
| Лицензия | openai.com ↗ | 2026-05-29 | проверено |
| Дата отсечения знаний | arxiv.org ↗ | 2026-05-29 | проверено |
| Токенизатор | arxiv.org ↗ | 2026-05-29 | проверено |
| Минимальная память | openai.com ↗ | 2026-05-29 | проверено |
| Квантизация | arxiv.org ↗ | 2026-05-29 | проверено |
| Размер контрольной точки | huggingface.co ↗ | 2026-05-29 | проверено |
| Режимы рассуждений | openai.com ↗ | 2026-05-29 | проверено |
| MMLU | arxiv.org ↗ | 2026-05-29 | проверено |
| AIME 2024 | arxiv.org ↗ | 2026-05-29 | проверено |
| AIME 2025 | arxiv.org ↗ | 2026-05-29 | проверено |
| Codeforces Elo | openai.com ↗ | 2026-05-29 | к проверке |
| SWE-Bench Verified | arxiv.org ↗ | 2026-05-29 | проверено |
| GPQA Diamond | arxiv.org ↗ | 2026-05-29 | проверено |
| HLE | arxiv.org ↗ | 2026-05-29 | проверено |
| HealthBench | arxiv.org ↗ | 2026-05-29 | проверено |
| Tau-Bench Retail | arxiv.org ↗ | 2026-05-29 | проверено |
| Могу ли я использовать GPT OSS 20B через API TheRouter без самостоятельного хостинга? | openai.com ↗ | 2026-05-29 | к проверке |
| По какой лицензии распространяется GPT OSS 20B? | openai.com ↗ | 2026-05-29 | к проверке |
| Как GPT OSS 20B сравнивается с GPT OSS 120B? | openai.com ↗ | 2026-05-29 | к проверке |
| Какое оборудование нужно для самостоятельного хостинга GPT OSS 20B? | github.com ↗ | 2026-05-29 | к проверке |