GPT OSS 120B
OpenAI's open-source 120B model with hybrid reasoning, extended thinking, efficient code generation, agentic search, computer use, and tool use capabilities.
GPT OSS 120B — первая открытая модель от OpenAI со времён GPT-2, выпущенная в августе 2025 года под лицензией Apache 2.0. Это 117-миллиардный Mixture-of-Experts (MoE) трансформер, активирующий всего 5,1 млрд параметров за один прямой проход, что позволяет разворачивать его на одном 80GB GPU (NVIDIA H100 или AMD MI300X). Модель дообучена с использованием тех же методов RL на основе цепочки рассуждений (CoT), что и проприетарные модели серии o от OpenAI. Поддерживает настраиваемые уровни рассуждений (низкий/средний/высокий), полную CoT, использование инструментов и структурированные выходные данные.
В продакшене GPT OSS 120B — сильный кандидат для задач с высокими требованиями к рассуждениям и агентным нагрузкам, где необходим собственный хостинг: корпоративные развёртывания on-premises, работа с чувствительными данными или государственные установки. Модель достигает почти паритета с OpenAI o4-mini на ключевых бенчмарках рассуждений, превосходя o3-mini практически во всех оценках. Доступна через OpenAI Responses API, а также через маршрутизацию TheRouter для тех, кто предпочитает управляемый API, сохраняя при этом возможность работы с открытыми весами.
- • Развёртывание с высокими требованиями к рассуждениям — установка on-premises на одном H100 или MI300X с полным суверенитетом данных.
- • Агентные рабочие процессы — вызов функций, интеграция веб-поиска, выполнение Python-кода в агентных циклах.
- • Соревновательное программирование и математика — Codeforces Elo ~2620, AIME 2024 с инструментами 96.6%.
- • Медицинские рассуждения — почти достигает o3 на HealthBench, превосходя o1, o4-mini и GPT-4o.
- • Дообучение для специализированных доменов — лицензия Apache 2.0 позволяет неограниченную кастомизацию.
- • Чувствительные к задержке real-time приложения — режим высоких рассуждений генерирует длинные CoT; используйте gpt-oss-20b с низким уровнем рассуждений.
- • Мультимодальные задачи — это текстовая модель. Для зрения или аудио используйте GPT-4o или GPT-4o-mini через TheRouter.
- • Развёртывание на периферийных/мобильных устройствах — контрольная точка 60,8 GiB слишком велика; используйте gpt-oss-20b (12,8 GiB).
Модальности
Разбивка цен
| Тип | Ставка |
|---|---|
| Вход | $0.162 за 1 млн токенов |
| Выход | $0.648 за 1 млн токенов |
Поддерживаемые параметры
Характеристики
| Дата релиза | 2025-08-05openai.com ↗ | проверено |
| Архитектура | MoE Transformer — 36 слоёв, 128 экспертов, top-4 активны, 116,8B всего / 5,1B активных параметровarxiv.org ↗ | проверено |
| Лицензия | Apache 2.0openai.com ↗ | проверено |
| Дата отсечения знаний | Июнь 2024arxiv.org ↗ | проверено |
| Токенизатор | o200k_harmony (201 088 токенов)arxiv.org ↗ | проверено |
| Квантизация | MXFP4 (4,25 бит/параметр на MoE-весах)arxiv.org ↗ | проверено |
| Размер контрольной точки | 60,8 GiBarxiv.org ↗ | проверено |
| Вычисления на обучение | 2,1 млн H100-часовarxiv.org ↗ | проверено |
| Режимы рассуждений | низкий / средний / высокий (настраивается через system prompt)openai.com ↗ | проверено |
Бенчмарки
| Benchmark | Distribution | Score | Source |
|---|---|---|---|
MMLU Режим высоких рассуждений | 90.0%% | arxiv.org ↗ | |
AIME 2024 С инструментами, режим высоких рассуждений | 96.6%% | arxiv.org ↗ | |
AIME 2025 С инструментами, режим высоких рассуждений | 97.9%% | arxiv.org ↗ | |
Codeforces Elo Приблизительный рейтинг Elo; режим высоких рассуждений с инструментом терминала | ~2620 | openai.com ↗ | |
SWE-Bench Verified Режим высоких рассуждений | 62.4%% | arxiv.org ↗ | |
GPQA Diamond С инструментами, режим высоких рассуждений | 80.9%% | arxiv.org ↗ | |
HLE С инструментами, режим высоких рассуждений. HLE — чрезвычайно сложный бенчмарк. | 19.0%% | arxiv.org ↗ | |
HealthBench Режим высоких рассуждений. Почти достигает o3, превосходит o1, GPT-4o, o3-mini и o4-mini. | 57.6%% | arxiv.org ↗ | |
HealthBench Hard Режим высоких рассуждений, сложный поднабор HealthBench | 30.0%% | arxiv.org ↗ | |
Tau-Bench Retail Режим высоких рассуждений — оценка агентного вызова функций | 67.8%% | arxiv.org ↗ | |
MMMLU (Average) Среднее по 14 языкам, режим высоких рассуждений | 81.3%% | arxiv.org ↗ |
Примеры API
Для новых интеграций используйте глобальный endpoint api.therouter.ai из примеров ниже; старый China accelerated endpoint выведен из эксплуатации.
curl https://api.therouter.ai/v1/chat/completions -H "Content-Type: application/json" -H "Authorization: Bearer $THE_ROUTER_API_KEY" -d '{
"model": "openai/gpt-oss-120b",
"messages": [
{"role": "user", "content": "Summarize the key points from this input."}
]
}'Гид по API
Полный API-справочник →Chat completion
Используйте стандартный совместимый с OpenAI chat completion через TheRouter. Модель использует формат harmony; TheRouter выполняет преобразование автоматически.
curl https://api.therouter.ai/v1/chat/completions \
-H "Authorization: Bearer $THEROUTER_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "openai/gpt-oss-120b",
"messages": [
{"role": "user", "content": "Explain the benefits of Mixture-of-Experts architecture in large language models."}
]
}'Ещё от openai
Похожие модели
Аналоги в других провайдерахЧастые вопросы
Могу ли я использовать GPT OSS 120B через API TheRouter без самостоятельного хостинга?
Да. TheRouter маршрутизирует запросы к gpt-oss-120b через свою управляемую инфраструктуру. Вы получаете модель с открытыми весами через стандартный совместимый с OpenAI API по адресу https://api.therouter.ai/v1, без управления собственным GPU-оборудованием.
По какой лицензии распространяется GPT OSS 120B?
Apache 2.0 — разрешительная лицензия, позволяющая коммерческое использование, модификацию, распространение и сублицензирование без ограничений copyleft или патентных рисков.
Как GPT OSS 120B сравнивается с GPT-4o?
GPT OSS 120B — это модель с открытыми весами, ориентированная на рассуждения. Она превосходит GPT-4o на бенчмарках по математике (AIME), программированию (Codeforces) и здоровью (HealthBench). Однако GPT-4o — мультимодальная модель (зрение, аудио), тогда как GPT OSS 120B работает только с текстом. Для мультимодальных задач используйте GPT-4o или GPT-4o-mini через TheRouter.
Какое оборудование нужно для самостоятельного хостинга GPT OSS 120B?
Один 80GB GPU, например NVIDIA H100 или AMD MI300X. Квантизированная контрольная точка — 60,8 GiB. Благодаря квантизации MXFP4 и архитектуре MoE на каждый прямой проход активируется всего 5,1 млрд параметров, что позволяет эффективно выполнять инференс на потребительских GPU.
Реестр фактов — каждая утверждаемая величина имеет источник
| источник | URL | получено | |
|---|---|---|---|
| Дата релиза | openai.com ↗ | 2026-05-29 | проверено |
| Архитектура | arxiv.org ↗ | 2026-05-29 | проверено |
| Лицензия | openai.com ↗ | 2026-05-29 | проверено |
| Дата отсечения знаний | arxiv.org ↗ | 2026-05-29 | проверено |
| Токенизатор | arxiv.org ↗ | 2026-05-29 | проверено |
| Квантизация | arxiv.org ↗ | 2026-05-29 | проверено |
| Размер контрольной точки | arxiv.org ↗ | 2026-05-29 | проверено |
| Вычисления на обучение | arxiv.org ↗ | 2026-05-29 | проверено |
| Режимы рассуждений | openai.com ↗ | 2026-05-29 | проверено |
| MMLU | arxiv.org ↗ | 2026-05-29 | проверено |
| AIME 2024 | arxiv.org ↗ | 2026-05-29 | проверено |
| AIME 2025 | arxiv.org ↗ | 2026-05-29 | проверено |
| Codeforces Elo | openai.com ↗ | 2026-05-29 | к проверке |
| SWE-Bench Verified | arxiv.org ↗ | 2026-05-29 | проверено |
| GPQA Diamond | arxiv.org ↗ | 2026-05-29 | проверено |
| HLE | arxiv.org ↗ | 2026-05-29 | проверено |
| HealthBench | arxiv.org ↗ | 2026-05-29 | проверено |
| HealthBench Hard | arxiv.org ↗ | 2026-05-29 | проверено |
| Tau-Bench Retail | arxiv.org ↗ | 2026-05-29 | проверено |
| MMMLU (Average) | arxiv.org ↗ | 2026-05-29 | проверено |
| Могу ли я использовать GPT OSS 120B через API TheRouter без самостоятельного хостинга? | openai.com ↗ | 2026-05-29 | к проверке |
| По какой лицензии распространяется GPT OSS 120B? | openai.com ↗ | 2026-05-29 | к проверке |
| Как GPT OSS 120B сравнивается с GPT-4o? | arxiv.org ↗ | 2026-05-29 | к проверке |
| Какое оборудование нужно для самостоятельного хостинга GPT OSS 120B? | github.com ↗ | 2026-05-29 | к проверке |