Назад к моделям

GPT OSS 120B

openaiopenai/gpt-oss-120b

OpenAI's open-source 120B model with hybrid reasoning, extended thinking, efficient code generation, agentic search, computer use, and tool use capabilities.

GPT OSS 120B — первая открытая модель от OpenAI со времён GPT-2, выпущенная в августе 2025 года под лицензией Apache 2.0. Это 117-миллиардный Mixture-of-Experts (MoE) трансформер, активирующий всего 5,1 млрд параметров за один прямой проход, что позволяет разворачивать его на одном 80GB GPU (NVIDIA H100 или AMD MI300X). Модель дообучена с использованием тех же методов RL на основе цепочки рассуждений (CoT), что и проприетарные модели серии o от OpenAI. Поддерживает настраиваемые уровни рассуждений (низкий/средний/высокий), полную CoT, использование инструментов и структурированные выходные данные.

В продакшене GPT OSS 120B — сильный кандидат для задач с высокими требованиями к рассуждениям и агентным нагрузкам, где необходим собственный хостинг: корпоративные развёртывания on-premises, работа с чувствительными данными или государственные установки. Модель достигает почти паритета с OpenAI o4-mini на ключевых бенчмарках рассуждений, превосходя o3-mini практически во всех оценках. Доступна через OpenAI Responses API, а также через маршрутизацию TheRouter для тех, кто предпочитает управляемый API, сохраняя при этом возможность работы с открытыми весами.

Когда выбирать
  • • Развёртывание с высокими требованиями к рассуждениям — установка on-premises на одном H100 или MI300X с полным суверенитетом данных.
  • • Агентные рабочие процессы — вызов функций, интеграция веб-поиска, выполнение Python-кода в агентных циклах.
  • • Соревновательное программирование и математика — Codeforces Elo ~2620, AIME 2024 с инструментами 96.6%.
  • • Медицинские рассуждения — почти достигает o3 на HealthBench, превосходя o1, o4-mini и GPT-4o.
  • • Дообучение для специализированных доменов — лицензия Apache 2.0 позволяет неограниченную кастомизацию.
Когда не выбирать
  • • Чувствительные к задержке real-time приложения — режим высоких рассуждений генерирует длинные CoT; используйте gpt-oss-20b с низким уровнем рассуждений.
  • • Мультимодальные задачи — это текстовая модель. Для зрения или аудио используйте GPT-4o или GPT-4o-mini через TheRouter.
  • • Развёртывание на периферийных/мобильных устройствах — контрольная точка 60,8 GiB слишком велика; используйте gpt-oss-20b (12,8 GiB).
Размер контекста
128K
Максимальный вывод
16K
Цена Входза 1M токенов
$0.162за 1 млн токенов
Цена Выходза 1M токенов
$0.648за 1 млн токенов

Модальности

Текст→Текст

Разбивка цен

ТипСтавка
Вход$0.162 за 1 млн токенов
Выход$0.648 за 1 млн токенов

Поддерживаемые параметры

temperaturemax_tokenstop_ptoolstool_choiceresponse_formatreasoningstop

Характеристики

Дата релиза2025-08-05openai.com ↗проверено
АрхитектураMoE Transformer — 36 слоёв, 128 экспертов, top-4 активны, 116,8B всего / 5,1B активных параметровarxiv.org ↗проверено
ЛицензияApache 2.0openai.com ↗проверено
Дата отсечения знанийИюнь 2024arxiv.org ↗проверено
Токенизаторo200k_harmony (201 088 токенов)arxiv.org ↗проверено
КвантизацияMXFP4 (4,25 бит/параметр на MoE-весах)arxiv.org ↗проверено
Размер контрольной точки60,8 GiBarxiv.org ↗проверено
Вычисления на обучение2,1 млн H100-часовarxiv.org ↗проверено
Режимы рассужденийнизкий / средний / высокий (настраивается через system prompt)openai.com ↗проверено

Бенчмарки

BenchmarkDistributionScoreSource
MMLU
Режим высоких рассуждений
90.0%%arxiv.org ↗
AIME 2024
С инструментами, режим высоких рассуждений
96.6%%arxiv.org ↗
AIME 2025
С инструментами, режим высоких рассуждений
97.9%%arxiv.org ↗
Codeforces Elo
Приблизительный рейтинг Elo; режим высоких рассуждений с инструментом терминала
~2620openai.com ↗
SWE-Bench Verified
Режим высоких рассуждений
62.4%%arxiv.org ↗
GPQA Diamond
С инструментами, режим высоких рассуждений
80.9%%arxiv.org ↗
HLE
С инструментами, режим высоких рассуждений. HLE — чрезвычайно сложный бенчмарк.
19.0%%arxiv.org ↗
HealthBench
Режим высоких рассуждений. Почти достигает o3, превосходит o1, GPT-4o, o3-mini и o4-mini.
57.6%%arxiv.org ↗
HealthBench Hard
Режим высоких рассуждений, сложный поднабор HealthBench
30.0%%arxiv.org ↗
Tau-Bench Retail
Режим высоких рассуждений — оценка агентного вызова функций
67.8%%arxiv.org ↗
MMMLU (Average)
Среднее по 14 языкам, режим высоких рассуждений
81.3%%arxiv.org ↗

Примеры API

Для новых интеграций используйте глобальный endpoint api.therouter.ai из примеров ниже; старый China accelerated endpoint выведен из эксплуатации.

cURL
curl https://api.therouter.ai/v1/chat/completions   -H "Content-Type: application/json"   -H "Authorization: Bearer $THE_ROUTER_API_KEY"   -d '{
    "model": "openai/gpt-oss-120b",
    "messages": [
      {"role": "user", "content": "Summarize the key points from this input."}
    ]
  }'

Chat completion

Используйте стандартный совместимый с OpenAI chat completion через TheRouter. Модель использует формат harmony; TheRouter выполняет преобразование автоматически.

cURL
curl https://api.therouter.ai/v1/chat/completions \
  -H "Authorization: Bearer $THEROUTER_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "openai/gpt-oss-120b",
    "messages": [
      {"role": "user", "content": "Explain the benefits of Mixture-of-Experts architecture in large language models."}
    ]
  }'

Ещё от openai

Похожие модели

Аналоги в других провайдерах

Частые вопросы

Могу ли я использовать GPT OSS 120B через API TheRouter без самостоятельного хостинга?

Да. TheRouter маршрутизирует запросы к gpt-oss-120b через свою управляемую инфраструктуру. Вы получаете модель с открытыми весами через стандартный совместимый с OpenAI API по адресу https://api.therouter.ai/v1, без управления собственным GPU-оборудованием.

переработано TheRouteropenai.com ↗
По какой лицензии распространяется GPT OSS 120B?

Apache 2.0 — разрешительная лицензия, позволяющая коммерческое использование, модификацию, распространение и сублицензирование без ограничений copyleft или патентных рисков.

переработано TheRouteropenai.com ↗
Как GPT OSS 120B сравнивается с GPT-4o?

GPT OSS 120B — это модель с открытыми весами, ориентированная на рассуждения. Она превосходит GPT-4o на бенчмарках по математике (AIME), программированию (Codeforces) и здоровью (HealthBench). Однако GPT-4o — мультимодальная модель (зрение, аудио), тогда как GPT OSS 120B работает только с текстом. Для мультимодальных задач используйте GPT-4o или GPT-4o-mini через TheRouter.

переработано TheRouterarxiv.org ↗
Какое оборудование нужно для самостоятельного хостинга GPT OSS 120B?

Один 80GB GPU, например NVIDIA H100 или AMD MI300X. Квантизированная контрольная точка — 60,8 GiB. Благодаря квантизации MXFP4 и архитектуре MoE на каждый прямой проход активируется всего 5,1 млрд параметров, что позволяет эффективно выполнять инференс на потребительских GPU.

переработано TheRoutergithub.com ↗
Реестр фактов — каждая утверждаемая величина имеет источник
источникURLполучено
Дата релизаopenai.com ↗2026-05-29проверено
Архитектураarxiv.org ↗2026-05-29проверено
Лицензияopenai.com ↗2026-05-29проверено
Дата отсечения знанийarxiv.org ↗2026-05-29проверено
Токенизаторarxiv.org ↗2026-05-29проверено
Квантизацияarxiv.org ↗2026-05-29проверено
Размер контрольной точкиarxiv.org ↗2026-05-29проверено
Вычисления на обучениеarxiv.org ↗2026-05-29проверено
Режимы рассужденийopenai.com ↗2026-05-29проверено
MMLUarxiv.org ↗2026-05-29проверено
AIME 2024arxiv.org ↗2026-05-29проверено
AIME 2025arxiv.org ↗2026-05-29проверено
Codeforces Eloopenai.com ↗2026-05-29к проверке
SWE-Bench Verifiedarxiv.org ↗2026-05-29проверено
GPQA Diamondarxiv.org ↗2026-05-29проверено
HLEarxiv.org ↗2026-05-29проверено
HealthBencharxiv.org ↗2026-05-29проверено
HealthBench Hardarxiv.org ↗2026-05-29проверено
Tau-Bench Retailarxiv.org ↗2026-05-29проверено
MMMLU (Average)arxiv.org ↗2026-05-29проверено
Могу ли я использовать GPT OSS 120B через API TheRouter без самостоятельного хостинга?openai.com ↗2026-05-29к проверке
По какой лицензии распространяется GPT OSS 120B?openai.com ↗2026-05-29к проверке
Как GPT OSS 120B сравнивается с GPT-4o?arxiv.org ↗2026-05-29к проверке
Какое оборудование нужно для самостоятельного хостинга GPT OSS 120B?github.com ↗2026-05-29к проверке
Помощь и контакты