Назад к моделям

Grok 4.20

xaixai/grok-4.20-non-reasoning

xAI's flagship model (March 2026) with 2M token context window. Fast general-purpose mode without reasoning overhead, supporting text and image inputs with function calling and structured outputs.

Grok 4.20 Non-Reasoning — низколатентный вариант поколения Grok 4.20 Beta от xAI, выпущенный через xAI API в марте 2026 года. Он использует те же базовые веса модели, что и вариант с рассуждением, но намеренно пропускает расширенный шаг цепочки мыслей (CoT), жертвуя глубоким многошаговым рассуждением ради значительно меньшего времени до первого токена и более высокой пропускной способности. Модель сохраняет контекстное окно в 2 миллиона токенов — наибольшее в семействе Grok 4.20 — и принимает как текстовый, так и визуальный ввод.

С точки зрения маршрутизации TheRouter, xai/grok-4.20-non-reasoning привязан к закреплённому слагу API grok-4.20-0309-non-reasoning. Поколение Grok 4.20 находится между оригинальным Grok 4 (июль 2025, 256K контекст) и текущим флагманом Grok 4.3 (апрель 2026, 1M контекст, всегда включённое рассуждение). По состоянию на июнь 2026 года варианты Grok 4.20 остаются активными и доступными в xAI API, хотя xAI теперь рекомендует Grok 4.3 для новых интеграций чата и кодирования. Режим без рассуждений подходит, когда задержка ответа важнее глубины рассуждений — автоматизированные конвейеры, высокообъёмная пакетная обработка или циклы вызова инструментов, где модель является одним шагом в более широком рабочем процессе.

Поколение Grok 4.20 Beta запустилось с четырьмя параллельными моделями API: стандартный grok-4.20-beta (сбалансированный), grok-4.20-0309-non-reasoning (скорость), grok-4.20-0309-reasoning (глубина) и grok-4.20-multi-agent-0309 (надёжность через четыре параллельных агента). Все четыре делят одинаковое ценообразование $2/$6 за 1M токенов при запуске и одинаковое контекстное окно в 2M токенов. Бенчмарки сообщества (Artificial Analysis, июнь 2026) показывают, что вариант без рассуждений набирает значительно меньше, чем вариант с рассуждением, на бенчмарках интеллекта (AA Intelligence Index 29,7 против более высокого показателя варианта с рассуждением), но обеспечивает примерно 200 токенов в секунду — сопоставимо с исходной пропускной способностью варианта с рассуждением, если не считать время ожидания рассуждения.

Когда выбирать
  • • Высокопроизводительные агентные конвейеры — рассуждение пропускается, поэтому модель выступает быстрым узлом вызова функций; идеально, когда оркестратор управляет логикой, а модель обрабатывает диспетчеризацию инструментов и генерацию текста
  • • Чувствительные к задержке диалоговые интерфейсы — TTFT ниже по сравнению с вариантом с рассуждением; подходит для чат-приложений, где ожидание нескольких секунд для рассуждения неприемлемо
  • • Обработка длинных документов — окно в 2M токенов вмещает целые кодовые базы, обширные наборы контрактов или расширенные транскрипты; хорошо сочетается со структурированным выводом для задач извлечения
  • • Пакетная классификация и извлечение в масштабе — отсутствие накладных расходов на рассуждение делает стоимость предсказуемой; подходит для классификации, извлечения сущностей и шаблонных преобразований, выполняемых с высоким объёмом
  • • Вызов инструментов в многошаговых рабочих процессах, где рассуждение обеспечивает другая модель — вариант без рассуждений служит надёжным исполнителем для диспетчеризации инструментов и форматирования результатов; дешевле, чем держать модель с рассуждением активной на каждом шаге
Когда не выбирать
  • • Сложные многошаговые задачи рассуждений — без цепочки мыслей производительность на сложных математических, научных и олимпиадных задачах резко падает; вместо этого используйте xai/grok-4.20-reasoning или xai/grok-4.3
  • • Задачи, для которых существует вариант с рассуждением по той же цене — при одинаковых ценах в списке xAI ($2/$6 за 1M), большинство задач выигрывают от включения рассуждения; вариант без рассуждений предпочтителен только тогда, когда ограничивающим фактором является задержка или стоимость шага в более крупном конвейере
  • • Случаи, требующие последнего поколения xAI — Grok 4.3 (апрель 2026, 1M контекст, всегда включённое рассуждение, нативное видео, $1,25/$2,50 за 1M) — текущий флагман xAI, теперь рекомендованный для всех новых интеграций чата и кодирования
  • • Запросы, требующие видео или аудио модальности — Grok 4.20 Non-Reasoning принимает только текст и изображения; нативный видеоввод был введён в Grok 4.3; для аудио требуется отдельный Voice API xAI

Чем обслуживание в TheRouter отличается от вендорского

Как её эксплуатирует вендор

xAI предоставляет grok-4.20-0309-non-reasoning как нативную модель xAI API с ценовыми уровнями xAI, лимитами xAI и документированным ограничением: logprobs/top_logprobs silently ignored для Grok 4.20 и новее.

На TheRouter

TheRouter обслуживает закреплённый маршрут xai/grok-4.20-non-reasoning через OpenAI-compatible chat endpoint с ценами и routing-метаданными TheRouter; endpoints для media generation, audio и embeddings для этой модели не предоставляются.

Размер контекста
2M
Максимальный вывод
66K
Цена Входза 1M токенов
$1.35за 1 млн токенов
Цена Выходза 1M токенов
$2.70за 1 млн токенов

Модальности

ТекстИзображение→Текст

Возможности

Зрение

Разбивка цен

ТипСтавка
Вход$1.35 за 1 млн токенов
Выход$2.70 за 1 млн токенов

Поддерживаемые параметры

temperaturemax_tokenstop_ptoolstool_choiceresponse_formatstop

Характеристики

Дата выпуска (публичный API)2026-03-09 / 2026-03-10неизвестно
Слаг модели API (закреплённый)grok-4.20-0309-non-reasoningdocs.x.ai ↗проверено
Режим рассужденияОтключён (без цепочки мыслей; для CoT используйте xai/grok-4.20-reasoning)проверено
Контекстное окно2 000 000 токеновdocs.x.ai ↗проверено
Максимум токенов завершения65 536 токеновпроверено
Модальности вводаТекст, изображение (jpg/png, до 20 МиБ на изображение)docs.x.ai ↗проверено
Модальности выводаТекстпроверено
Цены xAI API (текущие)$1,25 ввод / $2,50 вывод за 1M токенов (по состоянию на июнь 2026; TheRouter может применять наценку)docs.x.ai ↗проверено
Вызов функций / инструментыПоддерживаетсяпроверено
Структурированные выводы (response_format)Поддерживается (режим JSON)проверено
logprobs / top_logprobsНе поддерживается — для grok-4.20 и новее игнорируются без ошибки (API принимает, но не возвращает пословные логарифмические вероятности)docs.x.ai ↗проверено
Дата отсечки знанийНе раскрывается публично (в метаданных некоторых агрегаторов указано 'март 2026')неизвестно
ЛицензияПроприетарнаяпроверено
Лимиты запросов (xAI API)1 800 запросов/мин · 10 000 000 токенов/минdocs.x.ai ↗проверено

Бенчмарки

BenchmarkDistributionScoreSource
AA Intelligence Index
Публичная документация моделей xAI не раскрывает этот бенчмарк для grok-4.20-0309-non-reasoning. Оставляйте строку unknown, пока xAI не опубликует официальное значение.
—Не раскрыто—
AA Coding Index
—Не раскрыто—
AA Agentic Index
—Не раскрыто—
GPQA Diamond
Публичная документация моделей xAI не раскрывает этот бенчмарк для grok-4.20-0309-non-reasoning. Оставляйте строку unknown, пока xAI не опубликует официальное значение.
—Не раскрыто—
HLE (Humanity's Last Exam)
—Не раскрыто—
SciCode
Публичная документация моделей xAI не раскрывает этот бенчмарк для grok-4.20-0309-non-reasoning. Оставляйте строку unknown, пока xAI не опубликует официальное значение.
—Не раскрыто—
τ²-Bench (Telecom)
Публичная документация моделей xAI не раскрывает этот бенчмарк для grok-4.20-0309-non-reasoning. Оставляйте строку unknown, пока xAI не опубликует официальное значение.
—Не раскрыто—
IFBench (Instruction Following)
—Не раскрыто—
AA-LCR (Long-Context Reasoning)
Публичная документация моделей xAI не раскрывает этот бенчмарк для grok-4.20-0309-non-reasoning. Оставляйте строку unknown, пока xAI не опубликует официальное значение.
—Не раскрыто—
TerminalBench Hard
Публичная документация моделей xAI не раскрывает этот бенчмарк для grok-4.20-0309-non-reasoning. Оставляйте строку unknown, пока xAI не опубликует официальное значение.
—Не раскрыто—

Примеры API

Для новых интеграций используйте глобальный endpoint api.therouter.ai из примеров ниже; старый China accelerated endpoint выведен из эксплуатации.

cURL
curl https://api.therouter.ai/v1/chat/completions   -H "Content-Type: application/json"   -H "Authorization: Bearer $THE_ROUTER_API_KEY"   -d '{
    "model": "xai/grok-4.20-non-reasoning",
    "messages": [
      {"role": "user", "content": "Summarize the key points from this input."}
    ]
  }'

Chat completion

cURL
curl https://api.therouter.ai/v1/chat/completions \
  -H "Authorization: Bearer $THEROUTER_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "xai/grok-4.20-non-reasoning",
    "messages": [{"role": "user", "content": "Summarise the key points in the following document:"}]
  }'

Ещё от xai

Похожие модели

Аналоги в других провайдерах

Новости и изменения

2026-03-10

Grok 4.20 Beta запускается с четырьмя вариантами API, включая режим без рассуждений

xAI выпустила поколение Grok 4.20 Beta в публичный API 9–10 марта 2026 года, представив четыре параллельных варианта: стандартный grok-4.20-beta, вариант скорости без рассуждений (grok-4.20-0309-non-reasoning), вариант с глубоким рассуждением (grok-4.20-0309-reasoning) и вариант для многоагентного взаимодействия (grok-4.20-multi-agent-0309). Все четыре делят контекстное окно в 2M токенов — наибольшее среди западных frontier-моделей на тот момент — и одинаковые цены $2/$6 за 1M токенов. Режим без рассуждений ориентирован на автоматизированные конвейеры и рабочие процессы с вызовом инструментов, где задержка важнее глубины рассуждений.

переработано TheRoutergrokipedia.com ↗

Частые вопросы

В чём разница между grok-4.20-non-reasoning и grok-4.20-reasoning?

Оба варианта используют одни и те же базовые веса модели Grok 4.20. Вариант без рассуждений (grok-4.20-0309-non-reasoning) полностью пропускает шаг цепочки мыслей, обеспечивая меньшую задержку и пропускную способность около 200 токенов/сек. Вариант с рассуждением (grok-4.20-0309-reasoning) активирует расширенную цепочку мыслей перед генерацией окончательного ответа, что значительно улучшает производительность на сложных математических, научных и многошаговых логических задачах ценой большего времени до первого токена. Разрыв в бенчмарках велик: вариант без рассуждений набирает 29,7 балла по AA Intelligence Index против более высокого показателя у варианта с рассуждением. При одинаковых ценах в списке xAI ($2/$6 за 1M токенов при запуске), вариант без рассуждений лучше всего подходит для нагрузок, где ограничивающим фактором является задержка — автоматизированные конвейеры, диспетчеризация инструментов, высокообъёмное извлечение — а не максимальное качество каждого ответа.

переработано TheRouter
Режим без рассуждений дешевле режима с рассуждением?

По ценам списка xAI оба варианта стоят одинаково за входной и выходной токен ($2/$6 за 1M токенов при запуске; xAI обновила оба до $1,25/$2,50 в июне 2026 года). В чувствительных к задержке конвейерах режим без рассуждений фактически дешевле на выполненную задачу, поскольку производит меньше токенов в сумме (токены рассуждений не тарифицируются) и завершается быстрее, сокращая реальное время. В пакетных нагрузках оба режима поддерживают 50% скидки на пакетную обработку в xAI API. Проверьте страницу цен TheRouter для текущих применяемых наценок.

переработано TheRouter
Когда использовать Grok 4.20 Non-Reasoning вместо Grok 4.3?

Grok 4.3 (апрель 2026) — текущая рекомендованная xAI модель для всех новых интеграций. Она имеет всегда включённое рассуждение, контекст 1M токенов, нативный видеоввод и более низкую цену ($1,25/$2,50 за 1M по ценам списка xAI). Для большинства новых нагрузок xai/grok-4.3 — лучший выбор. Вариант Grok 4.20 Non-Reasoning может по-прежнему предпочтительнее, если у вас есть существующая интеграция, полагающаяся на контекстное окно в 2M токенов (у 4.3 — 1M), или если ваш конвейер специально выигрывает от профиля задержки без рассуждений Grok 4.20 и вам нужен закреплённый стабильный слаг модели, который не будет обновляться.

переработано TheRouter
Реестр фактов — каждая утверждаемая величина имеет источник
источникURLполучено
Дата выпуска (публичный API)——неизвестно
Слаг модели API (закреплённый)docs.x.ai ↗2026-06-09проверено
Режим рассуждения——проверено
Контекстное окноdocs.x.ai ↗2026-06-09проверено
Максимум токенов завершения——проверено
Модальности вводаdocs.x.ai ↗2026-06-09проверено
Модальности вывода——проверено
Цены xAI API (текущие)docs.x.ai ↗2026-06-09проверено
Вызов функций / инструменты——проверено
Структурированные выводы (response_format)——проверено
logprobs / top_logprobsdocs.x.ai ↗2026-06-09проверено
Дата отсечки знаний——неизвестно
Лицензия——проверено
Лимиты запросов (xAI API)docs.x.ai ↗2026-06-09проверено
AA Intelligence Indexdocs.x.ai ↗2026-08-01неизвестно
AA Coding Indexdocs.x.ai ↗2026-08-01неизвестно
AA Agentic Indexdocs.x.ai ↗2026-08-01неизвестно
GPQA Diamonddocs.x.ai ↗2026-08-01неизвестно
HLE (Humanity's Last Exam)docs.x.ai ↗2026-08-01неизвестно
SciCodedocs.x.ai ↗2026-08-01неизвестно
τ²-Bench (Telecom)docs.x.ai ↗2026-08-01неизвестно
IFBench (Instruction Following)docs.x.ai ↗2026-08-01неизвестно
AA-LCR (Long-Context Reasoning)docs.x.ai ↗2026-08-01неизвестно
TerminalBench Harddocs.x.ai ↗2026-08-01неизвестно
Grok 4.20 Beta запускается с четырьмя вариантами API, включая режим без рассужденийgrokipedia.com ↗2026-06-09проверено
Помощь и контакты