Назад к моделям

MiniMax M2.1 Highspeed — вариант с открытыми весами MiniMax M2.1 (230B всего / 10B активных MoE), оптимизированный для инференса, выдающий примерно 100 токенов в секунду — примерно в 1,6 раза быстрее стандартного M2.1 при удвоенной стоимости за токен. Важно: вариант Highspeed использует те же веса модели, даёт то же качество ответов и поддерживает тот же контекстный окно 204 800 токенов. Прирост скорости полностью обеспечен оптимизациями на уровне инференса: настройкой маршрутизации MoE-экспертов для снижения задержки, более агрессивной пакетной обработкой при конкурентности и улучшениями управления памятью для длинных контекстов.

Для оператора TheRouter M2.1 Highspeed — выбор для чувствительных к задержке сценариев, где нужны возможности M2.1 по кодингу и агентской работе, но задержка видна пользователю: живые ассистенты программирования, real-time чат, стриминг агентских выводов. Через TheRouter модель стоит $0,80/M входных токенов и $3,20/M выходных (в 2 раза дороже стандартного M2.1 за $0,40/$1,60). Используйте стандартный M2.1 для пакетных задач, офлайн-оценки или сценариев, где задержка не видна пользователю; выбирайте Highspeed, когда разница между ~60 tps и ~100 tps превращает «ощущается быстро» в «ощущается как ожидание».

Когда выбирать
  • • Пользовательские живые ассистенты кодинга — ~100 tps позволяет разработчику видеть код по мере генерации, создавая интерактивный парный процесс, недостижимый при ~60 tps стандартного M2.1
  • • Стриминговый чат с агентскими цепочками инструментов — когда модель должна последовательно вызывать несколько инструментов и стримить результаты, Highspeed значительно сокращает время каждого агентского цикла
  • • Высококонкурентные разговорные нагрузки — поддержка клиентов, real-time чат-боты, пайплайны персонализации контента, где сотни одновременных сессий требуют быстрых компетентных ответов
  • • Многошаговые агентские сессии, где кэширование промптов снижает эффективную стоимость — автоматическое кэширование может сократить задержку на кэшированных токенах на 60–80%
Когда не выбирать
  • • Пакетная / офлайн-оценка — то же качество, что у стандартного M2.1, но вдвое дороже; для нечувствительных к задержке задач используйте minimax/m2.1
  • • Нативный мультимодальный ввод — вариант Highspeed наследует ограничение M2.1: только text-in/text-out (без vision). Для изображений/видео/аудио маршрутизируйте на doubao-seed-2.0-vision или gpt-image-1.5
  • • Конкурсная математика — M2.1 набирает 83,0% на AIME25; DeepSeek V3.2 (92,0%), GPT-5.2 thinking (98,0%) и Gemini 3 Pro (96,0%) значительно сильнее в сложной математике
Размер контекста
205K
Максимальный вывод
66K
Цена Входза 1M токенов
$0.648за 1 млн токенов
Цена Выходза 1M токенов
$2.59за 1 млн токенов

Модальности

Текст→Текст

Разбивка цен

ТипСтавка
Вход$0.648 за 1 млн токенов
Выход$2.59 за 1 млн токенов

Поддерживаемые параметры

temperaturemax_tokenstop_ptoolstool_choiceresponse_formatstop

Характеристики

ДоступностьДоступен как MiniMax-M2.1-highspeed на platform.minimax.io и через TheRouter на api.therouter.ai/v1 с model ID minimax/m2.1-highspeedplatform.minimax.io — Supported Models ↗проверено
Скорость вывода~100 токенов/с (официальные данные MiniMax); для сравнения стандартный M2.1 — ~60 tpsplatform.minimax.io — Model Overview ↗проверено
Архитектура230B всего / 10B активных MoE — те же веса, что у стандартного M2.1; отличается только уровень инференса (оптимизированная маршрутизация, пакетная обработка, управление KV-памятью)github.com/MiniMax-AI — M2.1 repository ↗проверено
Контекстное окно204 800 токенов — идентично стандартному M2.1platform.minimax.io ↗проверено
Кэширование промптовПоддерживается автоматическое кэширование — снижает задержку на кэшированных токенах на 60–80% для повторяющихся системных промптовplatform.minimax.io — Model Overview ↗к проверке
ЛицензияТа же Modified-MIT, что у M2.1 (коммерческое использование открытых весов разрешено); Highspeed через API MiniMax или TheRouter — стандартная коммерческая лицензияhuggingface.co/MiniMaxAI ↗к проверке
Поддерживаемые backend инференсаSGLang, vLLM, Transformers, MLX-LM, KTransformers (общие с открытыми весами стандартного M2.1)github.com/MiniMax-AI ↗проверено

Бенчмарки

BenchmarkDistributionScoreSource
SWE-bench Verified
Стабильно на нескольких фреймворках (Claude Code, Droid, mini-SWE-agent) — фреймворк-независимая производительность кодинга
74.0%%minimax.io — official announcement ↗
Multi-SWE-bench
49.4%%minimax.io — official announcement ↗
SWE-bench Multilingual
Rust, Java, Golang, C++, Kotlin, TypeScript, JavaScript, Objective-C
72.5%%minimax.io — official announcement ↗
VIBE (aggregate)
Web 91,5 | Android 89,7 | iOS 88,0 | Simulation 87,1 | Backend 86,7 — сквозное создание приложений с нуля
88.6%%minimax.io — official announcement ↗
Toolathlon
43.5%%minimax.io — official announcement ↗
BrowseComp
47.4%%minimax.io — official announcement ↗
AIME 2025
83.0%%minimax.io — official announcement ↗
MMLU
90.0%%minimax.io — official announcement ↗

Примеры API

Для новых интеграций используйте глобальный endpoint api.therouter.ai из примеров ниже; старый China accelerated endpoint выведен из эксплуатации.

cURL
curl https://api.therouter.ai/v1/chat/completions   -H "Content-Type: application/json"   -H "Authorization: Bearer $THE_ROUTER_API_KEY"   -d '{
    "model": "minimax/m2.1-highspeed",
    "messages": [
      {"role": "user", "content": "Summarize the key points from this input."}
    ]
  }'

Chat completion

Стандартный OpenAI-совместимый chat completion через TheRouter — меняются только baseURL и model.

cURL
curl https://api.therouter.ai/v1/chat/completions \
  -H "Authorization: Bearer $THEROUTER_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "minimax/m2.1-highspeed",
    "messages": [
      {"role": "system", "content": "You are a helpful coding assistant."},
      {"role": "user", "content": "Write a Rust function to parse a CSV line."}
    ],
    "temperature": 0.3,
    "max_tokens": 4096
  }'

Ещё от minimax

Похожие модели

Аналоги в других провайдерах

Новости и изменения

2025-12-23

MiniMax выпускает M2.1 с фокусом на кодинг и вариант Highspeed

MiniMax запустила M2.1 (230B всего / 10B активных MoE) с сильным результатом SWE-bench Verified (74,0%), поддержкой многоязычного программирования и новым API-уровнем Highspeed, обеспечивающим ~100 tps для чувствительных к задержке приложений. Вариант Highspeed использует идентичные веса модели с оптимизациями на уровне инференса.

переработано TheRouterminimax.io — official announcement ↗

Частые вопросы

Отличается ли качество вывода варианта Highspeed от стандартного M2.1?

Нет. Highspeed использует те же самые веса модели (230B всего / 10B активных MoE) и даёт идентичное качество вывода. Прирост скорости полностью обеспечен оптимизациями на уровне инференса: настройкой маршрутизации MoE-экспертов, пакетной обработкой и управлением KV-кэшем. Те же ответы, быстрее.

переработано TheRouterAIMLAPI — MiniMax HighSpeed guide ↗
Когда использовать M2.1 Highspeed vs стандартный M2.1?

Используйте Highspeed, когда задержка видна пользователю — живые ассистенты программирования, real-time чат-боты, стриминг агентских выводов. Используйте стандартный M2.1 (minimax/m2.1) для пакетных задач, офлайн-оценки или сценариев, где разница в ~40 tps не заметна. Удвоенная стоимость Highspeed ($0,80/$3,20 против $0,40/$1,60) делает этот выбор строго компромиссом задержки и цены.

Доступны ли открытые веса для M2.1 Highspeed?

Нет. Вариант Highspeed — это SKU уровня API на платформе MiniMax (и через TheRouter). Основные веса модели идентичны открытым весам M2.1 (лицензия Modified-MIT), но оптимизации инференса, обеспечивающие прирост скорости, являются проприетарной функцией API. Для self-hosting используйте открытые веса стандартного M2.1, достигающие ~60-70 tps на потребительских GPU.

Реестр фактов — каждая утверждаемая величина имеет источник
источникURLполучено
Доступностьplatform.minimax.io — Supported Models ↗2026-05-27проверено
Скорость выводаplatform.minimax.io — Model Overview ↗2026-05-27проверено
Архитектураgithub.com/MiniMax-AI — M2.1 repository ↗2026-05-27проверено
Контекстное окноplatform.minimax.io ↗2026-05-27проверено
Кэширование промптовplatform.minimax.io — Model Overview ↗2026-05-27к проверке
Лицензияhuggingface.co/MiniMaxAI ↗2026-05-27к проверке
Поддерживаемые backend инференсаgithub.com/MiniMax-AI ↗2026-05-27проверено
SWE-bench Verifiedminimax.io — official announcement ↗2026-05-27проверено
Multi-SWE-benchminimax.io — official announcement ↗2026-05-27проверено
SWE-bench Multilingualminimax.io — official announcement ↗2026-05-27проверено
VIBE (aggregate)minimax.io — official announcement ↗2026-05-27проверено
Toolathlonminimax.io — official announcement ↗2026-05-27проверено
BrowseCompminimax.io — official announcement ↗2026-05-27проверено
AIME 2025minimax.io — official announcement ↗2026-05-27проверено
MMLUminimax.io — official announcement ↗2026-05-27к проверке
MiniMax выпускает M2.1 с фокусом на кодинг и вариант Highspeedminimax.io — official announcement ↗2026-05-27проверено
Отличается ли качество вывода варианта Highspeed от стандартного M2.1?AIMLAPI — MiniMax HighSpeed guide ↗2026-05-27к проверке
Помощь и контакты