Назад к моделям

MiniMax M2.5 Highspeed

minimaxminimax/m2.5-highspeed

MiniMax M2.5 Highspeed variant with ~100 tokens/sec output speed. Same capabilities as M2.5 at 2x cost for latency-sensitive applications.

MiniMax M2.5-Highspeed (Lightning-вариант) — высокопроизводительная версия MiniMax M2.5, выпущенная 12 февраля 2026 года. Имеет ту же архитектуру MoE на 230 млрд параметров (10 млрд активных на токен) и ту же RL-тренировку Forge, что и стандартная M2.5, но работает со стабильной скоростью ~100 токенов/с — примерно вдвое быстрее стандартных 50 TPS. На TheRouter цена вдвое выше базовой M2.5 ($0,80/M ввод, $3,20/M вывод), что в точности повторяет официальное ценовое соотношение между M2.5-Lightning и M2.5 от MiniMax.

Этот вариант стоит выбирать, когда сквозная задержка является жёстким ограничением: реальное время для агентов, чат-боты для пользователей или пакетные задачи, чувствительные к пропускной способности, где 100 TPS кардинально улучшает UX. Для оптимизации затрат или непрерывной работы агентов стандартный вариант M2.5 (minimax/m2.5) с 50 TPS за полцены — лучший выбор по умолчанию. По возможностям оба варианта идентичны: те же 80,2% SWE-Bench Verified, те же 76,3% BrowseComp, то же поведение инструментов. Разница только в скорости и цене.

Когда выбирать
  • • Чувствительный к задержкам агентский кодинг — те же 80,2% SWE-Bench Verified при ~100 TPS, что сокращает время выполнения задачи по сравнению со стандартным вариантом. На SWE-Bench Verified это ~15 минут на задачу против 22,8 мин у стандартной версии
  • • Чат-агенты реального времени, где субсекундная задержка первого токена и высокая пропускная способность важнее стоимости
  • • Конвейеры с высокочастотными вызовами инструментов — параллельные вызовы функций, где пропускная способность является узким местом
  • • Те же сильные стороны M2.5 на более высокой скорости: full-stack разработка, мультиязычное программирование (13 языков), офисная продуктивность (Word, PPT, Excel-моделирование с 59,0% побед на GDPval-MM)
Когда не выбирать
  • • Оптимизированная по стоимости непрерывная работа агентов — стандартный вариант M2.5 по $0,40/$1,60 при 50 TPS всё ещё быстр и стоит вдвое меньше. При непрерывной работе на 100 TPS Highspeed обойдётся ~$2/час против ~$1/час у стандартного
  • • Мультимодальные задачи — только текст; нет встроенной поддержки изображений, зрения или аудио. Для скриншотов или диаграмм комбинируйте с моделью зрения
  • • Генерация более 64K токенов — максимальный вывод 65 536 токенов (как у стандартной M2.5). Для более длинных документов используйте чанкинг или модель с большим лимитом вывода
Размер контекста
205K
Максимальный вывод
66K
Цена Входза 1M токенов
$0.648за 1 млн токенов
Цена Выходза 1M токенов
$2.59за 1 млн токенов

Модальности

Текст→Текст

Разбивка цен

ТипСтавка
Вход$0.648 за 1 млн токенов
Выход$2.59 за 1 млн токенов

Поддерживаемые параметры

temperaturemax_tokenstop_ptoolstool_choiceresponse_formatstop

Характеристики

Дата выпуска12 февраля 2026www.minimax.io ↗проверено
Тип вариантаHighspeed / Lightning — идентичен M2.5 по возможностям, 2x пропускная способность (100 TPS), 2x стоимостьwww.minimax.io ↗проверено
АрхитектураMixture of Experts (MoE) — 230B всего / 10B активных на токенwww.minimax.io ↗проверено
Пропускная способность~100 токенов/с (стабильно)www.minimax.io ↗проверено
ЛицензияModified MIT — коммерческое использование разрешено с указанием авторстваgithub.com ↗проверено
RL-фреймворкForge — агентский RL-фреймворк с CISPOwww.minimax.io ↗проверено
Среды обучения200 000+ симулированных реальных средwww.minimax.io ↗проверено
Языки обученияGo, C, C++, TypeScript, Rust, Kotlin, Python, Java, JavaScript, PHP, Lua, Dart, Rubywww.minimax.io ↗проверено

Бенчмарки

BenchmarkDistributionScoreSource
SWE-bench Verified
Тот же результат, что и у стандартного M2.5 — возможности идентичны. На Droid: 79,7% (Opus 4.6: 78,9%), на OpenCode: 76,1% (Opus 4.6: 75,9%). Highspeed-вариант выполняет задачи на ~37% быстрее M2.1; стандартный вариант по скорости сравним с Opus 4.6 (22,8 мин/задача), Highspeed-вариант пропорционально быстрее.
80.2%www.minimax.io ↗
Multi-SWE-bench
Первое место на момент релиза — мультиязычный бенчмарк программной инженерии. Тот же результат, что у стандартного M2.5.
51.3%www.minimax.io ↗
BrowseComp
С включённым управлением контекстом. Тот же результат, что у стандартного M2.5 — возможности идентичны во всех бенчмарках.
76.3%www.minimax.io ↗

Примеры API

Для новых интеграций используйте глобальный endpoint api.therouter.ai из примеров ниже; старый China accelerated endpoint выведен из эксплуатации.

cURL
curl https://api.therouter.ai/v1/chat/completions   -H "Content-Type: application/json"   -H "Authorization: Bearer $THE_ROUTER_API_KEY"   -d '{
    "model": "minimax/m2.5-highspeed",
    "messages": [
      {"role": "user", "content": "Summarize the key points from this input."}
    ]
  }'

Chat completion

M2.5-Highspeed использует тот же OpenAI-совместимый эндпоинт v1/chat/completions, что и любая модель TheRouter. Просто укажите model: minimax/m2.5-highspeed.

cURL
curl https://api.therouter.ai/v1/chat/completions \
  -H "Authorization: Bearer $THEROUTER_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{"model":"minimax/m2.5-highspeed","messages":[{"role":"user","content":"Write a React component for a file uploader with drag-and-drop support."}]}'

Ещё от minimax

Похожие модели

Аналоги в других провайдерах

Новости и изменения

2026-02-12

MiniMax M2.5 выпущен с вариантом Lightning (Highspeed)

MiniMax выпустила M2.5, open-weight frontier-модель с 80,2% SWE-Bench Verified и 51,3% Multi-SWE-Bench. Модель доступна в двух скоростных вариантах: стандартном (50 TPS) и Lightning/Highspeed (100 TPS). Оба варианта имеют одинаковую архитектуру, бенчмарки и возможности — различаются только скорость и цена.

переработано TheRouterminimax.io/news ↗

Частые вопросы

В чём разница между minimax/m2.5 и minimax/m2.5-highspeed?

Оба варианта имеют одинаковую архитектуру, веса и возможности — те же баллы SWE-Bench, то же поведение инструментов, та же длина контекста. Разница только в пропускной способности: M2.5-Highspeed работает со скоростью ~100 токенов/с при 2x цене, а стандартный M2.5 — ~50 токенов/с за полцены. Highspeed выбирайте, когда важна задержка; стандартный — когда важна экономия.

переработано TheRouter
M2.5-Highspeed — это отдельная модель или только скоростной уровень?

MiniMax описывает M2.5-Lightning как ту же модель в более быстром инференс-тире. Оба варианта используют идентичные веса и архитектуру — это не независимо обученные модели. На TheRouter они представлены отдельными slug'ами, поскольку каждый вариант имеет свою цену и пропускную способность, но вывод идентичен при одинаковом входе.

переработано TheRouter
Реестр фактов — каждая утверждаемая величина имеет источник
источникURLполучено
Дата выпускаwww.minimax.io ↗2026-05-27проверено
Тип вариантаwww.minimax.io ↗2026-05-27проверено
Архитектураwww.minimax.io ↗2026-05-27проверено
Пропускная способностьwww.minimax.io ↗2026-05-27проверено
Лицензияgithub.com ↗2026-05-27проверено
RL-фреймворкwww.minimax.io ↗2026-05-27проверено
Среды обученияwww.minimax.io ↗2026-05-27проверено
Языки обученияwww.minimax.io ↗2026-05-27проверено
SWE-bench Verifiedwww.minimax.io ↗2026-05-27проверено
Multi-SWE-benchwww.minimax.io ↗2026-05-27проверено
BrowseCompwww.minimax.io ↗2026-05-27проверено
MiniMax M2.5 выпущен с вариантом Lightning (Highspeed)minimax.io/news ↗2026-05-27проверено
Помощь и контакты