Назад к моделям

Qwen Max

qwenqwen/qwen-max

Прошлый флагман Qwen — всё ещё силён в reasoning и tool use.

qwen-max — флагман предыдущего поколения серии Qwen. Даже после релиза Qwen3 он остаётся уместным выбором для reasoning-нагруженных чатов, структурированного вывода и function-calling-нагрузок, а 128K контекста спокойно держит длинные документы.

Берите его, когда нужна флагманская модель по предсказуемой цене и Qwen3-уровень кодинга или 256K у qwen3-max не оправданы. TheRouter на каждый запрос выбирает более дешёвый из bailian-cn / bailian-sg.

Сильный reasoning
Уверенный chain-of-thought, математика и многошаговый tool use от прошлого флагмана Qwen.
128K context
Анализ длинных документов, большие code review и расширенные истории агента укладываются в один вызов.
Function calling
Нативные tool / function calling с OpenAI-совместимыми схемами — обёрточный SDK не нужен.
Двухрегиональная маршрутизация
Селектор выбирает bailian-cn или bailian-sg по стоимости запроса — failover автоматический.
Когда выбирать
Reasoning, структурированный вывод и tool-use задачи, где нужен флагман Qwen по стабильной цене и переплата за qwen3-max не оправдана.
Когда не выбирать
Если нужен абсолютный топ Qwen по кодингу или 256K контекста — переходите на qwen3-max. Для массового дешёвого чата — на qwen-plus / qwen-turbo.
Тарификация: $2.00 input / $8.00 output per MTok. TheRouter выбирает более дешёвый регион — bailian-cn или bailian-sg — на запрос.
Размер контекста
131K
Максимальный вывод
33K
Цена Входза 1M токенов
$1.73за 1 млн токенов
Цена Выходза 1M токенов
$6.91за 1 млн токенов

Модальности

Текст→Текст

Разбивка цен

ТипСтавка
Вход$1.73 за 1 млн токенов
Выход$6.91 за 1 млн токенов

Поддерживаемые параметры

temperaturemax_tokenstop_ptoolstool_choiceresponse_formatstop

Характеристики

АрхитектураКрупномасштабная Mixture-of-Experts (MoE) — точное число активных/общих параметров не раскрытоqwenlm.github.io ↗к проверке
Данные предобученияБолее 20 триллионов токеновqwenlm.github.io ↗проверено
Пост-обучениеSupervised Fine-Tuning (SFT) + Reinforcement Learning from Human Feedback (RLHF)qwenlm.github.io ↗проверено
Дата доступности API (Qwen2.5-Max)28 января 2025 года (фиксированный алиас: qwen-max-2025-01-25)qwenlm.github.io ↗проверено
Режим мышленияНе поддерживается — это поколение предшествует hybrid thinking API Qwen3. Для thinking mode используйте qwen/qwen3-32b или новее.проверено
ЛицензияПроприетарная (closed-weight, только API)проверено
Статус жизненного циклаLegacy — Alibaba классифицирует qwen-max как legacy endpoint; новые проекты должны использовать Qwen3.xhelp.aliyun.com ↗проверено

Бенчмарки

BenchmarkDistributionScoreSource
Arena-Hard
По данным официального блога Qwen2.5-Max, при запуске модель превзошла DeepSeek V3, GPT-4o и Claude-3.5-Sonnet на Arena-Hard. Точный числовой балл не указан.
SOTA at launch (Jan 2025)rankqwenlm.github.io ↗
LiveCodeBench
При запуске Qwen2.5-Max превзошла DeepSeek V3 на LiveCodeBench. Конкретный pass@1 score в официальном блоге не указан.
Above DeepSeek V3 at launchrankqwenlm.github.io ↗
GPQA-Diamond
При запуске Qwen2.5-Max превзошла DeepSeek V3 на GPQA-Diamond. Точный балл не опубликован в официальном блоге.
Above DeepSeek V3 at launchrankqwenlm.github.io ↗

Примеры API

Для новых интеграций используйте глобальный endpoint api.therouter.ai из примеров ниже; старый China accelerated endpoint выведен из эксплуатации.

cURL
curl https://api.therouter.ai/v1/chat/completions   -H "Content-Type: application/json"   -H "Authorization: Bearer $THE_ROUTER_API_KEY"   -d '{
    "model": "qwen/qwen-max",
    "messages": [
      {"role": "user", "content": "Summarize the key points from this input."}
    ]
  }'

Chat completion

Стандартные OpenAI-совместимые chat completions. Если строите что-то новое, рассмотрите qwen/qwen3-32b — тот же провайдер, активное поколение, с опциональным thinking mode.

cURL
curl https://api.therouter.ai/v1/chat/completions \
  -H "Authorization: Bearer $THEROUTER_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "qwen/qwen-max",
    "messages": [
      {"role": "user", "content": "Summarize the key capabilities of Qwen2.5-Max."}
    ],
    "temperature": 0.7,
    "max_tokens": 1024
  }'

Ещё от qwen

Похожие модели

Аналоги в других провайдерах

Новости и изменения

2025-01-28

Qwen2.5-Max запускается как qwen-max API alias, превосходя DeepSeek V3 при запуске

Alibaba выпустила Qwen2.5-Max через алиас qwen-max в DashScope, сообщив о победах над DeepSeek V3 на Arena-Hard, LiveBench, LiveCodeBench и GPQA-Diamond. Модель — крупномасштабная MoE, предобученная на более 20 триллионах токенов с SFT и RLHF пост-тренингом.

переработано TheRouterQwen blog ↗

Частые вопросы

Что такое qwen/qwen-max в TheRouter?

qwen-max — плавающий коммерческий алиас на Alibaba DashScope, с января 2025 года указывающий на Qwen2.5-Max, крупномасштабную MoE-модель. Alibaba теперь классифицирует его как legacy endpoint; текущие рекомендуемые модели — из семейства Qwen3.x.

Стоит ли использовать qwen/qwen-max для нового проекта?

Нет. Используйте qwen/qwen3-32b для balanced general tasks, qwen/qwen3-coder-480b для coding agents или qwen/qwen3-235b для highest-quality reasoning. qwen-max лучше оставить командам с существующими интеграциями, которые ещё не готовы к миграции.

Поддерживает ли qwen/qwen-max thinking mode?

Нет. qwen-max предшествует hybrid thinking API Qwen3 и не поддерживает параметр reasoning. Для thinking-mode reasoning используйте qwen/qwen3-32b или qwen/qwen3-235b.

Как соотносится цена qwen/qwen-max с моделями Qwen3?

qwen/qwen-max стоит $2.00/MTok input и $8.00/MTok output в TheRouter. qwen/qwen3-32b стоит дешевле и предлагает hybrid thinking mode и 131K context window — более выгодный вариант для большинства новых нагрузок.

Реестр фактов — каждая утверждаемая величина имеет источник
источникURLполучено
Архитектураqwenlm.github.io ↗2026-06-10к проверке
Данные предобученияqwenlm.github.io ↗2026-06-10проверено
Пост-обучениеqwenlm.github.io ↗2026-06-10проверено
Дата доступности API (Qwen2.5-Max)qwenlm.github.io ↗2026-06-10проверено
Режим мышления——проверено
Лицензия——проверено
Статус жизненного циклаhelp.aliyun.com ↗2026-06-10проверено
Arena-Hardqwenlm.github.io ↗2026-06-10к проверке
LiveCodeBenchqwenlm.github.io ↗2026-06-10к проверке
GPQA-Diamondqwenlm.github.io ↗2026-06-10к проверке
Qwen2.5-Max запускается как qwen-max API alias, превосходя DeepSeek V3 при запускеQwen blog ↗2026-06-10проверено
Помощь и контакты