Назад к моделям

Qwen Plus

qwenqwen/qwen-plus

Средний уровень Qwen — режимы thinking / non-thinking и контекст 1M.

Чем обслуживание в TheRouter отличается от вендорского

Как её эксплуатирует вендор

Alibaba документирует семейство qwen-plus в Bailian с контекстом 1M, поддержкой thinking mode, function calling, built-in tools и structured output. Upstream OpenAI-compatible пример thinking использует нестандартный флаг enable_thinking в extra_body.

На TheRouter

TheRouter обслуживает модель как qwen/qwen-plus на OpenAI-compatible chat route с catalog context 1 048 576, max output 32 768 и supported parameters, включая tools, tool_choice, response_format, reasoning и stop. Поэтому reference берёт Alibaba 1M и feature table как upstream authority, но явно указывает parameter spelling и catalog limits TheRouter.

qwen-plus — рабочая лошадка коммерческой линейки Qwen3. Поддерживает два режима — быстрый `enable_thinking: false` для повседневного чата и более глубокий `enable_thinking: true`, который для сложных задач возвращает `reasoning_content` рядом с финальным ответом, — за долю цены флагмана.

Окно контекста 1M делает её сильным дефолтом для Q&A по длинным документам, чтения многофайлового кода и длинных диалогов агента. TheRouter на каждый запрос выбирает более дешёвый из bailian-cn / bailian-sg; `enable_thinking` и `reasoning_content` транзитятся в обе стороны без изменений.

Thinking + non-thinking
Переключайте `enable_thinking` на запрос. При значении true модель отдаёт `reasoning_content` рядом с финальным ответом.
Контекст 1M
Одно из самых больших коммерческих окон Qwen — идеально для целых документов и мультифайловых сценариев.
Сбалансированная цена
$0.50 input / $1.50 output per MTok. ~5× дешевле qwen-max на входе и ~5.3× — на выходе.
Двухрегиональная маршрутизация
Селектор на каждый запрос выбирает более дешёвый регион — bailian-cn или bailian-sg — без региональной логики на клиенте.
Когда выбирать
Дефолтная Qwen-модель в проде: Q&A по длинным документам, многошаговые агенты, чтение кода и чат, где нужен опциональный глубокий reasoning без флагманского ценника.
Когда не выбирать
Если нужен топ Qwen по reasoning или кодингу — поднимайтесь до qwen3-max / qwen3-coder-plus. Для высокопроизводительного дешёвого чата — qwen-turbo или qwen-flash.
Тарификация: $0.50 input / $1.50 output per MTok. TheRouter выбирает более дешёвый из bailian-cn / bailian-sg на каждый запрос. Режим thinking цену не меняет.
Размер контекста
1.0M
Максимальный вывод
33K
Цена Входза 1M токенов
$0.432за 1 млн токенов
Цена Выходза 1M токенов
$1.30за 1 млн токенов

Модальности

Текст→Текст

Разбивка цен

ТипСтавка
Вход$0.432 за 1 млн токенов
Выход$1.30 за 1 млн токенов

Поддерживаемые параметры

temperaturemax_tokenstop_ptoolstool_choiceresponse_formatreasoningstop

Характеристики

Длина контекста1 048 576 токенов в каталоге TheRouter; Alibaba документирует контекст семейства qwen-plus как 1Mhelp.aliyun.com ↗проверено
Максимальный вывод32 768 токенов в каталоге TheRouterпроверено
Thinking modeПоддерживается upstream для семейства qwen-plus; OpenAI-compatible вызовы upstream используют enable_thinking, а TheRouter предоставляет параметр reasoninghelp.aliyun.com ↗проверено
Function calling и toolsГайд Alibaba по text generation указывает function calling для всех general models и built-in tools для Plus-tier Qwen recommendationshelp.aliyun.com ↗проверено
Structured outputПоддерживается для маршрутов семейства qwen-plus в capability tables Alibaba и предоставляется TheRouter как response_formathelp.aliyun.com ↗проверено
МодальностиТекстовый ввод → текстовый выводhelp.aliyun.com ↗проверено

Бенчмарки

BenchmarkDistributionScoreSource
Public Plus-tier benchmark table
Гайд Alibaba по text generation рекомендует Plus-tier Qwen как баланс качества и цены, но полученная публичная страница не публикует числовую benchmark table для alias `qwen-plus`.
—Не раскрыто—
Thinking-mode benchmark
Документация deep-thinking объясняет включение thinking и перечисляет поддержку семейства qwen-plus, но не публикует reasoning scores для qwen-plus.
—Не раскрыто—
TheRouter latency / throughput benchmark
Публичного TTFT или throughput measurement для маршрута TheRouter `qwen/qwen-plus` нет. Перед production SLO измерьте режимы thinking on и off.
—Не раскрыто—

Примеры API

Для новых интеграций используйте глобальный endpoint api.therouter.ai из примеров ниже; старый China accelerated endpoint выведен из эксплуатации.

cURL
curl https://api.therouter.ai/v1/chat/completions   -H "Content-Type: application/json"   -H "Authorization: Bearer $THE_ROUTER_API_KEY"   -d '{
    "model": "qwen/qwen-plus",
    "messages": [
      {"role": "user", "content": "Summarize the key points from this input."}
    ]
  }'

Chat completion

Используйте OpenAI-compatible chat endpoint для дефолтного non-thinking path. Добавляйте reasoning только после проверки, как ваш SDK сериализует vendor-specific options.

cURL
curl https://api.therouter.ai/v1/chat/completions \
  -H "Authorization: Bearer $THEROUTER_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{"model":"qwen/qwen-plus","messages":[{"role":"user","content":"Summarize this customer feedback in three bullets."}],"max_tokens":600}'

Ещё от qwen

Похожие модели

Аналоги в других провайдерах

Новости и изменения

2026-08-02

Гайд Alibaba по text generation позиционирует Plus-tier Qwen как balanced default

Актуальный Model Studio guide рекомендует Plus-tier Qwen для office work, chatbots, content generation, document processing и agent/coding workflows, которым нужны 1M context, tools и balanced cost. Unsuffixed route qwen-plus остаётся в legacy Qwen aliases с теми же broad capability columns.

переработано TheRouterhelp.aliyun.com ↗

Частые вопросы

Что такое qwen/qwen-plus в TheRouter?

Это OpenAI-compatible route TheRouter для commercial alias qwen-plus в Alibaba Bailian: text-in/text-out модель с контекстом класса 1M, max output 32K, function calling, structured output и optional reasoning support в каталоге.

Поддерживает ли qwen-plus thinking mode?

Да. Документация Alibaba deep-thinking перечисляет модели семейства qwen-plus среди hybrid-thinking routes. Upstream examples используют enable_thinking; TheRouter предоставляет reasoning, поэтому проверьте точный request body вашего SDK перед тем, как считать reasoning traces стабильным contract.

Когда выбирать qwen-plus вместо qwen-long?

Выбирайте qwen-plus для обычного production chat, agents, structured output и document tasks, помещающихся в 1M токенов. qwen-long выбирайте только когда bottleneck — context size и вы принимаете более узкий long-document route.

qwen-plus — fixed checkpoint Qwen3.7?

Нет. Public route — unsuffixed commercial alias. Alibaba отдельно перечисляет dated Plus snapshots, включая Qwen3.7 Plus и старые qwen-plus snapshots, поэтому version-specific regressions или benchmark claims стоит закреплять на snapshot route, когда он доступен.

Реестр фактов — каждая утверждаемая величина имеет источник
источникURLполучено
Длина контекстаhelp.aliyun.com ↗2026-08-02проверено
Максимальный вывод——проверено
Thinking modehelp.aliyun.com ↗2026-08-02проверено
Function calling и toolshelp.aliyun.com ↗2026-08-02проверено
Structured outputhelp.aliyun.com ↗2026-08-02проверено
Модальностиhelp.aliyun.com ↗2026-08-02проверено
Public Plus-tier benchmark tablehelp.aliyun.com ↗2026-08-02неизвестно
Thinking-mode benchmarkhelp.aliyun.com ↗2026-08-02неизвестно
TheRouter latency / throughput benchmarkhelp.aliyun.com ↗2026-08-02неизвестно
Гайд Alibaba по text generation позиционирует Plus-tier Qwen как balanced defaulthelp.aliyun.com ↗2026-08-02проверено
Что такое qwen/qwen-plus в TheRouter?help.aliyun.com ↗2026-08-02к проверке
Поддерживает ли qwen-plus thinking mode?help.aliyun.com ↗2026-08-02к проверке
Когда выбирать qwen-plus вместо qwen-long?help.aliyun.com ↗2026-08-02к проверке
qwen-plus — fixed checkpoint Qwen3.7?help.aliyun.com ↗2026-08-02к проверке
Помощь и контакты