Назад к моделям

Qwen3 235B

qwenqwen/qwen3-235b

Alibaba's flagship Qwen3 model (235B total, 22B active, 128 experts, 8 active per token MoE). Dual thinking/non-thinking mode, strong reasoning, tools, and 100+ language support.

Qwen3-235B-A22B — флагманская open-weight модель Alibaba Qwen, выпущенная 28 апреля 2025 года в составе семейства Qwen3. Это архитектура Mixture-of-Experts (MoE) с 235 млрд общих параметров и 22 млрд активируемых на один forward pass — обеспечивая глубину рассуждений frontier large model при стоимости инференса ~22B dense модели. Архитектура: 94 слоя трансформера, 128 экспертов всего с 8 активируемыми на токен, GQA attention (64Q / 4KV), предобучение на ~36 трлн токенов в 119 языках и диалектах. Ключевая инновация — единая гибридная система мышления: одна модель переключается между режимом thinking (пошаговые цепочки мыслей) и non-thinking (прямые, низколатентные ответы) через флаг enable_thinking или префиксы /think / /no_think.

Для пользователей TheRouter Qwen3-235B — рекомендованный выбор, когда максимальное качество важнее всего: frontier-level математика и кодирование, сложные agentic workflows и мультиязычные задачи на 119 языках. Он сопоставим или превосходит DeepSeek-R1, o1 и Gemini-2.5-Pro на ключевых бенчмарках — 85,7 на AIME'24, 81,5 на AIME'25, 70,7 на LiveCodeBench v5. Поскольку на каждом шаге инференса активны только 22B параметров, он значительно экономичнее dense-моделей аналогичного уровня качества. Non-thinking mode обеспечивает скорость и лаконичность класса Qwen2.5-Instruct; thinking mode добавляет глубокие рассуждения для сложных задач без необходимости отдельной модели.

Когда выбирать
  • • Frontier математика и соревновательные рассуждения — 85,7 AIME'24, 81,5 AIME'25 в thinking mode; go-to модель для олимпийской математики, формальных доказательств и quantitative reasoning пайплайнов
  • • Сложное кодирование и программная инженерия — 70,7 на LiveCodeBench v5 и 2056 на CodeForces в thinking mode; идеально для разработки алгоритмов, code review, рефакторинга и многофайловых agentic задач
  • • Agentic workflows с использованием инструментов — 70,8 на BFCL v3; модель оптимизирована для многошагового tool calling и MCP-совместимых agent chains в обоих режимах
  • • Многоязычные задачи в масштабе — нативная поддержка 119 языков и диалектов; сильный в многоязычном следовании инструкциям, переводе и кросс-языковых рассуждениях без смены модели
  • • Творческое письмо, ролевые игры и многоходовые диалоги — non-thinking mode обеспечивает разговорное качество класса Qwen2.5; thinking mode позволяет более богатое нарративное планирование для long-form задач
Когда не выбирать
  • • Низколатентные, высокопропускные текстовые задачи — MoE-маршрутизация и большое число параметров увеличивают latency на токен по сравнению с меньшими dense моделями; предпочитайте qwen/qwen3-32b или qwen/qwen3-30b-a3b, когда скорость важнее пикового качества
  • • Визуальные или аудиовходы — Qwen3-235B — это text-only модель; для понимания изображений или видео используйте qwen/qwen3-vl-32b или qwen/qwen3-vl-235b
  • • Cost-sensitive batch jobs — при ценообразовании frontier качества, высокообъёмные batch нагрузки лучше обслуживает qwen/qwen3-30b-a3b (3B active, значительно дешевле), когда требования к качеству позволяют
Размер контекста
131K
Максимальный вывод
33K
Цена Входза 1M токенов
$0.756за 1 млн токенов
Цена Выходза 1M токенов
$3.02за 1 млн токенов

Модальности

Текст→Текст

Разбивка цен

ТипСтавка
Вход$0.756 за 1 млн токенов
Выход$3.02 за 1 млн токенов

Поддерживаемые параметры

temperaturemax_tokenstop_ptoolstool_choiceresponse_formatreasoningstop

Характеристики

Дата релиза2025-04-28qwenlm.github.io ↗проверено
АрхитектураMixture-of-Experts (MoE); 235B общих параметров, 22B активируемых на токен; 94 слоя; 128 экспертов / 8 активируемых; GQA (64Q / 4KV головы)huggingface.co ↗проверено
Нативный контекст32 768 токенов нативно; расширяемый до 131 072 токенов с YaRNhuggingface.co ↗проверено
Режимы мышленияГибридный: thinking mode (цепочка мыслей, enable_thinking=True) и non-thinking mode (enable_thinking=False); переключение по ходу диалога через префиксы /think и /no_thinkhuggingface.co ↗проверено
Предобучение~36 трлн токенов; 119 языков и диалектов; включает синтетические данные по математике/коду от Qwen2.5-Math и Qwen2.5-Coderqwenlm.github.io ↗проверено
Многоязычность119 языков и диалектовqwenlm.github.io ↗проверено
ЛицензияApache 2.0qwenlm.github.io ↗проверено
Дата отсечения данныхНе раскрыто для базового релиза; вариант -2507 ориентирован на знания по июль 2025www.mindstudio.ai ↗к проверке

Бенчмарки

BenchmarkDistributionScoreSource
AIME 2024
Thinking mode
85.7%arxiv.org ↗
AIME 2025
Thinking mode
81.5%arxiv.org ↗
LiveCodeBench v5
Thinking mode
70.7%arxiv.org ↗
CodeForces
Thinking mode
2056ratingarxiv.org ↗
BFCL v3
70.8%arxiv.org ↗

Примеры API

Для новых интеграций используйте глобальный endpoint api.therouter.ai из примеров ниже; старый China accelerated endpoint выведен из эксплуатации.

cURL
curl https://api.therouter.ai/v1/chat/completions   -H "Content-Type: application/json"   -H "Authorization: Bearer $THE_ROUTER_API_KEY"   -d '{
    "model": "qwen/qwen3-235b",
    "messages": [
      {"role": "user", "content": "Summarize the key points from this input."}
    ]
  }'

Non-thinking mode (быстрый, прямой)

cURL
curl https://api.therouter.ai/v1/chat/completions \
  -H "Authorization: Bearer $THEROUTER_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "qwen/qwen3-235b",
    "messages": [
      {"role": "user", "content": "/no_think Summarise the key changes in this diff: ..."}
    ]
  }'

Ещё от qwen

Похожие модели

Аналоги в других провайдерах

Новости и изменения

2025-05-14

Технический отчёт Qwen3 опубликован на arXiv (2505.09388)

Команда Qwen выпустила полный технический отчёт, охватывающий методологию предобучения семейства Qwen3 (36T токенов, 3 стадии), гибридную thinking-архитектуру, пайплайн пост-обучения и комплексные бенчмарки, показывающие Qwen3-235B-A22B с 85,7 AIME'24, 81,5 AIME'25, 70,7 LiveCodeBench v5 и 70,8 BFCL v3 в thinking mode.

переработано TheRouterarxiv.org ↗
2025-04-28

Qwen3-235B-A22B выпущена под лицензией Apache 2.0

Alibaba Qwen выпустила Qwen3-235B-A22B и полное семейство Qwen3 на Hugging Face, ModelScope и Kaggle под Apache 2.0, сделав крупнейшую open-weight hybrid-thinking MoE модель общедоступной. Релиз включал как pretrained base, так и post-trained instruct версии, а также шесть dense моделей от 0,6B до 32B и меньший Qwen3-30B-A3B MoE.

переработано TheRouterqwenlm.github.io ↗

Частые вопросы

В чём разница между thinking mode и non-thinking mode qwen/qwen3-235b на TheRouter?

Thinking mode (префикс /think или enable_thinking=True) заставляет модель генерировать полную цепочку рассуждений внутри тегов <think>...</think> перед финальным ответом. Это значительно улучшает точность на сложной математике, кодировании и многошаговых рассуждениях ценой большего количества токенов, latency и стоимости. Non-thinking mode (префикс /no_think) выдаёт прямой, лаконичный ответ — быстрее и дешевле, подходит для разговорных, творческих и простых задач. Режим можно переключать пер-ход в одном диалоге.

Как Qwen3-235B сравнивается с DeepSeek-R1 и o1?

Qwen3-235B-A22B в thinking mode достигает конкурентных или лучших результатов, чем DeepSeek-R1 и o1, на математических и кодировочных бенчмарках (85,7 AIME'24, 81,5 AIME'25, 70,7 LiveCodeBench v5). Команда Qwen позиционировала его как прямой аналог Grok-3 и Gemini-2.5-Pro. Ключевое преимущество перед закрытыми моделями — Apache 2.0 open-weight доступ и гибридный переключатель thinking, позволяющий одной модели обслуживать быстрые non-reasoning запросы без отдельного деплоя.

переработано TheRouterarxiv.org ↗
Можно ли использовать Qwen3-235B из Cursor, Cline или OpenAI-compatible SDK?

Да. Установите base URL клиента https://api.therouter.ai/v1, настройте API-ключ TheRouter и задайте model qwen/qwen3-235b. Streaming и tool calling поддерживаются. Для активации thinking mode добавьте к сообщению пользователя префикс /think; для прямых ответов — /no_think. Клиенты, отправляющие обычный текст без префикса, используют режим по умолчанию — проверяйте документацию TheRouter для актуального значения.

Почему Qwen3-235B активирует только 22B параметров при наличии 235B всего?

Qwen3-235B — это модель Mixture-of-Experts: её feed-forward слои содержат 128 подсетей-экспертов, из которых для каждого токена в ходе инференса отбираются только 8 (через обученный механизм маршрутизации). Остальные 120 экспертов для этого токена бездействуют. Это означает, что вычислительные затраты на токен эквивалентны примерно 22B dense модели, тогда как общая ёмкость модели — распределённая по всем 128 экспертам — достигает 235B параметров. В результате — frontier качество рассуждений при значительно более низкой стоимости инференса по сравнению с гипотетической 235B dense моделью.

Реестр фактов — каждая утверждаемая величина имеет источник
источникURLполучено
Дата релизаqwenlm.github.io ↗2026-06-09проверено
Архитектураhuggingface.co ↗2026-06-09проверено
Нативный контекстhuggingface.co ↗2026-06-09проверено
Режимы мышленияhuggingface.co ↗2026-06-09проверено
Предобучениеqwenlm.github.io ↗2026-06-09проверено
Многоязычностьqwenlm.github.io ↗2026-06-09проверено
Лицензияqwenlm.github.io ↗2026-06-09проверено
Дата отсечения данныхwww.mindstudio.ai ↗2026-06-09к проверке
AIME 2024arxiv.org ↗2026-06-09проверено
AIME 2025arxiv.org ↗2026-06-09проверено
LiveCodeBench v5arxiv.org ↗2026-06-09проверено
CodeForcesarxiv.org ↗2026-06-09проверено
BFCL v3arxiv.org ↗2026-06-09проверено
Технический отчёт Qwen3 опубликован на arXiv (2505.09388)arxiv.org ↗2026-06-09проверено
Qwen3-235B-A22B выпущена под лицензией Apache 2.0qwenlm.github.io ↗2026-06-09проверено
В чём разница между thinking mode и non-thinking mode qwen/qwen3-235b на TheRouter?huggingface.co ↗2026-06-09к проверке
Как Qwen3-235B сравнивается с DeepSeek-R1 и o1?arxiv.org ↗2026-06-09к проверке
Можно ли использовать Qwen3-235B из Cursor, Cline или OpenAI-compatible SDK?huggingface.co ↗2026-06-09к проверке
Почему Qwen3-235B активирует только 22B параметров при наличии 235B всего?huggingface.co ↗2026-06-09к проверке
Помощь и контакты