Назад к моделям

Qwen3 30B Thinking

qwenqwen/qwen3-30b-thinking

Qwen3 30B Thinking — efficient reasoning model (MoE, 3B active) for cost-effective chain-of-thought.

Qwen3 30B Thinking — стабильный публичный маршрут TheRouter для эффективной reasoning-модели Alibaba Qwen с архитектурой Mixture-of-Experts: 30B общих параметров и около 3B активных. Model card описывает базовую Qwen3-30B-A3B как sparse MoE: модель хранит пул экспертов 30B, но активирует около 3B параметров на токен, создавая средний уровень между малыми dense Qwen и флагманским маршрутом класса 235B.

Используйте этот маршрут, когда нужна cost-controlled chain-of-thought модель без привязки к суффиксу конкретного snapshot. Live-конфигурация TheRouter обслуживает её как text-in/text-out OpenAI-compatible chat completions с параметрами temperature, max_tokens, top_p и stop; если приложение оценивалось на явном июльском snapshot 2025, продолжайте использовать qwen/qwen3-30b-a3b-thinking-2507, а не незаметно менять alias.

Когда выбирать
  • • Reasoning traffic с жёстким бюджетом, где малые dense модели уже слабы, а qwen/qwen3-235b или закрытые frontier-модели слишком дороги для объёма запросов
  • • Шаги planning, evaluation и review, которым полезно явное рассуждение, но не нужен максимальный benchmark ceiling
  • • Высокообъёмные многоязычные задачи summarization, comparison и extraction, где нужна reasoning-сила выше уровня Qwen3 8B
  • • Стабильные production configs, предпочитающие общий маршрут TheRouter, при условии что поведение точного snapshot нужно переоценивать перед крупными изменениями prompt
Когда не выбирать
  • • Native image, audio, video или PDF understanding — этот маршрут только text-in/text-out; для multimodal inputs выбирайте Qwen VL или speech model
  • • Строгий low-latency chat, где reasoning-токены лишние — выбирайте non-thinking или меньший Qwen route, когда важнее first-token latency и output cost
  • • Приложения, сертифицированные на закреплённом маршруте 2507 — используйте qwen/qwen3-30b-a3b-thinking-2507, пока не повторите acceptance tests на этом alias

Чем обслуживание в TheRouter отличается от вендорского

Как её эксплуатирует вендор

Alibaba публикует Qwen3-30B-A3B как open model artifacts и документацию; host deployments могут expose tokenizer templates, thinking controls или snapshot labels в зависимости от serving stack.

На TheRouter

TheRouter обслуживает qwen/qwen3-30b-thinking как text-only OpenAI-compatible chat-completions route с supported parameters, объявленными в standard-models.yaml.

Размер контекста
131K
Максимальный вывод
33K
Цена Входза 1M токенов
$0.216за 1 млн токенов
Цена Выходза 1M токенов
$2.59за 1 млн токенов

Модальности

Текст→Текст

Разбивка цен

ТипСтавка
Вход$0.216 за 1 млн токенов
Выход$2.59 за 1 млн токенов

Поддерживаемые параметры

temperaturemax_tokenstop_pstop

Характеристики

АрхитектураMixture-of-Experts; 30B общих параметров, около 3B активныхhuggingface.co/Qwen ↗проверено
Контекстное окно в TheRouter131 072 токенаtherouter.ai model configuration ↗проверено
Максимальный ответ32 768 токеновtherouter.ai model configuration ↗проверено
МодальностиТекст на входе; текст на выходеtherouter.ai model configuration ↗проверено
Поддерживаемые параметры запросаtemperature, max_tokens, top_p, stoptherouter.ai model configuration ↗проверено
ЛицензияApache 2.0huggingface.co/Qwen ↗проверено
Дата отсечения данныхНе раскрытонеизвестно

Бенчмарки

BenchmarkDistributionScoreSource
Qwen3 family benchmark set
Публичные материалы Qwen3 benchmark-ят членов семейства, но этот маршрут TheRouter является operational alias; не копируйте sibling scores без route-specific verification.
—Не раскрыто—
AIME
Оставьте math score явно unknown, пока для точного model ID TheRouter нет verified benchmark ledger.
—Не раскрыто—
LiveCodeBench
Sibling code scores Qwen3 здесь не утверждаются, потому что страница описывает served alias TheRouter, а не отдельно опубликованный evaluation artifact.
—Не раскрыто—

Примеры API

Для новых интеграций используйте глобальный endpoint api.therouter.ai из примеров ниже; старый China accelerated endpoint выведен из эксплуатации.

cURL
curl https://api.therouter.ai/v1/chat/completions   -H "Content-Type: application/json"   -H "Authorization: Bearer $THE_ROUTER_API_KEY"   -d '{
    "model": "qwen/qwen3-30b-thinking",
    "messages": [
      {"role": "user", "content": "Summarize the key points from this input."}
    ]
  }'

Chat completion

cURL
curl https://api.therouter.ai/v1/chat/completions \
  -H "Authorization: Bearer $THEROUTER_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{"model":"qwen/qwen3-30b-thinking","messages":[{"role":"user","content":"Compare these two incident summaries and identify the likely root cause."}]}'

Ещё от qwen

Похожие модели

Аналоги в других провайдерах

Новости и изменения

2025-07-01

Qwen3 30B Thinking доступна как reasoning route TheRouter

TheRouter lists маршрут Qwen3 30B Thinking для команд, которым нужен reasoning tier Qwen MoE с 30B total / 3B active за OpenAI-compatible chat-completions API. Если evaluation требует явного суффикса 2507, закрепляйте snapshot route.

переработано TheRoutertherouter.ai model configuration ↗

Частые вопросы

qwen/qwen3-30b-thinking — это то же самое, что qwen/qwen3-30b-a3b-thinking-2507?

Это related routes семейства Qwen3 30B-A3B thinking. Используйте явный model ID 2507, если prompts, fallbacks или evals сертифицированы на закреплённом snapshot; используйте этот route, когда нужен общий публичный ID TheRouter.

переработано TheRoutertherouter.ai model configuration ↗
Поддерживает ли этот маршрут TheRouter tool calling или JSON schema output?

Локальная live-конфигурация этого route перечисляет temperature, max_tokens, top_p и stop. Не предполагайте tools или response_format, пока собственный route contract test это не подтвердит.

переработано TheRoutertherouter.ai model configuration ↗
Почему snippets score не отмечен как verified?

У этого scheduled curation loop нет бюджета на paid API. Snippet verifier намеренно заблокирован, пока оператор не выставит SNIPPET_VERIFY_APPROVED=1, поэтому страница должна оставаться capped до human-funded approval.

переработано TheRoutertherouter.ai model configuration ↗
Реестр фактов — каждая утверждаемая величина имеет источник
источникURLполучено
Архитектураhuggingface.co/Qwen ↗2026-08-06проверено
Контекстное окно в TheRoutertherouter.ai model configuration ↗2026-08-06проверено
Максимальный ответtherouter.ai model configuration ↗2026-08-06проверено
Модальностиtherouter.ai model configuration ↗2026-08-06проверено
Поддерживаемые параметры запросаtherouter.ai model configuration ↗2026-08-06проверено
Лицензияhuggingface.co/Qwen ↗2026-08-06проверено
Дата отсечения данных——неизвестно
Qwen3 family benchmark setqwenlm.github.io ↗2026-08-06неизвестно
AIMEqwenlm.github.io ↗2026-08-06неизвестно
LiveCodeBenchqwenlm.github.io ↗2026-08-06неизвестно
Qwen3 30B Thinking доступна как reasoning route TheRoutertherouter.ai model configuration ↗2026-08-06проверено
qwen/qwen3-30b-thinking — это то же самое, что qwen/qwen3-30b-a3b-thinking-2507?therouter.ai model configuration ↗2026-08-06к проверке
Поддерживает ли этот маршрут TheRouter tool calling или JSON schema output?therouter.ai model configuration ↗2026-08-06к проверке
Почему snippets score не отмечен как verified?therouter.ai model configuration ↗2026-08-06к проверке
Помощь и контакты