Назад к моделям

Qwen3 Coder 30B

qwenqwen/qwen3-coder-30b

Qwen3's efficient coding model (30B MoE, 3B active). Fast code generation at low cost.

Qwen3-Coder-30B-A3B-Instruct — эффективная модель семейства Alibaba Qwen3-Coder: MoE для кода с 30,5B параметров всего и 3,3B активных, рассчитанная на агентское программирование, tool calls и контекст масштаба репозитория при заметно меньшей стоимости обслуживания, чем флагман 480B. Карточка модели позиционирует её как streamlined coder с сильной производительностью в agentic coding, browser-use и базовых coding-задачах при лучшей пропускной способности и deployability.

Для пользователей TheRouter это практичный high-throughput Qwen coder: выбирайте его для ассистентов в стиле Cursor, Cline, предварительного code review, генерации тестов и batch coding workflow, где 480B была бы избыточной. Он сохраняет нативный контекст 262K и non-thinking вывод, поэтому продакшен-клиентам не нужно удалять блоки <think> из ответов.

Когда выбирать
  • • High-throughput coding agents — повторяющиеся правки кода, генерация тестов, сводки static analysis и batch triage PR, где важна цена запроса
  • • Developer tools в стиле Cursor/Cline — OpenAI-совместимый chat, streaming, tools и response_format через TheRouter
  • • Long-context понимание кода — нативные 262K для больших файлов, карт зависимостей и migration notes без перехода к flagship pricing
  • • Команды, которым нужен open-weight coding fallback с более сильным agent behavior, чем у обычных малых chat-моделей
Когда не выбирать
  • • Самые рискованные автономные refactor-задачи — при высокой цене ошибки ведите на qwen/qwen3-coder-480b или frontier coding model
  • • Нативный multimodal input — модель text-in/text-out; для изображений используйте qwen/qwen3-vl-plus или другую vision-модель
  • • UX с явным reasoning trace — Qwen указывает, что модель non-thinking и не выводит блоки <think>
Размер контекста
200K
Максимальный вывод
66K
Цена Входза 1M токенов
$0.486за 1 млн токенов
Цена Выходза 1M токенов
$2.43за 1 млн токенов

Модальности

Текст→Текст

Разбивка цен

ТипСтавка
Вход$0.486 за 1 млн токенов
Выход$2.43 за 1 млн токенов

Поддерживаемые параметры

temperaturemax_tokenstop_ptoolstool_choiceresponse_formatreasoningstop

Характеристики

АрхитектураMoE causal language modelhuggingface.co ↗проверено
Параметры30,5B всего / 3,3B активныхhuggingface.co ↗проверено
Слои48huggingface.co ↗проверено
Эксперты128 экспертов; 8 активируются на токенhuggingface.co ↗проверено
Нативный контекст262 144 токена; до 1M через YaRN в self-host развертыванияхhuggingface.co ↗проверено
Режим выводаТолько non-thinking; не генерирует блоки <think>huggingface.co ↗проверено

Бенчмарки

BenchmarkDistributionScoreSource
Agentic Coding / Browser-Use / Foundational Coding
Карточка 30B заявляет сильную performance среди open-моделей в agentic coding, agentic browser-use и foundational coding tasks, но точные числа в полученном тексте не опубликованы.
Strong open-model performance; exact 30B-specific score not exposed in fetched model-card texthuggingface.co/Qwen ↗
SWE-Bench Verified
Семейный анонс Qwen обсуждает SWE-Bench Verified для Qwen3-Coder и флагмана 480B; не выводите score 30B, пока Alibaba не опубликует его.
—Не раскрыто—

Примеры API

Для новых интеграций используйте глобальный endpoint api.therouter.ai из примеров ниже; старый China accelerated endpoint выведен из эксплуатации.

cURL
curl https://api.therouter.ai/v1/chat/completions   -H "Content-Type: application/json"   -H "Authorization: Bearer $THE_ROUTER_API_KEY"   -d '{
    "model": "qwen/qwen3-coder-30b",
    "messages": [
      {"role": "user", "content": "Summarize the key points from this input."}
    ]
  }'

Chat completion

Используйте стандартный OpenAI-совместимый endpoint chat completions для code edits, тестов и объяснений. Делайте prompt конкретным: файл, падающий assertion или API contract.

cURL
curl https://api.therouter.ai/v1/chat/completions \
  -H "Authorization: Bearer $THEROUTER_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "qwen/qwen3-coder-30b",
    "messages": [
      {"role": "system", "content": "You are a senior software engineer. Return concise patches and tests."},
      {"role": "user", "content": "Write unit tests for this parser and cover edge cases: ..."}
    ],
    "temperature": 0.7,
    "max_tokens": 4096
  }'

Ещё от qwen

Похожие модели

Аналоги в других провайдерах

Новости и изменения

2025-07-29

Qwen выпускает Qwen3-Coder-30B-A3B-Instruct

Qwen представил streamlined coder 30,5B total / 3,3B active, сохранив акцент семейства на long context, agentic coding, browser-use и tool-use при меньшей стоимости deployment/routing.

переработано TheRouterhuggingface.co/Qwen ↗
2025-07-22

Qwen запускает семейство Qwen3-Coder и Qwen Code

Первый анонс Qwen3-Coder представил семейство как agentic coding line с Qwen Code, OpenAI-compatible API examples, настройкой Cline и интеграциями в стиле Claude Code.

переработано TheRouterqwenlm.github.io ↗

Частые вопросы

Чем qwen/qwen3-coder-30b отличается от qwen/qwen3-coder-480b?

30B — efficiency sibling: 30,5B total и 3,3B active против 480B total и 35B active у флагмана. Используйте 30B для high-throughput coding, тестов, summaries и cost-sensitive agents; 480B оставляйте для более рискованных autonomous edits или сложного repo reasoning.

Поддерживает ли Qwen3-Coder-30B tool calling?

Да. Карточка модели подчёркивает agentic coding и содержит OpenAI-compatible пример tool calling. Через TheRouter используйте обычные поля tools и tool_choice на /v1/chat/completions.

Возвращает ли она hidden reasoning или блоки <think>?

Нет. Qwen указывает, что модель поддерживает только non-thinking mode и не генерирует блоки <think></think>. Это упрощает использование в production code clients, ожидающих прямой output.

Можно ли использовать её из Cursor, Cline или другого OpenAI-compatible клиента?

Да. TheRouter exposes модель через OpenAI-compatible chat endpoint, поэтому клиенты, где можно задать baseURL, API key и model name, могут routing на qwen/qwen3-coder-30b.

262K context — это гарантия TheRouter?

Curated card фиксирует native context claim модели, но operational context и max completion всё ещё берутся из standard-models.yaml и выбранного upstream route. Проверяйте крупнейшие prompts перед production rollout.

Реестр фактов — каждая утверждаемая величина имеет источник
источникURLполучено
Архитектураhuggingface.co ↗2026-06-03проверено
Параметрыhuggingface.co ↗2026-06-03проверено
Слоиhuggingface.co ↗2026-06-03проверено
Экспертыhuggingface.co ↗2026-06-03проверено
Нативный контекстhuggingface.co ↗2026-06-03проверено
Режим выводаhuggingface.co ↗2026-06-03проверено
Agentic Coding / Browser-Use / Foundational Codinghuggingface.co/Qwen ↗2026-06-03проверено
SWE-Bench Verifiedqwenlm.github.io ↗2026-06-03неизвестно
Qwen выпускает Qwen3-Coder-30B-A3B-Instructhuggingface.co/Qwen ↗2026-06-03проверено
Qwen запускает семейство Qwen3-Coder и Qwen Codeqwenlm.github.io ↗2026-06-03проверено
Чем qwen/qwen3-coder-30b отличается от qwen/qwen3-coder-480b?huggingface.co ↗2026-06-03к проверке
Поддерживает ли Qwen3-Coder-30B tool calling?huggingface.co ↗2026-06-03к проверке
Возвращает ли она hidden reasoning или блоки <think>?huggingface.co ↗2026-06-03к проверке
Можно ли использовать её из Cursor, Cline или другого OpenAI-compatible клиента?qwenlm.github.io ↗2026-06-03к проверке
262K context — это гарантия TheRouter?huggingface.co ↗2026-06-03к проверке
Помощь и контакты