Qwen выпускает Qwen3-Coder-30B-A3B-Instruct
Qwen представил streamlined coder 30,5B total / 3,3B active, сохранив акцент семейства на long context, agentic coding, browser-use и tool-use при меньшей стоимости deployment/routing.
Qwen3's efficient coding model (30B MoE, 3B active). Fast code generation at low cost.
Qwen3-Coder-30B-A3B-Instruct — эффективная модель семейства Alibaba Qwen3-Coder: MoE для кода с 30,5B параметров всего и 3,3B активных, рассчитанная на агентское программирование, tool calls и контекст масштаба репозитория при заметно меньшей стоимости обслуживания, чем флагман 480B. Карточка модели позиционирует её как streamlined coder с сильной производительностью в agentic coding, browser-use и базовых coding-задачах при лучшей пропускной способности и deployability.
Для пользователей TheRouter это практичный high-throughput Qwen coder: выбирайте его для ассистентов в стиле Cursor, Cline, предварительного code review, генерации тестов и batch coding workflow, где 480B была бы избыточной. Он сохраняет нативный контекст 262K и non-thinking вывод, поэтому продакшен-клиентам не нужно удалять блоки <think> из ответов.
| Тип | Ставка |
|---|---|
| Вход | $0.486 за 1 млн токенов |
| Выход | $2.43 за 1 млн токенов |
| Архитектура | MoE causal language modelhuggingface.co ↗ | проверено |
| Параметры | 30,5B всего / 3,3B активныхhuggingface.co ↗ | проверено |
| Слои | 48huggingface.co ↗ | проверено |
| Эксперты | 128 экспертов; 8 активируются на токенhuggingface.co ↗ | проверено |
| Нативный контекст | 262 144 токена; до 1M через YaRN в self-host развертыванияхhuggingface.co ↗ | проверено |
| Режим вывода | Только non-thinking; не генерирует блоки <think>huggingface.co ↗ | проверено |
| Benchmark | Distribution | Score | Source |
|---|---|---|---|
Agentic Coding / Browser-Use / Foundational Coding Карточка 30B заявляет сильную performance среди open-моделей в agentic coding, agentic browser-use и foundational coding tasks, но точные числа в полученном тексте не опубликованы. | Strong open-model performance; exact 30B-specific score not exposed in fetched model-card text | huggingface.co/Qwen ↗ | |
SWE-Bench Verified Семейный анонс Qwen обсуждает SWE-Bench Verified для Qwen3-Coder и флагмана 480B; не выводите score 30B, пока Alibaba не опубликует его. | — | Не раскрыто | — |
Для новых интеграций используйте глобальный endpoint api.therouter.ai из примеров ниже; старый China accelerated endpoint выведен из эксплуатации.
curl https://api.therouter.ai/v1/chat/completions -H "Content-Type: application/json" -H "Authorization: Bearer $THE_ROUTER_API_KEY" -d '{
"model": "qwen/qwen3-coder-30b",
"messages": [
{"role": "user", "content": "Summarize the key points from this input."}
]
}'Используйте стандартный OpenAI-совместимый endpoint chat completions для code edits, тестов и объяснений. Делайте prompt конкретным: файл, падающий assertion или API contract.
curl https://api.therouter.ai/v1/chat/completions \
-H "Authorization: Bearer $THEROUTER_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "qwen/qwen3-coder-30b",
"messages": [
{"role": "system", "content": "You are a senior software engineer. Return concise patches and tests."},
{"role": "user", "content": "Write unit tests for this parser and cover edge cases: ..."}
],
"temperature": 0.7,
"max_tokens": 4096
}'Qwen представил streamlined coder 30,5B total / 3,3B active, сохранив акцент семейства на long context, agentic coding, browser-use и tool-use при меньшей стоимости deployment/routing.
Первый анонс Qwen3-Coder представил семейство как agentic coding line с Qwen Code, OpenAI-compatible API examples, настройкой Cline и интеграциями в стиле Claude Code.
30B — efficiency sibling: 30,5B total и 3,3B active против 480B total и 35B active у флагмана. Используйте 30B для high-throughput coding, тестов, summaries и cost-sensitive agents; 480B оставляйте для более рискованных autonomous edits или сложного repo reasoning.
Да. Карточка модели подчёркивает agentic coding и содержит OpenAI-compatible пример tool calling. Через TheRouter используйте обычные поля tools и tool_choice на /v1/chat/completions.
Нет. Qwen указывает, что модель поддерживает только non-thinking mode и не генерирует блоки <think></think>. Это упрощает использование в production code clients, ожидающих прямой output.
Да. TheRouter exposes модель через OpenAI-compatible chat endpoint, поэтому клиенты, где можно задать baseURL, API key и model name, могут routing на qwen/qwen3-coder-30b.
Curated card фиксирует native context claim модели, но operational context и max completion всё ещё берутся из standard-models.yaml и выбранного upstream route. Проверяйте крупнейшие prompts перед production rollout.
| источник | URL | получено | |
|---|---|---|---|
| Архитектура | huggingface.co ↗ | 2026-06-03 | проверено |
| Параметры | huggingface.co ↗ | 2026-06-03 | проверено |
| Слои | huggingface.co ↗ | 2026-06-03 | проверено |
| Эксперты | huggingface.co ↗ | 2026-06-03 | проверено |
| Нативный контекст | huggingface.co ↗ | 2026-06-03 | проверено |
| Режим вывода | huggingface.co ↗ | 2026-06-03 | проверено |
| Agentic Coding / Browser-Use / Foundational Coding | huggingface.co/Qwen ↗ | 2026-06-03 | проверено |
| SWE-Bench Verified | qwenlm.github.io ↗ | 2026-06-03 | неизвестно |
| Qwen выпускает Qwen3-Coder-30B-A3B-Instruct | huggingface.co/Qwen ↗ | 2026-06-03 | проверено |
| Qwen запускает семейство Qwen3-Coder и Qwen Code | qwenlm.github.io ↗ | 2026-06-03 | проверено |
| Чем qwen/qwen3-coder-30b отличается от qwen/qwen3-coder-480b? | huggingface.co ↗ | 2026-06-03 | к проверке |
| Поддерживает ли Qwen3-Coder-30B tool calling? | huggingface.co ↗ | 2026-06-03 | к проверке |
| Возвращает ли она hidden reasoning или блоки <think>? | huggingface.co ↗ | 2026-06-03 | к проверке |
| Можно ли использовать её из Cursor, Cline или другого OpenAI-compatible клиента? | qwenlm.github.io ↗ | 2026-06-03 | к проверке |
| 262K context — это гарантия TheRouter? | huggingface.co ↗ | 2026-06-03 | к проверке |