Назад к моделям

Qwen3 Coder 480B

qwenqwen/qwen3-coder-480b

Qwen3's largest coding-specialized model (480B total, 35B active, 160 experts, 8 active per token MoE). State-of-the-art code generation and understanding. Non-thinking mode only.

Qwen3-Coder-480B-A35B-Instruct — флагманская open-weight модель Alibaba Qwen для кода: MoE на 480B параметров всего и 35B активных, ориентированная на агентское программирование, понимание репозиториев и работу с инструментами. Qwen называет её своей самой агентской кодовой моделью и позиционирует результаты среди open-моделей рядом с системами уровня Claude Sonnet.

Для пользователей TheRouter это практичный кандидат по умолчанию для команд AI coding, которым нужен крупный open-weight coder за Cursor, Cline, роутерами в стиле Claude Code или любым OpenAI-совместимым клиентом. Нативный контекст — 256K, в self-host сценариях его можно расширять до 1M через YaRN; модель явно non-thinking и не выводит блоки <think>, поэтому продакшен-клиенты могут воспринимать ответ как прямой кодовый результат.

Когда выбирать
  • • Агентские coding-процессы — многофайловые правки, вызовы инструментов, циклы тестов и долгий ремонт кода
  • • Контекст масштаба репозитория — нативные 256K для PR review, миграций, анализа зависимостей и больших файлов
  • • OpenAI-совместимые coding-клиенты — инструменты типа Cursor, Cline, Qwen Code и кастомные SDK через TheRouter
  • • Команды, которым нужна open-weight fallback/self-host опция без перехода на маленькую кодовую модель
Когда не выбирать
  • • Нативный ввод изображений, аудио или видео — Qwen3-Coder-480B работает text-in/text-out; мультимодальные задачи ведите на vision-модель
  • • UX с явным глубоким reasoning — модель намеренно non-thinking и не возвращает блоки <think>
  • • Сверхдешёвый autocomplete или high-QPS snippets — когда важнее latency и маржа, берите qwen/qwen3-coder-30b или другой малый coder
Размер контекста
200K
Максимальный вывод
66K
Цена Входза 1M токенов
$1.62за 1 млн токенов
Цена Выходза 1M токенов
$8.10за 1 млн токенов

Модальности

Текст→Текст

Разбивка цен

ТипСтавка
Вход$1.62 за 1 млн токенов
Выход$8.10 за 1 млн токенов

Поддерживаемые параметры

temperaturemax_tokenstop_ptoolstool_choiceresponse_formatstop

Характеристики

АрхитектураMoE causal language modelhuggingface.co ↗проверено
Параметры480B всего / 35B активныхhuggingface.co ↗проверено
Эксперты160 экспертов; 8 активируются на токенhuggingface.co ↗проверено
Нативный контекст262,144 токена; до 1M через YaRN в self-host развертыванияхqwenlm.github.io ↗проверено
Режим выводаТолько non-thinking; не генерирует блоки <think>huggingface.co ↗проверено
Фокус обучения7.5T токенов pretraining, около 70% код; code RL и long-horizon agent RLqwenlm.github.io ↗проверено

Бенчмарки

BenchmarkDistributionScoreSource
SWE-bench Verified
По данным Together AI для Qwen3-Coder-480B-A35B-Instruct; вторичный источник до доступности официальной числовой таблицы.
69.6%%together.ai ↗
Aider Polyglot
Многоязычный benchmark редактирования кода; публичный вторичный отчёт, не официальная таблица Qwen в доступных источниках.
61.8%%medium.com ↗
Agentic Coding / Browser-Use / Tool-Use
Качественное заявление из официального анонса Qwen; точные числа в полученном тексте страницы не раскрыты.
State-of-the-art among open modelsqwenlm.github.io ↗

Примеры API

Для новых интеграций используйте глобальный endpoint api.therouter.ai из примеров ниже; старый China accelerated endpoint выведен из эксплуатации.

cURL
curl https://api.therouter.ai/v1/chat/completions   -H "Content-Type: application/json"   -H "Authorization: Bearer $THE_ROUTER_API_KEY"   -d '{
    "model": "qwen/qwen3-coder-480b",
    "messages": [
      {"role": "user", "content": "Summarize the key points from this input."}
    ]
  }'

Chat completion

Используйте стандартный OpenAI-совместимый endpoint chat completions. Модель сильнее всего, когда prompt содержит конкретные файлы, падающие тесты или явные coding-ограничения.

cURL
curl https://api.therouter.ai/v1/chat/completions \
  -H "Authorization: Bearer $THEROUTER_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "qwen/qwen3-coder-480b",
    "messages": [
      {"role": "system", "content": "You are a senior software engineer. Return concise patches and explain tradeoffs."},
      {"role": "user", "content": "Refactor this TypeScript function to remove duplication and preserve behavior: ..."}
    ],
    "temperature": 0.7,
    "max_tokens": 4096
  }'

Ещё от qwen

Похожие модели

Аналоги в других провайдерах

Новости и изменения

2026-02-28

Техотчёт Qwen3-Coder-Next сравнивает новую 80B/3B модель с Qwen3-Coder-480B

Отчёт Qwen3-Coder-Next позиционирует 480B-A35B как предыдущий флагманский coder и показывает, что Qwen оптимизирует agentic coding по активным параметрам, а не только по общему размеру.

переработано TheRouterarxiv.org ↗
2025-07-22

Qwen запускает Qwen3-Coder-480B-A35B-Instruct и Qwen Code

Qwen представила флагманскую coding MoE 480B/35B active вместе с Qwen Code — CLI на базе Gemini Code, адаптированным под Qwen-prompts и протоколы function calling.

переработано TheRouterqwenlm.github.io ↗
2025-07-22

Карточка Hugging Face публикует архитектуру и детали non-thinking режима

Model card фиксирует 62 слоя, 96 Q-heads / 8 KV-heads, 160 экспертов с 8 активными, нативный контекст 262,144 токена и только non-thinking режим.

переработано TheRouterhuggingface.co/Qwen ↗

Частые вопросы

Qwen3-Coder-480B — thinking-модель?

Нет. Qwen явно указывает, что checkpoint поддерживает только non-thinking mode и не генерирует блоки <think></think>. Это удобно для coding-клиентов, потому что ответы прямые, но UX не должен строиться вокруг видимых reasoning traces.

Какой контекст поддерживается?

Нативный контекст — 262,144 токена. В анонсе Qwen говорится о расширении до 1M через YaRN, но это путь настройки для self-host, а не гарантия, что каждый hosted route даёт 1M context.

Можно ли использовать её из Cursor, Cline или инструментов в стиле Claude Code?

Да, если клиент говорит с OpenAI-compatible chat completions или идёт через совместимый proxy. В анонсе Qwen отдельно описаны Qwen Code, Cline и пути интеграции в стиле Claude Code; через TheRouter самый простой путь — endpoint /v1/chat/completions и model qwen/qwen3-coder-480b.

Чем она отличается от qwen/qwen3-coder-30b?

480B — крупный флагман: 480B параметров всего и 35B активных. 30B sibling дешевле и быстрее: 30B всего / 3B active. Берите 480B для сложной многошаговой работы по репозиторию; 30B — для дешёвого autocomplete, малых правок и high-throughput IDE assistance.

Можно ли self-host Qwen3-Coder-480B?

Да, веса опубликованы, доступны BF16 и FP8 checkpoints. Практическое ограничение — железо и serving stack: используйте свежие SGLang или vLLM с parser qwen3_coder и уменьшайте context length, если памяти не хватает для полного 256K deployment.

Реестр фактов — каждая утверждаемая величина имеет источник
источникURLполучено
Архитектураhuggingface.co ↗2026-06-02проверено
Параметрыhuggingface.co ↗2026-06-02проверено
Экспертыhuggingface.co ↗2026-06-02проверено
Нативный контекстqwenlm.github.io ↗2026-06-02проверено
Режим выводаhuggingface.co ↗2026-06-02проверено
Фокус обученияqwenlm.github.io ↗2026-06-02проверено
SWE-bench Verifiedtogether.ai ↗2026-06-02к проверке
Aider Polyglotmedium.com ↗2026-06-02один источник
Agentic Coding / Browser-Use / Tool-Useqwenlm.github.io ↗2026-06-02проверено
Техотчёт Qwen3-Coder-Next сравнивает новую 80B/3B модель с Qwen3-Coder-480Barxiv.org ↗2026-06-02проверено
Qwen запускает Qwen3-Coder-480B-A35B-Instruct и Qwen Codeqwenlm.github.io ↗2026-06-02проверено
Карточка Hugging Face публикует архитектуру и детали non-thinking режимаhuggingface.co/Qwen ↗2026-06-02проверено
Qwen3-Coder-480B — thinking-модель?huggingface.co ↗2026-06-02к проверке
Какой контекст поддерживается?qwenlm.github.io ↗2026-06-02к проверке
Можно ли использовать её из Cursor, Cline или инструментов в стиле Claude Code?qwenlm.github.io ↗2026-06-02к проверке
Чем она отличается от qwen/qwen3-coder-30b?github.com ↗2026-06-02к проверке
Можно ли self-host Qwen3-Coder-480B?huggingface.co ↗2026-06-02к проверке
Помощь и контакты