Qwen3-Coder-Next 技术报告将新 80B/3B 模型与 Qwen3-Coder-480B 对比
Qwen3-Coder-Next 报告将 480B-A35B 定位为上一代旗舰代码模型,并显示 Qwen 正在按激活参数效率优化 coding-agent 能力,而不只是堆总参数量。
Qwen3's largest coding-specialized model (480B total, 35B active, 160 experts, 8 active per token MoE). State-of-the-art code generation and understanding. Non-thinking mode only.
Qwen3-Coder-480B-A35B-Instruct 是阿里 Qwen 的旗舰开源权重编程模型:480B 总参数 / 35B 激活参数的 MoE,面向 agentic coding、仓库级理解和工具使用。Qwen 称其为目前最具 agent 能力的代码模型,在 agent 编程、浏览器使用和工具使用任务上达到开源模型前列,并以 Claude Sonnet 级系统作为对标对象。
对 TheRouter 用户而言,这是 AI 编码团队在 Cursor、Cline、Claude Code 风格路由器或任何 OpenAI 兼容客户端背后使用大开源代码模型的现实默认候选。它原生支持 256K 上下文,自托管时可通过 YaRN 扩展到 1M tokens,并且明确为非思考模式:不会输出 <think> 块,因此生产客户端可以把返回内容直接作为代码输出处理。
| 类型 | 费率 |
|---|---|
| 输入 | $1.62 每百万 Tokens |
| 输出 | $8.10 每百万 Tokens |
| 架构 | MoE 因果语言模型huggingface.co ↗ | 已核实 |
| 参数规模 | 480B 总参数 / 35B 激活参数huggingface.co ↗ | 已核实 |
| 专家数量 | 160 个专家;每个 token 激活 8 个huggingface.co ↗ | 已核实 |
| 原生上下文 | 262,144 tokens;自托管部署中可通过 YaRN 扩展到 1Mqwenlm.github.io ↗ | 已核实 |
| 输出模式 | 仅非思考模式;不会生成 <think> 块huggingface.co ↗ | 已核实 |
| 训练重点 | 7.5T 预训练 tokens,约 70% 为代码;包含代码 RL 与长链路 agent RLqwenlm.github.io ↗ | 已核实 |
| Benchmark | Distribution | Score | Source |
|---|---|---|---|
SWE-bench Verified Together AI 对 Qwen3-Coder-480B-A35B-Instruct 的报告;在可访问官方数值表前按二级来源处理。 | 69.6%% | together.ai ↗ | |
Aider Polyglot 多语言代码编辑基准;来自公开二级报告,已抓取来源中未见官方 Qwen 数值表。 | 61.8%% | medium.com ↗ | |
Agentic Coding / Browser-Use / Tool-Use Qwen 官方发布中的定性表述;抓取页面文本未暴露精确分数。 | State-of-the-art among open models | qwenlm.github.io ↗ |
所有新集成都应使用下方示例中的全球端点 api.therouter.ai;旧中国加速端点已下线。
curl https://api.therouter.ai/v1/chat/completions -H "Content-Type: application/json" -H "Authorization: Bearer $THE_ROUTER_API_KEY" -d '{
"model": "qwen/qwen3-coder-480b",
"messages": [
{"role": "user", "content": "Summarize the key points from this input."}
]
}'使用标准 OpenAI 兼容 Chat Completions 端点。该模型在提示词包含具体文件、失败测试或明确编码约束时表现最好。
curl https://api.therouter.ai/v1/chat/completions \
-H "Authorization: Bearer $THEROUTER_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "qwen/qwen3-coder-480b",
"messages": [
{"role": "system", "content": "You are a senior software engineer. Return concise patches and explain tradeoffs."},
{"role": "user", "content": "Refactor this TypeScript function to remove duplication and preserve behavior: ..."}
],
"temperature": 0.7,
"max_tokens": 4096
}'Qwen3-Coder-Next 报告将 480B-A35B 定位为上一代旗舰代码模型,并显示 Qwen 正在按激活参数效率优化 coding-agent 能力,而不只是堆总参数量。
Qwen 发布旗舰 480B/35B 激活代码 MoE,同时推出 Qwen Code——基于 Gemini Code 改造、加入 Qwen 专属提示词与函数调用协议的 CLI。
模型卡记录了 62 层、96 个 Q head / 8 个 KV head、160 个专家且每 token 激活 8 个、262,144 token 原生上下文,以及该模型仅支持非思考模式。
不是。Qwen 明确说明该 checkpoint 仅支持非思考模式,不生成 <think></think> 块。这对编码客户端有利,因为返回更直接;但也意味着不应围绕可见推理轨迹设计 UX。
原生上下文长度是 262,144 tokens。Qwen 发布博客称可通过 YaRN 扩展到 1M tokens,但这是自托管部署/配置路径,并不代表每条托管路由都开放 1M 上下文。
可以,前提是客户端支持 OpenAI 兼容 Chat Completions,或可通过兼容代理转发。Qwen 发布博客专门提到 Qwen Code、Cline 和 Claude Code 风格集成路径;通过 TheRouter 最简单的方式是使用 OpenAI 兼容 /v1/chat/completions 端点与 model qwen/qwen3-coder-480b。
480B 是大旗舰:480B 总参数、35B 激活参数。30B 同系列模型更便宜更快,为 30B 总参数 / 3B 激活参数。复杂多步仓库任务用 480B;低成本补全、小改动和高吞吐 IDE 辅助用 30B。
可以,权重已发布,Qwen 提供 BF16 与 FP8 checkpoints。实际约束在硬件和服务栈:使用新版 SGLang 或 vLLM,并启用 qwen3_coder tool-call parser;如果内存压力导致无法部署完整 256K 上下文,应降低上下文长度。
| 来源 | URL | 采集于 | |
|---|---|---|---|
| 架构 | huggingface.co ↗ | 2026-06-02 | 已核实 |
| 参数规模 | huggingface.co ↗ | 2026-06-02 | 已核实 |
| 专家数量 | huggingface.co ↗ | 2026-06-02 | 已核实 |
| 原生上下文 | qwenlm.github.io ↗ | 2026-06-02 | 已核实 |
| 输出模式 | huggingface.co ↗ | 2026-06-02 | 已核实 |
| 训练重点 | qwenlm.github.io ↗ | 2026-06-02 | 已核实 |
| SWE-bench Verified | together.ai ↗ | 2026-06-02 | 待核实 |
| Aider Polyglot | medium.com ↗ | 2026-06-02 | 单一来源 |
| Agentic Coding / Browser-Use / Tool-Use | qwenlm.github.io ↗ | 2026-06-02 | 已核实 |
| Qwen3-Coder-Next 技术报告将新 80B/3B 模型与 Qwen3-Coder-480B 对比 | arxiv.org ↗ | 2026-06-02 | 已核实 |
| Qwen 发布 Qwen3-Coder-480B-A35B-Instruct 与 Qwen Code | qwenlm.github.io ↗ | 2026-06-02 | 已核实 |
| Hugging Face 模型页公开架构与非思考模式细节 | huggingface.co/Qwen ↗ | 2026-06-02 | 已核实 |
| Qwen3-Coder-480B 是思考模型吗? | huggingface.co ↗ | 2026-06-02 | 待核实 |
| 它支持多长上下文? | qwenlm.github.io ↗ | 2026-06-02 | 待核实 |
| 能否在 Cursor、Cline 或 Claude Code 风格工具中使用? | qwenlm.github.io ↗ | 2026-06-02 | 待核实 |
| 它和 qwen/qwen3-coder-30b 有什么区别? | github.com ↗ | 2026-06-02 | 待核实 |
| 可以自托管 Qwen3-Coder-480B 吗? | huggingface.co ↗ | 2026-06-02 | 待核实 |