返回模型列表

Qwen3 Coder 480B

qwenqwen/qwen3-coder-480b

Qwen3's largest coding-specialized model (480B total, 35B active, 160 experts, 8 active per token MoE). State-of-the-art code generation and understanding. Non-thinking mode only.

Qwen3-Coder-480B-A35B-Instruct 是阿里 Qwen 的旗舰开源权重编程模型:480B 总参数 / 35B 激活参数的 MoE,面向 agentic coding、仓库级理解和工具使用。Qwen 称其为目前最具 agent 能力的代码模型,在 agent 编程、浏览器使用和工具使用任务上达到开源模型前列,并以 Claude Sonnet 级系统作为对标对象。

对 TheRouter 用户而言,这是 AI 编码团队在 Cursor、Cline、Claude Code 风格路由器或任何 OpenAI 兼容客户端背后使用大开源代码模型的现实默认候选。它原生支持 256K 上下文,自托管时可通过 YaRN 扩展到 1M tokens,并且明确为非思考模式:不会输出 <think> 块,因此生产客户端可以把返回内容直接作为代码输出处理。

适合使用
  • • Agentic coding 工作流——多文件编辑、工具调用、测试反馈循环和长链路代码修复
  • • 仓库级上下文——原生 256K 上下文,适合 PR review、迁移规划、依赖分析和大文件推理
  • • OpenAI 兼容编码客户端——通过 TheRouter 接入 Cursor 类工具、Cline、Qwen Code 和自定义 SDK
  • • 需要开源权重 fallback 或自托管选择、但又不想降级到小代码模型的团队
不适合使用
  • • 原生图像、音频或视频输入——Qwen3-Coder-480B 是文本输入/文本输出;多模态任务请路由到视觉模型
  • • 需要显式深度思考 UX 的场景——它有意设计为非思考模式,不返回 <think> 块
  • • 极低成本补全或高 QPS 片段生成——当延迟和毛利优先时,使用 qwen/qwen3-coder-30b 或其他小代码模型
上下文长度
200K
最大输出
66K
输入价格每百万 tokens
$1.62每百万 Tokens
输出价格每百万 tokens
$8.10每百万 Tokens

模态能力

文本→文本

价格明细

类型费率
输入$1.62 每百万 Tokens
输出$8.10 每百万 Tokens

支持参数

temperaturemax_tokenstop_ptoolstool_choiceresponse_formatstop

模型规格

架构MoE 因果语言模型huggingface.co ↗已核实
参数规模480B 总参数 / 35B 激活参数huggingface.co ↗已核实
专家数量160 个专家;每个 token 激活 8 个huggingface.co ↗已核实
原生上下文262,144 tokens;自托管部署中可通过 YaRN 扩展到 1Mqwenlm.github.io ↗已核实
输出模式仅非思考模式;不会生成 <think> 块huggingface.co ↗已核实
训练重点7.5T 预训练 tokens,约 70% 为代码;包含代码 RL 与长链路 agent RLqwenlm.github.io ↗已核实

基准成绩

BenchmarkDistributionScoreSource
SWE-bench Verified
Together AI 对 Qwen3-Coder-480B-A35B-Instruct 的报告;在可访问官方数值表前按二级来源处理。
69.6%%together.ai ↗
Aider Polyglot
多语言代码编辑基准;来自公开二级报告,已抓取来源中未见官方 Qwen 数值表。
61.8%%medium.com ↗
Agentic Coding / Browser-Use / Tool-Use
Qwen 官方发布中的定性表述;抓取页面文本未暴露精确分数。
State-of-the-art among open modelsqwenlm.github.io ↗

API 使用示例

所有新集成都应使用下方示例中的全球端点 api.therouter.ai;旧中国加速端点已下线。

cURL
curl https://api.therouter.ai/v1/chat/completions   -H "Content-Type: application/json"   -H "Authorization: Bearer $THE_ROUTER_API_KEY"   -d '{
    "model": "qwen/qwen3-coder-480b",
    "messages": [
      {"role": "user", "content": "Summarize the key points from this input."}
    ]
  }'

API 使用指南

完整 API 参考 →

Chat 调用

使用标准 OpenAI 兼容 Chat Completions 端点。该模型在提示词包含具体文件、失败测试或明确编码约束时表现最好。

cURL
curl https://api.therouter.ai/v1/chat/completions \
  -H "Authorization: Bearer $THEROUTER_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "qwen/qwen3-coder-480b",
    "messages": [
      {"role": "system", "content": "You are a senior software engineer. Return concise patches and explain tradeoffs."},
      {"role": "user", "content": "Refactor this TypeScript function to remove duplication and preserve behavior: ..."}
    ],
    "temperature": 0.7,
    "max_tokens": 4096
  }'

qwen 其他模型

同类模型

跨供应商的相似能力档位

动态与变更

2026-02-28

Qwen3-Coder-Next 技术报告将新 80B/3B 模型与 Qwen3-Coder-480B 对比

Qwen3-Coder-Next 报告将 480B-A35B 定位为上一代旗舰代码模型,并显示 Qwen 正在按激活参数效率优化 coding-agent 能力,而不只是堆总参数量。

TheRouter 编辑重写arxiv.org ↗
2025-07-22

Qwen 发布 Qwen3-Coder-480B-A35B-Instruct 与 Qwen Code

Qwen 发布旗舰 480B/35B 激活代码 MoE,同时推出 Qwen Code——基于 Gemini Code 改造、加入 Qwen 专属提示词与函数调用协议的 CLI。

TheRouter 编辑重写qwenlm.github.io ↗
2025-07-22

Hugging Face 模型页公开架构与非思考模式细节

模型卡记录了 62 层、96 个 Q head / 8 个 KV head、160 个专家且每 token 激活 8 个、262,144 token 原生上下文,以及该模型仅支持非思考模式。

TheRouter 编辑重写huggingface.co/Qwen ↗

常见问题

Qwen3-Coder-480B 是思考模型吗?

不是。Qwen 明确说明该 checkpoint 仅支持非思考模式,不生成 <think></think> 块。这对编码客户端有利,因为返回更直接;但也意味着不应围绕可见推理轨迹设计 UX。

它支持多长上下文?

原生上下文长度是 262,144 tokens。Qwen 发布博客称可通过 YaRN 扩展到 1M tokens,但这是自托管部署/配置路径,并不代表每条托管路由都开放 1M 上下文。

能否在 Cursor、Cline 或 Claude Code 风格工具中使用?

可以,前提是客户端支持 OpenAI 兼容 Chat Completions,或可通过兼容代理转发。Qwen 发布博客专门提到 Qwen Code、Cline 和 Claude Code 风格集成路径;通过 TheRouter 最简单的方式是使用 OpenAI 兼容 /v1/chat/completions 端点与 model qwen/qwen3-coder-480b。

它和 qwen/qwen3-coder-30b 有什么区别?

480B 是大旗舰:480B 总参数、35B 激活参数。30B 同系列模型更便宜更快,为 30B 总参数 / 3B 激活参数。复杂多步仓库任务用 480B;低成本补全、小改动和高吞吐 IDE 辅助用 30B。

可以自托管 Qwen3-Coder-480B 吗?

可以,权重已发布,Qwen 提供 BF16 与 FP8 checkpoints。实际约束在硬件和服务栈:使用新版 SGLang 或 vLLM,并启用 qwen3_coder tool-call parser;如果内存压力导致无法部署完整 256K 上下文,应降低上下文长度。

事实档案 — 本页每条断言可在此回溯来源
来源URL采集于
架构huggingface.co ↗2026-06-02已核实
参数规模huggingface.co ↗2026-06-02已核实
专家数量huggingface.co ↗2026-06-02已核实
原生上下文qwenlm.github.io ↗2026-06-02已核实
输出模式huggingface.co ↗2026-06-02已核实
训练重点qwenlm.github.io ↗2026-06-02已核实
SWE-bench Verifiedtogether.ai ↗2026-06-02待核实
Aider Polyglotmedium.com ↗2026-06-02单一来源
Agentic Coding / Browser-Use / Tool-Useqwenlm.github.io ↗2026-06-02已核实
Qwen3-Coder-Next 技术报告将新 80B/3B 模型与 Qwen3-Coder-480B 对比arxiv.org ↗2026-06-02已核实
Qwen 发布 Qwen3-Coder-480B-A35B-Instruct 与 Qwen Codeqwenlm.github.io ↗2026-06-02已核实
Hugging Face 模型页公开架构与非思考模式细节huggingface.co/Qwen ↗2026-06-02已核实
Qwen3-Coder-480B 是思考模型吗?huggingface.co ↗2026-06-02待核实
它支持多长上下文?qwenlm.github.io ↗2026-06-02待核实
能否在 Cursor、Cline 或 Claude Code 风格工具中使用?qwenlm.github.io ↗2026-06-02待核实
它和 qwen/qwen3-coder-30b 有什么区别?github.com ↗2026-06-02待核实
可以自托管 Qwen3-Coder-480B 吗?huggingface.co ↗2026-06-02待核实
帮助与联系