Qwen 发布 Qwen3-Coder-30B-A3B-Instruct
Qwen 推出 30.5B 总参数 / 3.3B 激活的轻量代码模型,在降低部署与路由成本的同时延续该系列对长上下文、agent 编码、浏览器使用和工具使用的重点。
Qwen3's efficient coding model (30B MoE, 3B active). Fast code generation at low cost.
Qwen3-Coder-30B-A3B-Instruct 是阿里 Qwen 的 Qwen3-Coder 系列中的高效率成员:30.5B 总参数 / 3.3B 激活参数的 MoE 编程模型,面向 agentic coding、工具调用和仓库级上下文,但服务成本显著低于 480B 旗舰版。模型卡将其定位为更轻量的代码模型,在保持 agent 编程、浏览器使用和基础编码任务较强表现的同时提升吞吐与可部署性。
对 TheRouter 用户而言,这是更适合高吞吐场景的实用 Qwen 代码模型:当 480B 旗舰版显得过重时,可将它用于 Cursor 类助手、Cline、代码评审预筛、测试生成和批量编码工作流。它保留 262K 原生上下文和非思考输出行为,因此生产客户端不需要从响应中剥离 <think> 块。
| 类型 | 费率 |
|---|---|
| 输入 | $0.486 每百万 Tokens |
| 输出 | $2.43 每百万 Tokens |
| 架构 | MoE 因果语言模型huggingface.co ↗ | 已核实 |
| 参数规模 | 30.5B 总参数 / 3.3B 激活参数huggingface.co ↗ | 已核实 |
| 层数 | 48huggingface.co ↗ | 已核实 |
| 专家数量 | 128 个专家;每个 token 激活 8 个huggingface.co ↗ | 已核实 |
| 原生上下文 | 262,144 tokens;自托管部署中可通过 YaRN 扩展到 1Mhuggingface.co ↗ | 已核实 |
| 输出模式 | 仅非思考模式;不会生成 <think> 块huggingface.co ↗ | 已核实 |
| Benchmark | Distribution | Score | Source |
|---|---|---|---|
Agentic Coding / Browser-Use / Foundational Coding 30B 模型卡称其在 agent 编程、agent 浏览器使用和基础编码任务上达到开源模型中的显著表现,但抓取文本未公开精确分数。 | Strong open-model performance; exact 30B-specific score not exposed in fetched model-card text | huggingface.co/Qwen ↗ | |
SWE-Bench Verified Qwen 系列公告讨论了 Qwen3-Coder 与 480B 旗舰版在 SWE-Bench Verified 上的表现;在阿里发布 30B 专属分数前,不应推断其成绩。 | — | 未公开披露 | — |
所有新集成都应使用下方示例中的全球端点 api.therouter.ai;旧中国加速端点已下线。
curl https://api.therouter.ai/v1/chat/completions -H "Content-Type: application/json" -H "Authorization: Bearer $THE_ROUTER_API_KEY" -d '{
"model": "qwen/qwen3-coder-30b",
"messages": [
{"role": "user", "content": "Summarize the key points from this input."}
]
}'使用标准 OpenAI 兼容 Chat Completions 端点处理代码编辑、测试和解释。提示词应具体:包含目标文件、失败断言或 API 契约。
curl https://api.therouter.ai/v1/chat/completions \
-H "Authorization: Bearer $THEROUTER_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "qwen/qwen3-coder-30b",
"messages": [
{"role": "system", "content": "You are a senior software engineer. Return concise patches and tests."},
{"role": "user", "content": "Write unit tests for this parser and cover edge cases: ..."}
],
"temperature": 0.7,
"max_tokens": 4096
}'Qwen 推出 30.5B 总参数 / 3.3B 激活的轻量代码模型,在降低部署与路由成本的同时延续该系列对长上下文、agent 编码、浏览器使用和工具使用的重点。
Qwen3-Coder 首发公告将该系列定位为 agentic coding 产品线,并同时介绍 Qwen Code、OpenAI 兼容 API 示例、Cline 配置说明和 Claude Code 风格集成路径。
30B 是效率优先的同系列模型:30.5B 总参数 / 3.3B 激活参数,而旗舰版为 480B 总参数 / 35B 激活。高吞吐编码、测试、摘要和成本敏感 agent 用 30B;更高风险的自主编辑或更难的仓库推理再使用 480B。
支持。模型卡强调 agentic coding,并包含 OpenAI 兼容的工具调用示例。通过 TheRouter 调用时,在 /v1/chat/completions 上使用标准 tools 与 tool_choice 字段即可。
不会。Qwen 明确说明该模型仅支持非思考模式,不生成 <think></think> 块。因此它更容易用于期望直接输出的生产代码客户端。
可以。TheRouter 通过 OpenAI 兼容 chat 端点暴露该模型,因此支持设置 baseURL、API key 和 model name 的客户端都可以路由到 qwen/qwen3-coder-30b。
本精选页面记录模型的原生上下文声明,但实际运行的 context 和 max completion 仍以 standard-models.yaml 与所选上游路由为准。上线生产前请验证最大提示词。
| 来源 | URL | 采集于 | |
|---|---|---|---|
| 架构 | huggingface.co ↗ | 2026-06-03 | 已核实 |
| 参数规模 | huggingface.co ↗ | 2026-06-03 | 已核实 |
| 层数 | huggingface.co ↗ | 2026-06-03 | 已核实 |
| 专家数量 | huggingface.co ↗ | 2026-06-03 | 已核实 |
| 原生上下文 | huggingface.co ↗ | 2026-06-03 | 已核实 |
| 输出模式 | huggingface.co ↗ | 2026-06-03 | 已核实 |
| Agentic Coding / Browser-Use / Foundational Coding | huggingface.co/Qwen ↗ | 2026-06-03 | 已核实 |
| SWE-Bench Verified | qwenlm.github.io ↗ | 2026-06-03 | 未知 |
| Qwen 发布 Qwen3-Coder-30B-A3B-Instruct | huggingface.co/Qwen ↗ | 2026-06-03 | 已核实 |
| Qwen 发布 Qwen3-Coder 系列与 Qwen Code | qwenlm.github.io ↗ | 2026-06-03 | 已核实 |
| qwen/qwen3-coder-30b 与 qwen/qwen3-coder-480b 有什么区别? | huggingface.co ↗ | 2026-06-03 | 待核实 |
| Qwen3-Coder-30B 支持工具调用吗? | huggingface.co ↗ | 2026-06-03 | 待核实 |
| 它会返回隐藏推理或 <think> 块吗? | huggingface.co ↗ | 2026-06-03 | 待核实 |
| 可以从 Cursor、Cline 或其他 OpenAI 兼容客户端使用它吗? | qwenlm.github.io ↗ | 2026-06-03 | 待核实 |
| 262K 上下文是 TheRouter 保证吗? | huggingface.co ↗ | 2026-06-03 | 待核实 |