返回模型列表

Qwen3 Coder 30B

qwenqwen/qwen3-coder-30b

Qwen3's efficient coding model (30B MoE, 3B active). Fast code generation at low cost.

Qwen3-Coder-30B-A3B-Instruct 是阿里 Qwen 的 Qwen3-Coder 系列中的高效率成员:30.5B 总参数 / 3.3B 激活参数的 MoE 编程模型,面向 agentic coding、工具调用和仓库级上下文,但服务成本显著低于 480B 旗舰版。模型卡将其定位为更轻量的代码模型,在保持 agent 编程、浏览器使用和基础编码任务较强表现的同时提升吞吐与可部署性。

对 TheRouter 用户而言,这是更适合高吞吐场景的实用 Qwen 代码模型:当 480B 旗舰版显得过重时,可将它用于 Cursor 类助手、Cline、代码评审预筛、测试生成和批量编码工作流。它保留 262K 原生上下文和非思考输出行为,因此生产客户端不需要从响应中剥离 <think> 块。

适合使用
  • • 高吞吐代码 agent——重复代码编辑、测试生成、静态分析摘要和批量 PR 分流,适合单次请求成本敏感的场景
  • • Cursor/Cline 类开发工具——通过 TheRouter 使用 OpenAI 兼容 chat、streaming、tools 和 response_format
  • • 长上下文代码理解——262K 原生上下文,适合大文件、依赖图和迁移说明,而无需直接使用旗舰价位模型
  • • 需要开源权重代码 fallback、且希望 agent 行为强于通用小聊天模型的团队
不适合使用
  • • 最高风险的自主重构——当失败成本很高时,路由到 qwen/qwen3-coder-480b 或前沿代码模型
  • • 原生多模态输入——该模型是文本输入/文本输出;图像任务请使用 qwen/qwen3-vl-plus 或其他视觉模型
  • • 需要显式推理轨迹的 UX——Qwen 说明该模型为非思考模式,不输出 <think> 块
上下文长度
200K
最大输出
66K
输入价格每百万 tokens
$0.486每百万 Tokens
输出价格每百万 tokens
$2.43每百万 Tokens

模态能力

文本→文本

价格明细

类型费率
输入$0.486 每百万 Tokens
输出$2.43 每百万 Tokens

支持参数

temperaturemax_tokenstop_ptoolstool_choiceresponse_formatreasoningstop

模型规格

架构MoE 因果语言模型huggingface.co ↗已核实
参数规模30.5B 总参数 / 3.3B 激活参数huggingface.co ↗已核实
层数48huggingface.co ↗已核实
专家数量128 个专家;每个 token 激活 8 个huggingface.co ↗已核实
原生上下文262,144 tokens;自托管部署中可通过 YaRN 扩展到 1Mhuggingface.co ↗已核实
输出模式仅非思考模式;不会生成 <think> 块huggingface.co ↗已核实

基准成绩

BenchmarkDistributionScoreSource
Agentic Coding / Browser-Use / Foundational Coding
30B 模型卡称其在 agent 编程、agent 浏览器使用和基础编码任务上达到开源模型中的显著表现,但抓取文本未公开精确分数。
Strong open-model performance; exact 30B-specific score not exposed in fetched model-card texthuggingface.co/Qwen ↗
SWE-Bench Verified
Qwen 系列公告讨论了 Qwen3-Coder 与 480B 旗舰版在 SWE-Bench Verified 上的表现;在阿里发布 30B 专属分数前,不应推断其成绩。
—未公开披露—

API 使用示例

所有新集成都应使用下方示例中的全球端点 api.therouter.ai;旧中国加速端点已下线。

cURL
curl https://api.therouter.ai/v1/chat/completions   -H "Content-Type: application/json"   -H "Authorization: Bearer $THE_ROUTER_API_KEY"   -d '{
    "model": "qwen/qwen3-coder-30b",
    "messages": [
      {"role": "user", "content": "Summarize the key points from this input."}
    ]
  }'

API 使用指南

完整 API 参考 →

Chat 调用

使用标准 OpenAI 兼容 Chat Completions 端点处理代码编辑、测试和解释。提示词应具体:包含目标文件、失败断言或 API 契约。

cURL
curl https://api.therouter.ai/v1/chat/completions \
  -H "Authorization: Bearer $THEROUTER_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "qwen/qwen3-coder-30b",
    "messages": [
      {"role": "system", "content": "You are a senior software engineer. Return concise patches and tests."},
      {"role": "user", "content": "Write unit tests for this parser and cover edge cases: ..."}
    ],
    "temperature": 0.7,
    "max_tokens": 4096
  }'

qwen 其他模型

同类模型

跨供应商的相似能力档位

动态与变更

2025-07-29

Qwen 发布 Qwen3-Coder-30B-A3B-Instruct

Qwen 推出 30.5B 总参数 / 3.3B 激活的轻量代码模型,在降低部署与路由成本的同时延续该系列对长上下文、agent 编码、浏览器使用和工具使用的重点。

TheRouter 编辑重写huggingface.co/Qwen ↗
2025-07-22

Qwen 发布 Qwen3-Coder 系列与 Qwen Code

Qwen3-Coder 首发公告将该系列定位为 agentic coding 产品线,并同时介绍 Qwen Code、OpenAI 兼容 API 示例、Cline 配置说明和 Claude Code 风格集成路径。

TheRouter 编辑重写qwenlm.github.io ↗

常见问题

qwen/qwen3-coder-30b 与 qwen/qwen3-coder-480b 有什么区别?

30B 是效率优先的同系列模型:30.5B 总参数 / 3.3B 激活参数,而旗舰版为 480B 总参数 / 35B 激活。高吞吐编码、测试、摘要和成本敏感 agent 用 30B;更高风险的自主编辑或更难的仓库推理再使用 480B。

Qwen3-Coder-30B 支持工具调用吗?

支持。模型卡强调 agentic coding,并包含 OpenAI 兼容的工具调用示例。通过 TheRouter 调用时,在 /v1/chat/completions 上使用标准 tools 与 tool_choice 字段即可。

它会返回隐藏推理或 <think> 块吗?

不会。Qwen 明确说明该模型仅支持非思考模式,不生成 <think></think> 块。因此它更容易用于期望直接输出的生产代码客户端。

可以从 Cursor、Cline 或其他 OpenAI 兼容客户端使用它吗?

可以。TheRouter 通过 OpenAI 兼容 chat 端点暴露该模型,因此支持设置 baseURL、API key 和 model name 的客户端都可以路由到 qwen/qwen3-coder-30b。

262K 上下文是 TheRouter 保证吗?

本精选页面记录模型的原生上下文声明,但实际运行的 context 和 max completion 仍以 standard-models.yaml 与所选上游路由为准。上线生产前请验证最大提示词。

事实档案 — 本页每条断言可在此回溯来源
来源URL采集于
架构huggingface.co ↗2026-06-03已核实
参数规模huggingface.co ↗2026-06-03已核实
层数huggingface.co ↗2026-06-03已核实
专家数量huggingface.co ↗2026-06-03已核实
原生上下文huggingface.co ↗2026-06-03已核实
输出模式huggingface.co ↗2026-06-03已核实
Agentic Coding / Browser-Use / Foundational Codinghuggingface.co/Qwen ↗2026-06-03已核实
SWE-Bench Verifiedqwenlm.github.io ↗2026-06-03未知
Qwen 发布 Qwen3-Coder-30B-A3B-Instructhuggingface.co/Qwen ↗2026-06-03已核实
Qwen 发布 Qwen3-Coder 系列与 Qwen Codeqwenlm.github.io ↗2026-06-03已核实
qwen/qwen3-coder-30b 与 qwen/qwen3-coder-480b 有什么区别?huggingface.co ↗2026-06-03待核实
Qwen3-Coder-30B 支持工具调用吗?huggingface.co ↗2026-06-03待核实
它会返回隐藏推理或 <think> 块吗?huggingface.co ↗2026-06-03待核实
可以从 Cursor、Cline 或其他 OpenAI 兼容客户端使用它吗?qwenlm.github.io ↗2026-06-03待核实
262K 上下文是 TheRouter 保证吗?huggingface.co ↗2026-06-03待核实
帮助与联系