返回模型列表

qwen3-max 是阿里巴巴 Qwen3 代的商用旗舰模型。在推理、编码、数学与复杂工具调用方面领先整个 Qwen 系列,配合 256K context window,可一次性处理仓库级代码、长文档与多轮 agent 交互轨迹。

TheRouter 同时部署在大陆(bailian-cn)与新加坡(bailian-sg)两个 Bailian endpoint。Selector 按请求选择更便宜的区域,让你获得厂商直连的延迟,无需手动指定区域。

深度推理
Qwen 系列内最强的推理、数学与工具使用评分,适合 chain-of-thought 密集型提示。
256K 上下文
单请求可容纳小型仓库或多份长 PDF — 无需复杂的分块策略。
双区域路由
按请求自动在 bailian-cn 与 bailian-sg 之间挑选更便宜的一侧 — 客户端无需任何区域逻辑。
OpenAI 兼容
标准 `/v1/chat/completions` 形态,支持 tools、JSON mode 与 streaming。
适合使用
高价值推理、复杂编码、仓库级重构以及对 Qwen 系列质量敏感、预算允许走旗舰档位的 agent 工作流。
不适合使用
高并发客服、简单改写或延迟敏感的自动补全 — 降级到 qwen-plus 或 qwen-turbo 可节省 10–20 倍成本。
计费方式:$1.50 输入 / $7.50 输出 per MTok。TheRouter 按请求路由到 bailian-cn / bailian-sg 中更便宜的一侧。
上下文长度
262K
最大输出
33K
输入价格每百万 tokens
$1.30每百万 Tokens
输出价格每百万 tokens
$6.48每百万 Tokens

模态能力

文本→文本

价格明细

类型费率
输入$1.30 每百万 Tokens
输出$6.48 每百万 Tokens

支持参数

temperaturemax_tokenstop_ptoolstool_choiceresponse_formatstop

模型规格

稳定别名qwen3-max → qwen3-max-2026-01-23www.alibabacloud.com ↗已核实
可用快照qwen3-max-2026-01-23;qwen3-max-preview;qwen3-max-2025-09-23www.alibabacloud.com ↗已核实
架构Qwen3 混合专家(MoE)架构,总参数超过 1 万亿www.alibabacloud.com ↗已核实
预训练数据36 万亿 tokenwww.alibabacloud.com ↗已核实
上下文窗口上游 256K tokenwww.alibabacloud.com ↗已核实
最大输出TheRouter 配置为 32,768 tokengithub.com ↗已核实
思考模式上游 qwen3-max 与 qwen3-max-2026-01-23 支持混合思考,默认关闭。TheRouter 的 qwen/qwen3-max public 配置当前未暴露 reasoning 参数。www.alibabacloud.com ↗已核实
API 能力通过 TheRouter 支持 OpenAI 兼容 chat、流式输出、函数调用、结构化输出 / JSON mode 和 stop sequences;阿里巴巴上游记录了内置工具,但 TheRouter 未将其表示为独立端点。www.alibabacloud.com ↗已核实
TheRouter 价格分档32K 以内为 $1.20/M 输入 + $6.00/M 输出;超过 32K 后为 $2.40/M 输入 + $12.00/M 输出。阿里巴巴还公布了 128K-256K 的第三档($3/$15),但 TheRouter 当前单阈值 schema 不能完整表达。www.alibabacloud.com ↗已核实
许可证专有(闭源权重,仅 API 访问)已核实

基准成绩

BenchmarkDistributionScoreSource
SWE-bench Verified
阿里巴巴报告 Qwen3-Max-Instruct 在 SWE-bench Verified 上达到 69.6,并将其定位为发布时顶级编码模型之一。
69.6scorealibabacloud.com ↗
Tau2-Bench
阿里巴巴将 Tau2-Bench 描述为 Agent 工具调用能力评测,并称 Qwen3-Max-Instruct 在该基准上超过 Claude Opus 4 和 DeepSeek V3.1。
74.8scorealibabacloud.com ↗
LMArena Text Arena
发布文章称 Qwen3-Max-Instruct 预览版在 Text Arena 排行榜位列全球第三,并超过 GPT-5-Chat。文章未内嵌直接榜单快照,因此这里按官方声明处理,而不是复刻榜单行。
Top-three global ranking for previewrankalibabacloud.com ↗
AIME 25 / HMMT
该成绩明确属于仍在训练中的 Qwen3-Max-Thinking 变体,并结合代码解释器与并行 test-time compute;不代表默认非思考 qwen3-max 调用路径。
100% with Qwen3-Max-Thinking + tools + scaled test-time compute%alibabacloud.com ↗

API 使用示例

所有新集成都应使用下方示例中的全球端点 api.therouter.ai;旧中国加速端点已下线。

cURL
curl https://api.therouter.ai/v1/chat/completions   -H "Content-Type: application/json"   -H "Authorization: Bearer $THE_ROUTER_API_KEY"   -d '{
    "model": "qwen/qwen3-max",
    "messages": [
      {"role": "user", "content": "Summarize the key points from this input."}
    ]
  }'

API 使用指南

完整 API 参考 →

Chat 调用

通过 TheRouter 的 OpenAI 兼容 Chat Completions 端点调用 Qwen3-Max,用于高难度文本、编码和 Agent 提示。

cURL
curl https://api.therouter.ai/v1/chat/completions \
  -H "Authorization: Bearer $THEROUTER_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "qwen/qwen3-max",
    "messages": [{"role": "user", "content": "Summarize this vendor contract and list risky clauses."}],
    "temperature": 0.2,
    "top_p": 0.8,
    "max_tokens": 4096
  }'

qwen 其他模型

同类模型

跨供应商的相似能力档位

动态与变更

2026-01-23

qwen3-max 稳定别名推进至 2026 年 1 月快照

阿里云计费表显示 qwen3-max 当前等同于 qwen3-max-2026-01-23,当前快照提供非思考与思考模式,并按最高 256K token 分档计费。

TheRouter 编辑重写alibabacloud.com ↗
2025-09-23

Qwen3-Max 作为阿里巴巴万亿参数 Qwen 旗舰发布

Qwen 团队发布 Qwen3-Max:超过 1 万亿参数、36 万亿预训练 token、以 qwen3-max 提供 OpenAI 兼容 API,并报告编码与 Agent 基准提升。

TheRouter 编辑重写alibabacloud.com ↗

常见问题

qwen/qwen3-max 和 Qwen3-Max-Instruct 是同一个模型吗?

对 TheRouter 用户来说,qwen/qwen3-max 是路由到阿里巴巴 qwen3-max chat/instruct API 的 public id。阿里巴巴发布文章将 Qwen3-Max-Instruct 的 API 模型名写作 qwen3-max,计费页则说明稳定别名当前映射到 qwen3-max-2026-01-23。

TheRouter 编辑重写www.alibabacloud.com ↗
qwen/qwen3-max 在 TheRouter 上支持思考模式吗?

上游阿里巴巴记录 qwen3-max 与 qwen3-max-2026-01-23 支持混合思考,默认关闭。TheRouter 当前 qwen/qwen3-max public 模型配置未暴露 reasoning,因此除非你的账户有 provider-specific override,否则应将 TheRouter 调用视为标准非思考 chat 路径。

TheRouter 编辑重写www.alibabacloud.com ↗
qwen/qwen3-max 支持多长上下文?

上游阿里巴巴模型列表将 qwen3-max 标注为 256K 上下文,TheRouter 配置将 qwen/qwen3-max 设置为 262,144 token、最大补全 32,768 token。如果需要 1M 上下文,请改为比较 qwen/qwen3.7-max 或 qwen/qwen3.7-plus。

TheRouter 编辑重写www.alibabacloud.com ↗
应该选 qwen3-max 还是 qwen3.7-max?

对于新的最高能力部署,请优先从 qwen3.7-max 开始,因为阿里巴巴当前指南推荐它用于最强推理和 1M 上下文。若你需要 256K 级别、已有快照行为或当前 TheRouter 价格/路由稳定性,则保留 qwen3-max。

TheRouter 编辑重写www.alibabacloud.com ↗
事实档案 — 本页每条断言可在此回溯来源
来源URL采集于
稳定别名www.alibabacloud.com ↗2026-07-30已核实
可用快照www.alibabacloud.com ↗2026-07-30已核实
架构www.alibabacloud.com ↗2026-07-30已核实
预训练数据www.alibabacloud.com ↗2026-07-30已核实
上下文窗口www.alibabacloud.com ↗2026-07-30已核实
最大输出github.com ↗2026-07-30已核实
思考模式www.alibabacloud.com ↗2026-07-30已核实
API 能力www.alibabacloud.com ↗2026-07-30已核实
TheRouter 价格分档www.alibabacloud.com ↗2026-07-30已核实
许可证——已核实
SWE-bench Verifiedalibabacloud.com ↗2026-07-30已核实
Tau2-Benchalibabacloud.com ↗2026-07-30已核实
LMArena Text Arenaalibabacloud.com ↗2026-07-30待核实
AIME 25 / HMMTalibabacloud.com ↗2026-07-30待核实
qwen3-max 稳定别名推进至 2026 年 1 月快照alibabacloud.com ↗2026-07-30已核实
Qwen3-Max 作为阿里巴巴万亿参数 Qwen 旗舰发布alibabacloud.com ↗2026-07-30已核实
qwen/qwen3-max 和 Qwen3-Max-Instruct 是同一个模型吗?www.alibabacloud.com ↗2026-07-30待核实
qwen/qwen3-max 在 TheRouter 上支持思考模式吗?www.alibabacloud.com ↗2026-07-30待核实
qwen/qwen3-max 支持多长上下文?www.alibabacloud.com ↗2026-07-30待核实
应该选 qwen3-max 还是 qwen3.7-max?www.alibabacloud.com ↗2026-07-30待核实
帮助与联系