返回模型列表

Qwen Max

qwenqwen/qwen-max

上一代 Qwen 旗舰 — 推理与工具调用依然扎实。

qwen-max 是 Qwen 系列的上一代旗舰模型。即便 Qwen3 上线后,它在推理密集型对话、结构化输出与 function calling 工作负载中仍是稳妥选择,128K context window 足以应对长文档场景。

适合在需要旗舰行为、希望价格稳定可预测、且不需要 Qwen3 级别编码能力或 qwen3-max 的 256K 上下文时使用。TheRouter 会按请求在 bailian-cn 与 bailian-sg 之间选择更便宜的一侧。

扎实的推理
上一代 Qwen 旗舰 — 稳健的 chain-of-thought、数学与多步工具使用表现。
128K 上下文
长文档分析、大型代码评审与较长的 agent 历史都可在单次调用中完成。
Function calling
原生 tool / function calling,使用 OpenAI 兼容 schema — 无需包装 SDK。
双区域路由
Selector 按请求基于成本选择 bailian-cn 或 bailian-sg — failover 自动完成。
适合使用
推理、结构化输出与工具调用工作负载,希望使用旗舰档 Qwen 且 qwen3-max 的溢价不划算时。
不适合使用
需要 Qwen 系列最强的编码能力或 256K 上下文时,请升级到 qwen3-max;高并发低成本对话场景请降级到 qwen-plus / qwen-turbo。
计费方式:$2.00 输入 / $8.00 输出 per MTok。TheRouter 按请求选择 bailian-cn / bailian-sg 中更便宜的一侧。
上下文长度
131K
最大输出
33K
输入价格每百万 tokens
$1.73每百万 Tokens
输出价格每百万 tokens
$6.91每百万 Tokens

模态能力

文本→文本

价格明细

类型费率
输入$1.73 每百万 Tokens
输出$6.91 每百万 Tokens

支持参数

temperaturemax_tokenstop_ptoolstool_choiceresponse_formatstop

模型规格

架构大规模混合专家(MoE)——确切的激活/总参数量未公开披露qwenlm.github.io ↗待核实
预训练数据超过 20 万亿 tokenqwenlm.github.io ↗已核实
后训练监督微调(SFT)+ 基于人类反馈的强化学习(RLHF)qwenlm.github.io ↗已核实
API 可用日期(Qwen2.5-Max)2025 年 1 月 28 日(固定别名:qwen-max-2025-01-25)qwenlm.github.io ↗已核实
思考模式不支持——此代模型早于 Qwen3 的混合思考 API。如需思考模式,请使用 qwen/qwen3-32b 或更新版本。已核实
许可证专有(闭源权重,仅 API 访问)已核实
生命周期状态旧版——阿里云将 qwen-max 归类为旧版端点,新项目应使用 Qwen3.x 系列模型help.aliyun.com ↗已核实

基准成绩

BenchmarkDistributionScoreSource
Arena-Hard
根据官方 Qwen2.5-Max 博客,发布时 Qwen2.5-Max 在 Arena-Hard 上超越了 DeepSeek V3、GPT-4o 和 Claude-3.5-Sonnet。未报告确切数字分数。
SOTA at launch (Jan 2025)rankqwenlm.github.io ↗
LiveCodeBench
发布时 Qwen2.5-Max 在 LiveCodeBench 上超越了 DeepSeek V3。官方博客中未报告具体 pass@1 分数。
Above DeepSeek V3 at launchrankqwenlm.github.io ↗
GPQA-Diamond
发布时 Qwen2.5-Max 在 GPQA-Diamond 上超越了 DeepSeek V3。官方博客中未公布具体分数。
Above DeepSeek V3 at launchrankqwenlm.github.io ↗

API 使用示例

所有新集成都应使用下方示例中的全球端点 api.therouter.ai;旧中国加速端点已下线。

cURL
curl https://api.therouter.ai/v1/chat/completions   -H "Content-Type: application/json"   -H "Authorization: Bearer $THE_ROUTER_API_KEY"   -d '{
    "model": "qwen/qwen-max",
    "messages": [
      {"role": "user", "content": "Summarize the key points from this input."}
    ]
  }'

API 使用指南

完整 API 参考 →

Chat 调用

标准 OpenAI 兼容 Chat Completions。如果你在构建新项目,建议使用 qwen/qwen3-32b——同一供应商系列、现役版本、支持可选思考模式。

cURL
curl https://api.therouter.ai/v1/chat/completions \
  -H "Authorization: Bearer $THEROUTER_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "qwen/qwen-max",
    "messages": [
      {"role": "user", "content": "Summarize the key capabilities of Qwen2.5-Max."}
    ],
    "temperature": 0.7,
    "max_tokens": 1024
  }'

qwen 其他模型

同类模型

跨供应商的相似能力档位

动态与变更

2025-01-28

Qwen2.5-Max 以 qwen-max API 别名发布,发布时超越 DeepSeek V3

阿里巴巴通过 qwen-max DashScope 别名发布了 Qwen2.5-Max,报告在 Arena-Hard、LiveBench、LiveCodeBench 和 GPQA-Diamond 上超越 DeepSeek V3。该模型是一个在超过 20 万亿 token 上预训练、经过 SFT 和 RLHF 后训练的大规模 MoE。

TheRouter 编辑重写Qwen blog ↗

常见问题

TheRouter 上的 qwen/qwen-max 是什么?

qwen-max 是阿里云 DashScope 上的浮动商业别名,自 2025 年 1 月起指向大规模 MoE 模型 Qwen2.5-Max。阿里云现在将其归类为旧版端点;当前推荐的模型来自 Qwen3.x 系列。

新项目应该使用 qwen/qwen-max 吗?

不建议。通用任务使用 qwen/qwen3-32b,代码智能体使用 qwen/qwen3-coder-480b,最高质量推理使用 qwen/qwen3-235b。qwen-max 最适合保留给尚未准备好迁移的已有集成团队。

qwen/qwen-max 支持思考模式吗?

不支持。qwen-max 早于 Qwen3 的混合思考 API,不支持 reasoning 参数。如需思考模式推理,请使用 qwen/qwen3-32b 或 qwen/qwen3-235b。

qwen/qwen-max 的定价与 Qwen3 模型相比如何?

qwen/qwen-max 在 TheRouter 上的定价为输入 $2.00/MTok、输出 $8.00/MTok。qwen/qwen3-32b 定价更低,并提供混合思考模式和 131K 上下文窗口——对于大多数新工作负载是更高性价比的选择。

事实档案 — 本页每条断言可在此回溯来源
来源URL采集于
架构qwenlm.github.io ↗2026-06-10待核实
预训练数据qwenlm.github.io ↗2026-06-10已核实
后训练qwenlm.github.io ↗2026-06-10已核实
API 可用日期(Qwen2.5-Max)qwenlm.github.io ↗2026-06-10已核实
思考模式——已核实
许可证——已核实
生命周期状态help.aliyun.com ↗2026-06-10已核实
Arena-Hardqwenlm.github.io ↗2026-06-10待核实
LiveCodeBenchqwenlm.github.io ↗2026-06-10待核实
GPQA-Diamondqwenlm.github.io ↗2026-06-10待核实
Qwen2.5-Max 以 qwen-max API 别名发布,发布时超越 DeepSeek V3Qwen blog ↗2026-06-10已核实
帮助与联系