Qwen2.5-Max 以 qwen-max API 别名发布,发布时超越 DeepSeek V3
阿里巴巴通过 qwen-max DashScope 别名发布了 Qwen2.5-Max,报告在 Arena-Hard、LiveBench、LiveCodeBench 和 GPQA-Diamond 上超越 DeepSeek V3。该模型是一个在超过 20 万亿 token 上预训练、经过 SFT 和 RLHF 后训练的大规模 MoE。
上一代 Qwen 旗舰 — 推理与工具调用依然扎实。
qwen-max 是 Qwen 系列的上一代旗舰模型。即便 Qwen3 上线后,它在推理密集型对话、结构化输出与 function calling 工作负载中仍是稳妥选择,128K context window 足以应对长文档场景。
适合在需要旗舰行为、希望价格稳定可预测、且不需要 Qwen3 级别编码能力或 qwen3-max 的 256K 上下文时使用。TheRouter 会按请求在 bailian-cn 与 bailian-sg 之间选择更便宜的一侧。
| 类型 | 费率 |
|---|---|
| 输入 | $1.73 每百万 Tokens |
| 输出 | $6.91 每百万 Tokens |
| 架构 | 大规模混合专家(MoE)——确切的激活/总参数量未公开披露qwenlm.github.io ↗ | 待核实 |
| 预训练数据 | 超过 20 万亿 tokenqwenlm.github.io ↗ | 已核实 |
| 后训练 | 监督微调(SFT)+ 基于人类反馈的强化学习(RLHF)qwenlm.github.io ↗ | 已核实 |
| API 可用日期(Qwen2.5-Max) | 2025 年 1 月 28 日(固定别名:qwen-max-2025-01-25)qwenlm.github.io ↗ | 已核实 |
| 思考模式 | 不支持——此代模型早于 Qwen3 的混合思考 API。如需思考模式,请使用 qwen/qwen3-32b 或更新版本。 | 已核实 |
| 许可证 | 专有(闭源权重,仅 API 访问) | 已核实 |
| 生命周期状态 | 旧版——阿里云将 qwen-max 归类为旧版端点,新项目应使用 Qwen3.x 系列模型help.aliyun.com ↗ | 已核实 |
| Benchmark | Distribution | Score | Source |
|---|---|---|---|
Arena-Hard 根据官方 Qwen2.5-Max 博客,发布时 Qwen2.5-Max 在 Arena-Hard 上超越了 DeepSeek V3、GPT-4o 和 Claude-3.5-Sonnet。未报告确切数字分数。 | SOTA at launch (Jan 2025)rank | qwenlm.github.io ↗ | |
LiveCodeBench 发布时 Qwen2.5-Max 在 LiveCodeBench 上超越了 DeepSeek V3。官方博客中未报告具体 pass@1 分数。 | Above DeepSeek V3 at launchrank | qwenlm.github.io ↗ | |
GPQA-Diamond 发布时 Qwen2.5-Max 在 GPQA-Diamond 上超越了 DeepSeek V3。官方博客中未公布具体分数。 | Above DeepSeek V3 at launchrank | qwenlm.github.io ↗ |
所有新集成都应使用下方示例中的全球端点 api.therouter.ai;旧中国加速端点已下线。
curl https://api.therouter.ai/v1/chat/completions -H "Content-Type: application/json" -H "Authorization: Bearer $THE_ROUTER_API_KEY" -d '{
"model": "qwen/qwen-max",
"messages": [
{"role": "user", "content": "Summarize the key points from this input."}
]
}'标准 OpenAI 兼容 Chat Completions。如果你在构建新项目,建议使用 qwen/qwen3-32b——同一供应商系列、现役版本、支持可选思考模式。
curl https://api.therouter.ai/v1/chat/completions \
-H "Authorization: Bearer $THEROUTER_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "qwen/qwen-max",
"messages": [
{"role": "user", "content": "Summarize the key capabilities of Qwen2.5-Max."}
],
"temperature": 0.7,
"max_tokens": 1024
}'阿里巴巴通过 qwen-max DashScope 别名发布了 Qwen2.5-Max,报告在 Arena-Hard、LiveBench、LiveCodeBench 和 GPQA-Diamond 上超越 DeepSeek V3。该模型是一个在超过 20 万亿 token 上预训练、经过 SFT 和 RLHF 后训练的大规模 MoE。
qwen-max 是阿里云 DashScope 上的浮动商业别名,自 2025 年 1 月起指向大规模 MoE 模型 Qwen2.5-Max。阿里云现在将其归类为旧版端点;当前推荐的模型来自 Qwen3.x 系列。
不建议。通用任务使用 qwen/qwen3-32b,代码智能体使用 qwen/qwen3-coder-480b,最高质量推理使用 qwen/qwen3-235b。qwen-max 最适合保留给尚未准备好迁移的已有集成团队。
不支持。qwen-max 早于 Qwen3 的混合思考 API,不支持 reasoning 参数。如需思考模式推理,请使用 qwen/qwen3-32b 或 qwen/qwen3-235b。
qwen/qwen-max 在 TheRouter 上的定价为输入 $2.00/MTok、输出 $8.00/MTok。qwen/qwen3-32b 定价更低,并提供混合思考模式和 131K 上下文窗口——对于大多数新工作负载是更高性价比的选择。
| 来源 | URL | 采集于 | |
|---|---|---|---|
| 架构 | qwenlm.github.io ↗ | 2026-06-10 | 待核实 |
| 预训练数据 | qwenlm.github.io ↗ | 2026-06-10 | 已核实 |
| 后训练 | qwenlm.github.io ↗ | 2026-06-10 | 已核实 |
| API 可用日期(Qwen2.5-Max) | qwenlm.github.io ↗ | 2026-06-10 | 已核实 |
| 思考模式 | — | — | 已核实 |
| 许可证 | — | — | 已核实 |
| 生命周期状态 | help.aliyun.com ↗ | 2026-06-10 | 已核实 |
| Arena-Hard | qwenlm.github.io ↗ | 2026-06-10 | 待核实 |
| LiveCodeBench | qwenlm.github.io ↗ | 2026-06-10 | 待核实 |
| GPQA-Diamond | qwenlm.github.io ↗ | 2026-06-10 | 待核实 |
| Qwen2.5-Max 以 qwen-max API 别名发布,发布时超越 DeepSeek V3 | Qwen blog ↗ | 2026-06-10 | 已核实 |