返回模型列表

Qwen Long

qwenqwen/qwen-long

10M token 长上下文 Qwen — 面向文档级分析。

供应商自营与 TheRouter 服务形态的差异

供应商自己运营时

阿里云百炼将 qwen-long 记录为 CN 承载的长上下文模型:10M token 上下文、8,192 token 输出、文入文出;HTTP 直接提交建议为 1M token,超过则建议文件提交。

在 TheRouter 上

TheRouter 在 OpenAI 兼容 chat 路径上暴露 qwen/qwen-long,目录上下文长度为 10,485,760 token,并由百炼 CN 区域承载。因此本页将 10M 视为厂商契约、10,485,760 视为 TheRouter 运行目录值,并提示直接长提示词需要验证。

qwen-long 是 Qwen 家族的长上下文专项模型。10M token 的上下文窗口可一次性吞入整本书、数百页的法律文件、完整代码库或数周的聊天记录,并在完整输入上完成回答、摘要或抽取。

本模型仅部署在大陆 Bailian endpoint(bailian-cn),没有新加坡兜底 — 如果 bailian-cn 不可用,模型即不可用。请在重试策略中考虑这一点。

10M 上下文
Qwen 家族最大的商用上下文。多数文档级任务无需分块或 map-reduce。
文档分析
擅长跨段落推理、全文问答、合同评审与多文件代码摘要。
每 token 成本极低
$0.12 输入 / $0.45 输出 per MTok — 在如此大的上下文窗口下属极致性价比。
仅 CN 部署
运行在 bailian-cn,没有新加坡兜底 — 区域固定在大陆。
适合使用
整文档分析、合同 / 法规评审、仓库级代码摘要、长转录 Q&A — 任何分块会丢失跨段上下文的场景。
不适合使用
延迟敏感的对话或必须在新加坡(bailian-sg)可用的工作负载 — qwen-long 仅在 CN 部署,且为长输入吞吐而调优,并非为快速逐轮响应优化。
计费方式:$0.12 输入 / $0.45 输出 per MTok。仅 CN 部署 — 无新加坡兜底。
上下文长度
10.5M
最大输出
8K
输入价格每百万 tokens
$0.1296每百万 Tokens
输出价格每百万 tokens
$0.486每百万 Tokens

模态能力

文本→文本

价格明细

类型费率
输入$0.1296 每百万 Tokens
输出$0.486 每百万 Tokens

支持参数

temperaturemax_tokenstop_presponse_formatstop

模型规格

上下文长度阿里云文档标注 10,000,000 token;TheRouter 目录暴露 10,485,760 tokenhelp.aliyun.com ↗已核实
HTTP 直接提交输入上限1,000,000 token;超过该长度阿里云建议通过文件方式提交help.aliyun.com ↗已核实
最大输出8,192 tokenhelp.aliyun.com ↗已核实
模态文本输入 → 文本输出help.aliyun.com ↗已核实
上游不支持能力Function calling、结构化输出、联网搜索、前缀续写、上下文缓存、批量推理与模型调优help.aliyun.com ↗已核实
中国大陆公开限流qwen-long:华北2(北京)1,200 RPM、3,000,000 TPMhelp.aliyun.com ↗已核实

基准成绩

BenchmarkDistributionScoreSource
Public long-context benchmark suite
阿里云 qwen-long 页面描述了目标任务和限制,但未为该模型发布基准表。
—未公开披露—
Document QA benchmark
替换分块检索管道前,应使用自己的长文档验收集测试。
—未公开披露—
Latency / throughput benchmark
该模型面向超大上下文;请按计划使用的提示词规模测量 TTFT 与补全延迟。
—未公开披露—

API 使用示例

所有新集成都应使用下方示例中的全球端点 api.therouter.ai;旧中国加速端点已下线。

cURL
curl https://api.therouter.ai/v1/chat/completions   -H "Content-Type: application/json"   -H "Authorization: Bearer $THE_ROUTER_API_KEY"   -d '{
    "model": "qwen/qwen-long",
    "messages": [
      {"role": "user", "content": "Summarize the key points from this input."}
    ]
  }'

API 使用指南

完整 API 参考 →

长文档 Chat

通过 OpenAI 兼容 chat 端点提交长文本提示词。除非集成中已有获批的文件提交路径,否则应遵守上游 HTTP 直接提交 1M token 的建议。

cURL
curl https://api.therouter.ai/v1/chat/completions \
  -H "Authorization: Bearer $THEROUTER_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{"model":"qwen/qwen-long","messages":[{"role":"user","content":"Summarize the attached long document text: ..."}],"max_tokens":1200}'

qwen 其他模型

同类模型

跨供应商的相似能力档位

动态与变更

2025-01-25

阿里云同时列出 qwen-long 快照、qwen-long-latest 与基础路由

qwen-long 文档列出稳定的 qwen-long 路由、动态更新的 qwen-long-latest 与快照 qwen-long-2025-01-25。三者均标注 10M 上下文与 8,192 token 输出,但稳定/latest 与快照路由的公开限流不同。

TheRouter 编辑重写help.aliyun.com ↗

常见问题

qwen/qwen-long 真的是 10M token 模型吗?

阿里云文档将 qwen-long 的最大输入长度与上下文长度标注为 10,000,000 token。同一页面也说明 HTTP 直接提交支持 1M token,超过该长度建议文件提交。TheRouter 目录暴露 10,485,760 token,因此应将 10M 视为厂商公开契约,并验证你计划运行的具体请求形态。

qwen-long 支持 function calling 或结构化输出吗?

阿里云 qwen-long 能力表标注 function calling 与结构化输出均不支持,同时不支持联网搜索、前缀续写、上下文缓存、批量推理和模型调优。通过 TheRouter 使用时,应采用普通 chat 提示词,并将 JSON 输出视为尽力遵循指令。

什么时候应选择 qwen-long,而不是 qwen-plus?

只有在上下文大小是约束时才选择 qwen-long:整文档审阅、超长转录问答、跨章节抽取或归档级摘要。普通聊天、短文本分类或延迟敏感流程通常用 qwen-plus 更简单更快。

事实档案 — 本页每条断言可在此回溯来源
来源URL采集于
上下文长度help.aliyun.com ↗2026-08-01已核实
HTTP 直接提交输入上限help.aliyun.com ↗2026-08-01已核实
最大输出help.aliyun.com ↗2026-08-01已核实
模态help.aliyun.com ↗2026-08-01已核实
上游不支持能力help.aliyun.com ↗2026-08-01已核实
中国大陆公开限流help.aliyun.com ↗2026-08-01已核实
Public long-context benchmark suitehelp.aliyun.com ↗2026-08-01未知
Document QA benchmarkhelp.aliyun.com ↗2026-08-01未知
Latency / throughput benchmarkhelp.aliyun.com ↗2026-08-01未知
阿里云同时列出 qwen-long 快照、qwen-long-latest 与基础路由help.aliyun.com ↗2026-08-01已核实
qwen/qwen-long 真的是 10M token 模型吗?help.aliyun.com ↗2026-08-01待核实
qwen-long 支持 function calling 或结构化输出吗?help.aliyun.com ↗2026-08-01待核实
什么时候应选择 qwen-long,而不是 qwen-plus?help.aliyun.com ↗2026-08-01待核实
帮助与联系