阿里云同时列出 qwen-long 快照、qwen-long-latest 与基础路由
qwen-long 文档列出稳定的 qwen-long 路由、动态更新的 qwen-long-latest 与快照 qwen-long-2025-01-25。三者均标注 10M 上下文与 8,192 token 输出,但稳定/latest 与快照路由的公开限流不同。
阿里云百炼将 qwen-long 记录为 CN 承载的长上下文模型:10M token 上下文、8,192 token 输出、文入文出;HTTP 直接提交建议为 1M token,超过则建议文件提交。
TheRouter 在 OpenAI 兼容 chat 路径上暴露 qwen/qwen-long,目录上下文长度为 10,485,760 token,并由百炼 CN 区域承载。因此本页将 10M 视为厂商契约、10,485,760 视为 TheRouter 运行目录值,并提示直接长提示词需要验证。
qwen-long 是 Qwen 家族的长上下文专项模型。10M token 的上下文窗口可一次性吞入整本书、数百页的法律文件、完整代码库或数周的聊天记录,并在完整输入上完成回答、摘要或抽取。
本模型仅部署在大陆 Bailian endpoint(bailian-cn),没有新加坡兜底 — 如果 bailian-cn 不可用,模型即不可用。请在重试策略中考虑这一点。
| 类型 | 费率 |
|---|---|
| 输入 | $0.1296 每百万 Tokens |
| 输出 | $0.486 每百万 Tokens |
| 上下文长度 | 阿里云文档标注 10,000,000 token;TheRouter 目录暴露 10,485,760 tokenhelp.aliyun.com ↗ | 已核实 |
| HTTP 直接提交输入上限 | 1,000,000 token;超过该长度阿里云建议通过文件方式提交help.aliyun.com ↗ | 已核实 |
| 最大输出 | 8,192 tokenhelp.aliyun.com ↗ | 已核实 |
| 模态 | 文本输入 → 文本输出help.aliyun.com ↗ | 已核实 |
| 上游不支持能力 | Function calling、结构化输出、联网搜索、前缀续写、上下文缓存、批量推理与模型调优help.aliyun.com ↗ | 已核实 |
| 中国大陆公开限流 | qwen-long:华北2(北京)1,200 RPM、3,000,000 TPMhelp.aliyun.com ↗ | 已核实 |
| Benchmark | Distribution | Score | Source |
|---|---|---|---|
Public long-context benchmark suite 阿里云 qwen-long 页面描述了目标任务和限制,但未为该模型发布基准表。 | — | 未公开披露 | — |
Document QA benchmark 替换分块检索管道前,应使用自己的长文档验收集测试。 | — | 未公开披露 | — |
Latency / throughput benchmark 该模型面向超大上下文;请按计划使用的提示词规模测量 TTFT 与补全延迟。 | — | 未公开披露 | — |
所有新集成都应使用下方示例中的全球端点 api.therouter.ai;旧中国加速端点已下线。
curl https://api.therouter.ai/v1/chat/completions -H "Content-Type: application/json" -H "Authorization: Bearer $THE_ROUTER_API_KEY" -d '{
"model": "qwen/qwen-long",
"messages": [
{"role": "user", "content": "Summarize the key points from this input."}
]
}'通过 OpenAI 兼容 chat 端点提交长文本提示词。除非集成中已有获批的文件提交路径,否则应遵守上游 HTTP 直接提交 1M token 的建议。
curl https://api.therouter.ai/v1/chat/completions \
-H "Authorization: Bearer $THEROUTER_API_KEY" \
-H "Content-Type: application/json" \
-d '{"model":"qwen/qwen-long","messages":[{"role":"user","content":"Summarize the attached long document text: ..."}],"max_tokens":1200}'qwen-long 文档列出稳定的 qwen-long 路由、动态更新的 qwen-long-latest 与快照 qwen-long-2025-01-25。三者均标注 10M 上下文与 8,192 token 输出,但稳定/latest 与快照路由的公开限流不同。
阿里云文档将 qwen-long 的最大输入长度与上下文长度标注为 10,000,000 token。同一页面也说明 HTTP 直接提交支持 1M token,超过该长度建议文件提交。TheRouter 目录暴露 10,485,760 token,因此应将 10M 视为厂商公开契约,并验证你计划运行的具体请求形态。
阿里云 qwen-long 能力表标注 function calling 与结构化输出均不支持,同时不支持联网搜索、前缀续写、上下文缓存、批量推理和模型调优。通过 TheRouter 使用时,应采用普通 chat 提示词,并将 JSON 输出视为尽力遵循指令。
只有在上下文大小是约束时才选择 qwen-long:整文档审阅、超长转录问答、跨章节抽取或归档级摘要。普通聊天、短文本分类或延迟敏感流程通常用 qwen-plus 更简单更快。
| 来源 | URL | 采集于 | |
|---|---|---|---|
| 上下文长度 | help.aliyun.com ↗ | 2026-08-01 | 已核实 |
| HTTP 直接提交输入上限 | help.aliyun.com ↗ | 2026-08-01 | 已核实 |
| 最大输出 | help.aliyun.com ↗ | 2026-08-01 | 已核实 |
| 模态 | help.aliyun.com ↗ | 2026-08-01 | 已核实 |
| 上游不支持能力 | help.aliyun.com ↗ | 2026-08-01 | 已核实 |
| 中国大陆公开限流 | help.aliyun.com ↗ | 2026-08-01 | 已核实 |
| Public long-context benchmark suite | help.aliyun.com ↗ | 2026-08-01 | 未知 |
| Document QA benchmark | help.aliyun.com ↗ | 2026-08-01 | 未知 |
| Latency / throughput benchmark | help.aliyun.com ↗ | 2026-08-01 | 未知 |
| 阿里云同时列出 qwen-long 快照、qwen-long-latest 与基础路由 | help.aliyun.com ↗ | 2026-08-01 | 已核实 |
| qwen/qwen-long 真的是 10M token 模型吗? | help.aliyun.com ↗ | 2026-08-01 | 待核实 |
| qwen-long 支持 function calling 或结构化输出吗? | help.aliyun.com ↗ | 2026-08-01 | 待核实 |
| 什么时候应选择 qwen-long,而不是 qwen-plus? | help.aliyun.com ↗ | 2026-08-01 | 待核实 |