返回模型列表

Qwen3.6 Flash

qwenqwen/qwen3.6-flash

Alibaba Qwen 3.6 Flash — fast tier. 1M context.

Qwen3.6-Flash 是阿里云百炼 Qwen3.6 系列中的轻量 Flash 档,面向需要 Qwen3 时代工具能力但要压低单位成本的团队。阿里巴巴在推荐模型表中将它与 qwen3.7-plus、qwen3.7-max 并列:1M 上下文、思考模式、函数调用、内置工具和结构化输出均标为支持。公开定位很直接:先用 Plus 取得均衡效果,当成本压降更重要且业务能接受更低质量上限时切到 Flash。

TheRouter 通过标准 OpenAI 兼容 Chat Completions 路径暴露 qwen/qwen3.6-flash。运行时配置来自 standard-models.yaml:1,000,000 token 上下文、32,768 最大补全 token、文本输入与文本输出,并支持 temperature、max_tokens、top_p、tools、tool_choice、response_format 和 stop。本整理页不覆盖在线路由字段,只记录来源账本和生产定位。

应把 Qwen3.6-Flash 当作成本控制通道,而不是更强 Qwen 模型的通用替代。它适合高频聊天、抽取、分类、摘要和办公自动化,尤其是仍需要工具调用或 JSON 输出的场景。对于更难的推理、代码代理或质量敏感请求,应保留 qwen3.7-plus 或 qwen3.7-max;在把旧版 qwen-flash 或 qwen-plus 流量迁到这个新端点前,也要先做提示回归测试。

适合使用
  • • 高频客服、内部聊天和办公生产力工作流:1M 上下文与 Qwen 工具能力比最高推理上限更重要
  • • 批量抽取、分类、摘要和结构化 JSON 生成,需要在大量长请求上降低 token 成本
  • • 长文档分拣和轻量 RAG:qwen-long 过重,而 qwen3.7-plus 的质量余量超过任务需求
  • • Plus/Max 部署的降级通道:当成本、配额或延迟承压时,可将非关键流量降级处理
不适合使用
  • • 最高风险推理、复杂编码 Agent 或以评测驱动的迁移;qwen/qwen3.7-max 或 qwen/qwen3.7-plus 通常更稳妥
  • • 视觉、视频或音频工作负载;TheRouter 当前 qwen/qwen3.6-flash 路由是文本输入到文本输出
  • • 开放权重、本地部署或再分发需求;已查阅阿里云来源描述的是 API 模型,而非可下载 checkpoint

供应商自营与 TheRouter 服务形态的差异

供应商自己运营时

阿里云百炼将 qwen3.6-flash 列为 Qwen3.6 模型,支持 1M 上下文、思考模式、函数调用、内置工具和结构化输出。上游国际价格页按 256K 输入 token 分档。

在 TheRouter 上

TheRouter 通过 OpenAI 兼容 chat 路由提供 qwen/qwen3.6-flash,目录中为文入文出、1,000,000 上下文、32,768 最大输出,并支持 temperature、max_tokens、top_p、tools、tool_choice、response_format 和 stop。当前 TheRouter 目录未将阿里巴巴的 enable_thinking 控制暴露为该路由的公开 reasoning 参数。

上下文长度
1M
最大输出
33K
输入价格每百万 tokens
$0.270每百万 Tokens
输出价格每百万 tokens
$1.62每百万 Tokens

模态能力

文本→文本

价格明细

类型费率
输入$0.270 每百万 Tokens
输出$1.62 每百万 Tokens

支持参数

temperaturemax_tokenstop_ptoolstool_choiceresponse_formatstop

模型规格

上下文窗口1,000,000 tokenalibabacloud.com ↗已核实
思考模式阿里巴巴列出 qwen3.6-flash 支持思考模式;TheRouter 当前该路由的公开参数列表未暴露 reasoning 参数alibabacloud.com ↗已核实
工具能力上游列为支持函数调用、内置工具和结构化输出;TheRouter 暴露 tools、tool_choice 和 response_formatalibabacloud.com ↗已核实
模态TheRouter 上为文本输入;文本输出已核实
最大补全standard-models.yaml 中为 32,768 token已核实
上游标价 — 国际 ≤256K每 1M token 输入 $0.25 / 输出 $1.50alibabacloud.com ↗已核实
上游标价 — 国际 256K–1M每 1M token 输入 $1.00 / 输出 $4.00alibabacloud.com ↗已核实
训练数据截止未公开披露未知
授权 / 权重已查阅阿里云来源未发现公开开放权重版本未知

基准成绩

BenchmarkDistributionScoreSource
Official benchmark table
已查阅的阿里云百炼页面按能力、上下文和价格定位 qwen3.6-flash,但未发布该端点的通用基准表。替换 Plus 或 Max 流量前,应以生产评测为必需步骤。
—未公开披露—
Coding benchmark table
阿里巴巴建议编码工具优先使用 qwen3.7-plus,并将 qwen3.6-flash 定位为轻量低成本档。本次使用的免费公开来源未找到 qwen3.6-flash 的 SWE-bench、LiveCodeBench 或 agentic coding 得分。
—未公开披露—
Latency benchmark table
Flash 定位意味着更快、更便宜的服务通道,但本次未找到 qwen3.6-flash 的官方 TTFT、tokens/sec 或延迟分布。发布延迟承诺前,请用自己的请求组合实测。
—未公开披露—

API 使用示例

所有新集成都应使用下方示例中的全球端点 api.therouter.ai;旧中国加速端点已下线。

cURL
curl https://api.therouter.ai/v1/chat/completions   -H "Content-Type: application/json"   -H "Authorization: Bearer $THE_ROUTER_API_KEY"   -d '{
    "model": "qwen/qwen3.6-flash",
    "messages": [
      {"role": "user", "content": "Summarize the key points from this input."}
    ]
  }'

API 使用指南

完整 API 参考 →

Chat 调用

通过 TheRouter 的 OpenAI 兼容 Chat Completions 端点调用 Qwen3.6-Flash,用于低成本长上下文文本工作负载。

cURL
curl https://api.therouter.ai/v1/chat/completions \
  -H "Authorization: Bearer $THEROUTER_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "qwen/qwen3.6-flash",
    "messages": [
      {"role": "system", "content": "Return concise JSON."},
      {"role": "user", "content": "Classify these support tickets by urgency and product area."}
    ],
    "temperature": 0.1,
    "top_p": 0.8,
    "max_tokens": 1200,
    "response_format": {"type": "json_object"}
  }'

qwen 其他模型

同类模型

跨供应商的相似能力档位

动态与变更

2026-08-10

阿里云百炼继续将 Qwen3.6-Flash 放在推荐低成本通道

当前百炼文本生成指南将 qwen3.6-flash 列为降低成本的轻量 Qwen 选择,同时保留 1M 上下文、思考模式、函数调用、内置工具和结构化输出。

TheRouter 编辑重写alibabacloud.com ↗

近期动态

常见问题

什么时候应选择 qwen/qwen3.6-flash 而不是 qwen/qwen3.7-plus?

当成本和吞吐比 Plus 的质量余量更重要时选择 Qwen3.6-Flash,尤其是高频纯文本摘要、抽取、分类和客服自动化。需要多模态输入,或答案质量比 token 账单更重要时,应保留 Plus。

TheRouter 编辑重写alibabacloud.com ↗
qwen/qwen3.6-flash 支持工具调用和 JSON 输出吗?

支持。阿里巴巴列出 qwen3.6-flash 支持函数调用、内置工具和结构化输出;TheRouter 路由的支持参数中也包含 tools、tool_choice 和 response_format。在依赖严格下游解析器前,请在自己的集成中验证具体 schema 行为。

TheRouter 编辑重写alibabacloud.com ↗
Qwen3.6-Flash 上游如何计费?

阿里巴巴国际价格页列出 qwen3.6-flash 在 ≤256K 输入时每 1M token 输入 $0.25、输出 $1.50;256K 到 1M 时输入 $1.00、输出 $4.00。TheRouter 可能应用自己的路由价格;实际计费以实时模型页和账户账单为准。

TheRouter 编辑重写alibabacloud.com ↗
Qwen3.6-Flash 是开源的吗?

本次查阅的阿里云来源中未发现公开开放权重 checkpoint。除非阿里巴巴另行发布可下载模型卡,否则应将 qwen/qwen3.6-flash 视为 API 路由。

TheRouter 编辑重写alibabacloud.com ↗
事实档案 — 本页每条断言可在此回溯来源
来源URL采集于
上下文窗口alibabacloud.com ↗2026-08-10已核实
思考模式alibabacloud.com ↗2026-08-10已核实
工具能力alibabacloud.com ↗2026-08-10已核实
模态——已核实
最大补全——已核实
上游标价 — 国际 ≤256Kalibabacloud.com ↗2026-08-10已核实
上游标价 — 国际 256K–1Malibabacloud.com ↗2026-08-10已核实
训练数据截止——未知
授权 / 权重——未知
Official benchmark tablealibabacloud.com ↗2026-08-10未知
Coding benchmark tablealibabacloud.com ↗2026-08-10未知
Latency benchmark tablealibabacloud.com ↗2026-08-10未知
阿里云百炼继续将 Qwen3.6-Flash 放在推荐低成本通道alibabacloud.com ↗2026-08-10已核实
什么时候应选择 qwen/qwen3.6-flash 而不是 qwen/qwen3.7-plus?alibabacloud.com ↗2026-08-10待核实
qwen/qwen3.6-flash 支持工具调用和 JSON 输出吗?alibabacloud.com ↗2026-08-10待核实
Qwen3.6-Flash 上游如何计费?alibabacloud.com ↗2026-08-10待核实
Qwen3.6-Flash 是开源的吗?alibabacloud.com ↗2026-08-10待核实
帮助与联系