公告 · 2026-05-05
2026 年 5 月 AI 新模型发布汇总:Kimi K2.6、Qwen 3.6、Gemma 4、Mistral Small 4 等五款上线
2026 年 5 月四款新模型同步上线 TheRouter:Kimi K2.6(1T MoE,编码评测追平 GPT-5.5)、 Qwen 3.6 27B(MoE,262K 上下文)、Gemma 4(Apache 2.0)、Mistral Small 4(合并推理 + 多模态 + 编码)。全部通过 OpenAI 兼容 API 即可调用。
本次新增的模型
2026 年 3 月底到 4 月底,三个主流模型家族陆续发布了重要新版本。我们对每个上游都做了 端到端真实推理验证,然后向网关追加了下面 5 个 alias。已有模型完全不动 —— 本次发布是严格“只新增不修改”,我们用一份字节级 snapshot 回归测试保证 181 个老 alias 的行为完全一致。
Moonshot — Kimi K2.6
2026-04-20 发布。Kimi K2.6 是月之暗面的 1T 参数 MoE 旗舰。 编码评测追平 GPT-5.5,但价格仍是开源权重的水平。Agent swarm 子系统从 K2.5 的 100 个 sub-agent / 1500 步扩到 K2.6 的 300 个 sub-agent / 4000 步。 Alias 为 moonshot/kimi-k2.6。
阿里 — Qwen 3.6 27B
2026-04-16 发布。Qwen 3.6 引入了 hybrid multimodal、262K 上下文、显著加强 repo 级编码能力。我们这次接入的是 27B active 的 MoE 变体。 Alias qwen/qwen3.6-27b,通过 SiliconFlow 与阿里云百炼上游路由。
Google — Gemma 4 (Apache 2.0)
2026-04-02 发布。本次接入两个服务器级别尺寸:google/gemma-4-31b-it(稠密,开源 Arena 第 3)和 google/gemma-4-26b-a4b-it(MoE,4B active,开源 Arena 第 6)。 两个都改为 Apache 2.0 license —— Gemma 系列发布以来最宽松的协议。 都支持文本 + 图像输入。
Mistral — Small 4
2026-03 发布。119B MoE / 6B active 的统一模型,把之前三个 专精模型 Magistral(推理)、Pixtral(多模态)、Devstral(agentic 编码)的能力 合并到一个模型里。默认开启 tools / vision / JSON mode。Alias mistral/mistral-small-4。
Mistral — Voxtral TTS
Voxtral TTS 尚未在 TheRouter 开放路由,接入可用后我们会另行公告。
怎么用
新 alias 通过 TheRouter 的 OpenAI 兼容 API 直接调用:
curl https://api.therouter.ai/v1/chat/completions \
-H "Authorization: Bearer $THEROUTER_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "moonshot/kimi-k2.6",
"messages": [{"role": "user", "content": "用 Rust 写一个快排"}],
"max_tokens": 1024
}'定价(美元 / 百万 token)
| 模型 | 输入 | 输出 |
|---|---|---|
moonshot/kimi-k2.6 | $1.14 | $5.40 |
qwen/qwen3.6-27b | $0.24 | $0.96 |
google/gemma-4-31b-it | $0.36 | $0.60 |
google/gemma-4-26b-a4b-it | $0.24 | $0.48 |
mistral/mistral-small-4 | $0.24 | $0.72 |
表中为发布时价格,当前计费价格以对应模型页为准。
已有模型完全不变
本次上线之前已经存在的所有模型(参见模型目录) 行为完全保持一致。我们带了一份 snapshot 回归测试,会逐字段比对 181 个老 alias 的 定价、modality、capabilities、路由 —— 任何一项漂移都会让测试失败。这次测试通过, 证明改动是严格 additive。
同期国产生态动态
同一时段,国产模型圈还有几个值得关注的进展——这些模型目前已在 TheRouter 上可用, 供有需要的团队统一调用:
- 智谱 GLM-5.1(2026-04-10 发布):智谱旗舰推理 + 编程 Agent 模型,在多项 coding benchmark 上表现突出。Alias
zhipu/glm-5.1(如已开通请查看模型目录确认可用性)。 - MiniMax M2.7:MiniMax 面向 Agent 场景的旗舰 MoE 模型,支持长文档处理与多工具调用。TheRouter 已接入
minimax/m2.7与高速变体minimax/m2.7-highspeed。 - 小米 MiMo V2.5:小米开源推理模型,支持文本、图像、音频、 视频多模态输入,推理模式可按需开启。TheRouter alias 为
xiaomi/mimo-v2.5;轻量快速版为xiaomi/mimo-v2-flash。
上述模型均通过同一 OpenAI 兼容端点调用,计费与路由规则和本批发布的五款模型完全 一致,无需额外配置。
下一波
本次未接入的型号已经登记跟进:google/gemma-4-e4b(effective 4B, 端侧用途为主,服务端是否托管待定)。等上游可用之后,会跟下一波模型一起上。
欢迎在 dashboard.therouter.ai 试用,或者直接调 API。反馈邮箱 hello@therouter.ai。