公告 · 2026-05-05

2026 年 5 月 AI 新模型发布汇总:Kimi K2.6、Qwen 3.6、Gemma 4、Mistral Small 4 等五款上线

2026 年 5 月四款新模型同步上线 TheRouter:Kimi K2.6(1T MoE,编码评测追平 GPT-5.5)、 Qwen 3.6 27B(MoE,262K 上下文)、Gemma 4(Apache 2.0)、Mistral Small 4(合并推理 + 多模态 + 编码)。全部通过 OpenAI 兼容 API 即可调用。

本次新增的模型

2026 年 3 月底到 4 月底,三个主流模型家族陆续发布了重要新版本。我们对每个上游都做了 端到端真实推理验证,然后向网关追加了下面 5 个 alias。已有模型完全不动 —— 本次发布是严格“只新增不修改”,我们用一份字节级 snapshot 回归测试保证 181 个老 alias 的行为完全一致。

Moonshot — Kimi K2.6

2026-04-20 发布。Kimi K2.6 是月之暗面的 1T 参数 MoE 旗舰。 编码评测追平 GPT-5.5,但价格仍是开源权重的水平。Agent swarm 子系统从 K2.5 的 100 个 sub-agent / 1500 步扩到 K2.6 的 300 个 sub-agent / 4000 步。 Alias 为 moonshot/kimi-k2.6

阿里 — Qwen 3.6 27B

2026-04-16 发布。Qwen 3.6 引入了 hybrid multimodal、262K 上下文、显著加强 repo 级编码能力。我们这次接入的是 27B active 的 MoE 变体。 Alias qwen/qwen3.6-27b,通过 SiliconFlow 与阿里云百炼上游路由。

Google — Gemma 4 (Apache 2.0)

2026-04-02 发布。本次接入两个服务器级别尺寸:google/gemma-4-31b-it(稠密,开源 Arena 第 3)和 google/gemma-4-26b-a4b-it(MoE,4B active,开源 Arena 第 6)。 两个都改为 Apache 2.0 license —— Gemma 系列发布以来最宽松的协议。 都支持文本 + 图像输入。

Mistral — Small 4

2026-03 发布。119B MoE / 6B active 的统一模型,把之前三个 专精模型 Magistral(推理)、Pixtral(多模态)、Devstral(agentic 编码)的能力 合并到一个模型里。默认开启 tools / vision / JSON mode。Alias mistral/mistral-small-4

Mistral — Voxtral TTS

Voxtral TTS 尚未在 TheRouter 开放路由,接入可用后我们会另行公告。

怎么用

新 alias 通过 TheRouter 的 OpenAI 兼容 API 直接调用:

curl https://api.therouter.ai/v1/chat/completions \
  -H "Authorization: Bearer $THEROUTER_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "moonshot/kimi-k2.6",
    "messages": [{"role": "user", "content": "用 Rust 写一个快排"}],
    "max_tokens": 1024
  }'

定价(美元 / 百万 token)

模型输入输出
moonshot/kimi-k2.6$1.14$5.40
qwen/qwen3.6-27b$0.24$0.96
google/gemma-4-31b-it$0.36$0.60
google/gemma-4-26b-a4b-it$0.24$0.48
mistral/mistral-small-4$0.24$0.72

表中为发布时价格,当前计费价格以对应模型页为准。

已有模型完全不变

本次上线之前已经存在的所有模型(参见模型目录) 行为完全保持一致。我们带了一份 snapshot 回归测试,会逐字段比对 181 个老 alias 的 定价、modality、capabilities、路由 —— 任何一项漂移都会让测试失败。这次测试通过, 证明改动是严格 additive。

同期国产生态动态

同一时段,国产模型圈还有几个值得关注的进展——这些模型目前已在 TheRouter 上可用, 供有需要的团队统一调用:

上述模型均通过同一 OpenAI 兼容端点调用,计费与路由规则和本批发布的五款模型完全 一致,无需额外配置。

下一波

本次未接入的型号已经登记跟进:google/gemma-4-e4b(effective 4B, 端侧用途为主,服务端是否托管待定)。等上游可用之后,会跟下一波模型一起上。

欢迎在 dashboard.therouter.ai 试用,或者直接调 API。反馈邮箱 hello@therouter.ai

客服支持