MiMo V2 两天后自动切换 V2.5:你的 API 调用会发生什么变化
小米 MiMo V2 最后一批模型将于 6 月 18 日自动切换至 V2.5:mimo-v2-flash 和 mimo-v2-tts 沿用旧名但按 V2.5 计费,部分参数行为同步改变。路由配置未更新的团队将面临静默账单变化。

这周改变你 MiMo API 成本的决定,不是"要不要迁移"——小米已经替你做了这个决定。真正的问题是:你的路由配置、账单监控和参数假设,在 6 月 18 日之前是否已经准备好。
发生了什么
小米 MiMo 平台公布了 V2 模型的下线时间表。目前有两个关键节点:
2026 年 6 月 18 日北京时间 00:00(系统替换时间): 从该时刻起,所有使用 model: mimo-v2-flash 或 model: mimo-v2-tts 发出的请求,将自动路由到 mimo-v2.5 和 mimo-v2.5-tts。旧模型名仍被接受,但会被静默重映射,计费立即切换为 V2.5 价格。
2026 年 6 月 30 日北京时间 00:00(硬下线时间): 此时间点后,使用 V2 模型名的请求将返回错误,没有任何宽限期。
此前两个模型(mimo-v2-pro 和 mimo-v2-omni)已于 6 月 1 日完成系统替换——自 6 月 1 日起,它们已分别路由到 mimo-v2.5-pro 和 mimo-v2.5。关于 V2.5 系列的能力与 API 接口,可参阅我们此前的报道:MiMo V2.5 provider 上线 以及 V2.5-Pro UltraSpeed 推理加速更新。
完整下线时间表:
| 旧模型名 | 系统替换时间 | 替换目标 | 硬下线时间 |
|---|---|---|---|
| mimo-v2-pro | 2026.6.1 00:00 北京时间 | mimo-v2.5-pro | 2026.6.30 |
| mimo-v2-omni | 2026.6.1 00:00 北京时间 | mimo-v2.5 | 2026.6.30 |
| mimo-v2-flash | 2026.6.18 00:00 北京时间 | mimo-v2.5 | 2026.6.30 |
| mimo-v2-tts | 2026.6.18 00:00 北京时间 | mimo-v2.5-tts(音色重映射) | 2026.6.30 |
为什么 AI 工程团队需要重视
账单意外。 如果你在路由规则中硬编码了 mimo-v2-flash,并以此作为成本基准,6 月 18 日之后价格将切换为 V2.5 标准——API 不会报错,请求依然成功,但日志中还是显示 mimo-v2-flash,账单却已按 V2.5 计价。
mimo-v2-flash 的参数静默改写风险。 这是更隐蔽的问题。当 mimo-v2-flash 自动路由到 mimo-v2.5 时,思考模式(thinking mode)下的参数处理逻辑发生变化:
- V2.5 在思考模式下不支持自定义
temperature和top_p。如果请求中包含这两个参数,它们将被忽略,强制使用temperature: 1.0、top_p: 0.95。 - 如果请求未指定
thinking、temperature或max_completion_tokens,系统将使用 V2.5 的默认值——与 V2-Flash 默认值不同。
这意味着:6 月 18 日起,依赖特定 temperature 设置进行思考模式推理的评估流水线或成本控制推理任务,将在不报错的情况下悄然改变输出行为。
TTS 音色重映射。 对于 mimo-v2-tts 用户:默认音色 mimo_default 将被重映射——在中文集群中映射为"冰糖",在其他集群中映射为 mia。如果你的语音输出对语言环境敏感,请在 6 月 18 日前测试 TTS 集成效果。
路由 / 运营侧的分析视角
这种"先系统替换、后硬下线"的弃用模式,是成熟 AI provider 管理模型生命周期的标准做法。运营风险不在迁移本身,而在于你的路由配置所描述的模型与实际运行的模型之间的不一致。
6 月 18 日前需完成的四项操作:
-
审查路由配置中的模型 ID。 所有仍写着
mimo-v2-flash或mimo-v2-tts的路由,将在 6 月 18 日北京时间 00:00 静默切换行为和价格。建议改为显式指定 V2.5 模型名(mimo-v2.5、mimo-v2.5-tts),让迁移成为主动决策,而非被动触发。 -
现在就确认账单基线。 登录 MiMo 控制台账单详情,记录当前按模型分类的消费数据,作为迁移前的基准,便于 6 月 18 日后立即对比。
-
排查思考模式下的参数使用情况。 如果任何
mimo-v2-flash请求在开启thinking的同时传入了显式temperature或top_p,这些参数将在 6 月 18 日后不再生效。在此之前调整请求 payload,或接受 V2.5 默认值。 -
测试 TTS 语音输出(如果使用
mimo_default)。 在 TTS 配置中切换为显式音色名称,避免音色重映射影响生产环境输出。
第三方聚合器的注意事项。 如果你通过 SiliconFlow、OpenRouter 或其他托管 gateway 使用 MiMo V2,需确认该聚合器的模型别名已同步更新。部分聚合器有自己的模型名称映射层——即使你更新了本地配置,上游别名可能仍指向旧版本,反之亦然。
TheRouter 用户建议
如果你在 TheRouter 中已将 MiMo 配置为 provider 并显式使用了 V2 模型 ID(如 xiaomi/mimo-v2-flash、xiaomi/mimo-v2-tts),请在 6 月 18 日前将路由规则更新为 V2.5 模型名。这样可以让迁移行为显式可见、可在路由日志中审计,不受小米平台静默重映射的影响。
账单监控方面:6 月 18 日后,如果你有较大体量的 MiMo Flash 用量,建议同时对照 TheRouter 用量面板与 MiMo 控制台账单页,确认 V2.5 定价已在两侧准确体现。
更广泛的模式值得关注:设置"系统替换"缓冲期的 provider,实际上是在给你时间在新模型上跑真实工作负载、验证输出质量,然后再彻底移除回退路径。好好利用这个窗口期。
相关阅读
AI 路由新闻与供应商动态 →
Kimi K2.6 今日从 NVIDIA NIM 下线:operator 必须立即评估的三条迁移路径
NVIDIA NIM 于 2026 年 7 月 7 日正式关闭 Kimi K2.6 托管 endpoint。若你的路由配置仍指向 NIM 的 Kimi K2.6 API,请求现在已经报错。本文梳理三条迁移路径,帮助 operator 在当天完成切换。

OpenAI 将于 7 月 23 日停用 Codex、深度研究和计算机操控模型:每个团队必须在 21 天内完成的路由迁移
7 月 23 日,OpenAI 将关闭 gpt-5-codex、o3-deep-research、computer-use-preview 等 14 个模型别名。若路由配置仍指向这些模型,请求将直接报错。本文列出完整的迁移清单。

Anthropic Mythos 5 routing 重启——但仅限经批准的基础设施提供商
Anthropic Mythos 5 routing 已向一批经美国政府批准的网络安全防御方和基础设施提供商恢复。Fable 5 仍处于暂停状态。以下是新访问模式对路由层的影响。