Kimi K2.7 Code API:减少 30% 思考 Token,HighSpeed 变体改变路由策略
路由含义很简单:标准 K2.7 Code 应承载普通深度编码轮次,Highspeed 应保留给延迟敏感、且双倍单价合理的循环。
Moonshot AI Kimi K2.7 Code Highspeed — accelerated inference variant of K2.7 Code. Same coding-specialist capabilities with higher throughput. 256K context.
Kimi K2.7 Code Highspeed 是 Moonshot AI 面向 K2.7 Code 代码专用模型的加速推理 SKU。在 TheRouter 上,它保持与 K2.7 Code 相同的纯文本编码 agent 形态:256K 上下文、65,536 最大输出 token、工具调用和结构化输出支持,但作为面向延迟的兄弟路由单独计价与路由。
当需要 K2.7 Code 的质量、但交互式 agent 延迟成为瓶颈时使用该路由。取舍很明确:TheRouter 目录将 Highspeed 定价为标准 K2.7 Code 的 2 倍,因此它应保留给人在回路中的编码、快速审查循环,以及节省秒级延迟比单价更重要的 agent 编排。
Moonshot 将 Highspeed 作为 Kimi K2.7 Code 平台家族的一部分,用于更快的编码 agent 推理。
TheRouter 将 moonshot/kimi-k2.7-code-highspeed 暴露为独立的文本到文本 Chat Completions 模型 ID,具备 256K 上下文、65,536 最大输出 token,并相对 moonshot/kimi-k2.7-code 采用 2 倍目录价格。
| 类型 | 费率 |
|---|---|
| 输入 | $2.05 每百万 Tokens |
| 输出 | $8.64 每百万 Tokens |
Moonshot prices -highspeed as a separate SKU at 2x the standard K2.7-code rate (platform.kimi.ai/docs/pricing/chat-k27-code, international USD card, read 2026-07-29).
| 发布日期 | 2026-06-12platform.kimi.ai ↗ | 已核实 |
| 模型家族 | Kimi K2.7 Code 加速 Highspeed 变体platform.kimi.ai ↗ | 已核实 |
| 上下文窗口 | 256,000 tokensplatform.kimi.ai ↗ | 已核实 |
| 最大输出 | 65,536 tokensplatform.kimi.ai ↗ | 已核实 |
| 目录价格 | TheRouter 上为标准 K2.7 Code 价格的 2 倍platform.kimi.ai ↗ | 已核实 |
| 训练数据截止 | 未公开披露 | 未知 |
| Benchmark | Distribution | Score | Source |
|---|---|---|---|
Kimi Code Bench v2 与 K2.7 Code 使用相同模型质量基础;Highspeed 是推理 SKU,不是单独的基准发布。 | 62.0% | platform.kimi.ai ↗ | |
Program Bench Moonshot 为 K2.7 Code 报告该分数;用它比较质量,再只在延迟重要时使用 Highspeed。 | 53.6% | platform.kimi.ai ↗ | |
MCP Mark Verified Moonshot 为 K2.7 Code 模型家族报告的 MCP 工具调用分数。 | 81.1% | platform.kimi.ai ↗ | |
Highspeed throughput target 加速 Highspeed 路由的吞吐目标;比较时应看成本归一化延迟,而不只看基准质量。 | 180 tokens/sectokens/sec | platform.kimi.ai ↗ |
所有新集成都应使用下方示例中的全球端点 api.therouter.ai;旧中国加速端点已下线。
curl https://api.therouter.ai/v1/chat/completions -H "Content-Type: application/json" -H "Authorization: Bearer $THE_ROUTER_API_KEY" -d '{
"model": "moonshot/kimi-k2.7-code-highspeed",
"messages": [
{"role": "user", "content": "Summarize the key points from this input."}
]
}'当延迟收益足以证明更高价格合理时,使用专用 Highspeed 模型 ID。
curl https://api.therouter.ai/v1/chat/completions \
-H "Authorization: Bearer $THEROUTER_API_KEY" \
-H "Content-Type: application/json" \
-d '{"model":"moonshot/kimi-k2.7-code-highspeed","messages":[{"role":"user","content":"Review this patch for release-blocking bugs."}]}'路由含义很简单:标准 K2.7 Code 应承载普通深度编码轮次,Highspeed 应保留给延迟敏感、且双倍单价合理的循环。
当人工或编排器正在等待编码 agent 结果、且更低延迟会改变体验时选择 Highspeed。后台分析、计划重构和批量生成应使用标准 K2.7 Code 路由,避免支付双倍价格。
不会。TheRouter 目录中 moonshot/kimi-k2.7-code-highspeed 保持 256K 上下文和 65,536 最大输出 token。差异在路由、吞吐和价格,而不是更大的记忆窗口。
不是。TheRouter 将 moonshot/kimi-k2.7-code-highspeed 列为文本输入到文本输出。截图、UI 图片或视频理解应路由到已登记的多模态 Moonshot 模型,例如 moonshot/kimi-k2.6。
| 来源 | URL | 采集于 | |
|---|---|---|---|
| 发布日期 | platform.kimi.ai ↗ | 2026-08-14 | 已核实 |
| 模型家族 | platform.kimi.ai ↗ | 2026-08-14 | 已核实 |
| 上下文窗口 | platform.kimi.ai ↗ | 2026-08-14 | 已核实 |
| 最大输出 | platform.kimi.ai ↗ | 2026-08-14 | 已核实 |
| 目录价格 | platform.kimi.ai ↗ | 2026-08-14 | 已核实 |
| 训练数据截止 | — | — | 未知 |
| Kimi Code Bench v2 | platform.kimi.ai ↗ | 2026-08-14 | 已核实 |
| Program Bench | platform.kimi.ai ↗ | 2026-08-14 | 已核实 |
| MCP Mark Verified | platform.kimi.ai ↗ | 2026-08-14 | 已核实 |
| Highspeed throughput target | platform.kimi.ai ↗ | 2026-08-14 | 已核实 |
| Kimi K2.7 Code API:减少 30% 思考 Token,HighSpeed 变体改变路由策略 | Kimi Open Platform ↗ | 2026-08-14 | 已核实 |
| 什么时候应该选择 Highspeed 而不是标准 K2.7 Code? | platform.kimi.ai ↗ | 2026-08-14 | 待核实 |
| Highspeed 会改变模型上下文窗口或输出上限吗? | platform.kimi.ai ↗ | 2026-08-14 | 待核实 |
| 这个路由是多模态吗? | platform.kimi.ai ↗ | 2026-08-14 | 待核实 |