Назад к моделям
Kimi K2 Thinking
moonshotmoonshot/kimi-k2-thinking
Гид по API
Chat completion
Стандартный chat completion для K2 Thinking. Модель генерирует внутреннюю цепочку рассуждений перед итоговым ответом. Поддерживается потоковая передача токенов рассуждений.
cURL
curl https://api.therouter.ai/v1/chat/completions \
-H "Authorization: Bearer $THEROUTER_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "moonshot/kimi-k2-thinking",
"messages": [
{"role": "system", "content": "You are a helpful AI assistant."},
{"role": "user", "content": "Design a distributed caching strategy for a global e-commerce platform."}
],
"max_tokens": 8192,
"temperature": 0.7
}'Потоковая передача с токенами рассуждений
K2 Thinking передаёт токены рассуждений в потоковом ответе. Добавьте 'include_reasoning: true' в тело запроса, чтобы получить цепочку рассуждений модели как отдельную текстовую дельту до финального контента.
cURL
curl https://api.therouter.ai/v1/chat/completions \
-H "Authorization: Bearer $THEROUTER_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "moonshot/kimi-k2-thinking",
"messages": [{"role": "user", "content": "Solve 3x^2 + 5x - 2 = 0"}],
"stream": true,
"include_reasoning": true
}'Вызов инструментов (мышление + инструменты)
K2 Thinking нативно чередует токены рассуждений с вызовами инструментов в процессе цепочки рассуждений. Модель может выполнять 200–300 последовательных вызовов инструментов в одной траектории, сохраняя стабильное состояние.
cURL
curl https://api.therouter.ai/v1/chat/completions \
-H "Authorization: Bearer $THEROUTER_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "moonshot/kimi-k2-thinking",
"messages": [
{"role": "user", "content": "Find the latest research papers on MoE architectures and summarise the top 3 findings."}
],
"tools": [{
"type": "function",
"function": {
"name": "web_search",
"description": "Search the web for information",
"parameters": {
"type": "object",
"properties": {
"query": {"type": "string", "description": "Search query"}
},
"required": ["query"]
}
}
}],
"tool_choice": "auto"
}'Реестр фактов — каждая утверждаемая величина имеет источник
| источник | URL | получено | |
|---|---|---|---|
| Дата релиза | kimi-k2.org ↗ | 2026-05-28 | проверено |
| Архитектура | huggingface.co ↗ | 2026-05-28 | проверено |
| Стоимость обучения | cnbc.com ↗ | 2026-05-28 | к проверке |
| Дисковое пространство (INT4) | huggingface.co ↗ | 2026-05-28 | проверено |
| Лицензия | huggingface.co ↗ | 2026-05-28 | проверено |
| Поддерживаемые движки инференса | huggingface.co ↗ | 2026-05-28 | проверено |
| Дата отсечения данных | — | — | неизвестно |
| Humanity's Last Exam (w/ tools) | lambda.ai ↗ | 2026-05-28 | проверено |
| BrowseComp | lambda.ai ↗ | 2026-05-28 | проверено |
| SWE-bench Verified | lambda.ai ↗ | 2026-05-28 | проверено |
| AIME 2025 (w/ Python) | www.reddit.com ↗ | 2026-05-28 | к проверке |
| GPQA-Diamond | nist.gov ↗ | 2026-05-28 | проверено |
| MMLU-Pro | nist.gov ↗ | 2026-05-28 | проверено |
| CVE-Bench | nist.gov ↗ | 2026-05-28 | проверено |
| SMT 2025 | nist.gov ↗ | 2026-05-28 | проверено |
| Moonshot AI выпускает Kimi K2 Thinking — модель рассуждений с открытыми весами и 200+ последовательными вызовами инструментов | kimi-k2.org ↗ | 2026-05-28 | проверено |
| NIST CAISI оценивает Kimi K2 Thinking — самая сильная модель с открытыми весами от разработчика из КНР на момент выпуска | nist.gov ↗ | 2026-05-28 | проверено |
| Kimi K2 Thinking запущена на 2× M3 Ultra с 15 ток/с через mlx-lm | simonwillison.net ↗ | 2026-05-28 | проверено |
| В чём разница между Kimi K2 (Instruct) и Kimi K2 Thinking? | kimi-k2.org ↗ | 2026-05-28 | к проверке |
| Могу ли я запустить Kimi K2 Thinking на потребительском оборудовании? | lambda.ai ↗ | 2026-05-28 | к проверке |
| Как K2 Thinking сравнивается с DeepSeek-R1? | lambda.ai ↗ | 2026-05-28 | к проверке |
| Является ли K2 Thinking полностью открытой? | huggingface.co ↗ | 2026-05-28 | к проверке |