Назад к моделям

DeepSeek V3.1

deepseekdeepseek/deepseek-v3.1

DeepSeek V3.1 is a hybrid model supporting both thinking and non-thinking modes. Features enhanced tool calling capabilities for agent-based tasks. Thinking mode maintains answer quality comparable to DeepSeek-R1 with improved response times.

DeepSeek-V3.1, выпущенная 21 августа 2025 года, — первая гибридная модель DeepSeek: один чекпоинт работает либо в не-думающем режиме (deepseek-chat), либо в думающем (deepseek-reasoner) в зависимости от эндпоинта или переключателя DeepThink. Она наследует MoE-бэкбон 671B/37B активных параметров от V3, добавляет 840B токенов дообучения для длинного контекста и новый токенизатор + шаблон чата. Главный инженерный выигрыш — V3.1-Think достигает или превосходит качество DeepSeek-R1-0528, но отвечает заметно быстрее.

Для операторов TheRouter ценность очевидна: один model ID покрывает и быстрый чат, и глубокий reasoning, избавляя от необходимости поддерживать отдельную логику маршрутизации R1. Инструменты и многошаговые агентские задачи получили targeted post-training: SWE-bench Verified 66.0, SWE-bench Multilingual 54.5, Terminal-bench 31.3 — заметный рост по сравнению с R1-0528. Код под MIT, веса — под мягкой лицензией; стеки SGLang, vLLM, LMDeploy и др. уже поддерживают модель, поэтому путь self-host реален.

Когда выбирать
  • • Агентские задачи кодирования и поиска, требующие надёжных tool calls и JSON без флагманской цены
  • • Гибридные чат-интерфейсы, где часть пользователей хочет мгновенные ответы, а часть — видимый chain-of-thought; переключается эндпоинтом или флагом UI
  • • Задачи с длинным контекстом (128K), где дообучение V3.1 реально помогает — анализ репозиториев, CoT по длинным документам, многошаговые агентские циклы
  • • Self-host fallback для чувствительных к цене или compliance нагрузок — те же веса и токенизатор, что и в hosted
Когда не выбирать
  • • Vision или мультимодальный ввод — V3.1 только текст; изображения маршрутизируйте на Claude Opus 4.7, Amazon Nova 2 Lite или GPT-5o
  • • Сверхглубокие математические или исследовательские задачи, где уже есть V3.2-Speciale или V4-Pro и они предпочтительнее
  • • Продакшен-пути, которые уже должны быть на V4 — V4-Flash / V4-Pro запущены в апреле 2026 и являются текущим дефолтом
Размер контекста
128K
Максимальный вывод
33K
Цена Входза 1M токенов
$0.6264за 1 млн токенов
Цена Выходза 1M токенов
$1.81за 1 млн токенов

Модальности

Текст→Текст

Разбивка цен

ТипСтавка
Вход$0.6264 за 1 млн токенов
Выход$1.81 за 1 млн токенов

Поддерживаемые параметры

temperaturemax_tokenstop_ptoolstool_choiceresponse_formatreasoningstop

Характеристики

Дата релиза2025-08-21api-docs.deepseek.com ↗проверено
АрхитектураMoE 671B/37B активных; 840B токенов дообучения на базе V3 для длинного контекста; новый токенизатор + шаблон чатаapi-docs.deepseek.com ↗проверено
Контекстное окно128K токеновapi-docs.deepseek.com ↗проверено
Гибридные режимыdeepseek-chat → не-думающий режим; deepseek-reasoner → думающий режим (переключается через API или кнопку DeepThink в UI)api-docs.deepseek.com ↗проверено
Лицензия — кодMIThuggingface.co ↗проверено
Лицензия — весаDeepSeek Model License (коммерческое использование разрешено)huggingface.co ↗проверено
Поддерживаемые backend инференсаSGLang, vLLM, LMDeploy, TensorRT-LLM, LightLLM, DeepSeek-Infer; FP8 + BF16; NVIDIA + AMD GPU; Huawei Ascend через MindIEhuggingface.co ↗проверено
ПреемникDeepSeek-V3.2 (дек 2025) → V3.2-Speciale (временная) → V4-Flash / V4-Pro (апр 2026)проверено

Бенчмарки

BenchmarkDistributionScoreSource
SWE-bench Verified
Pass@1; значительное улучшение по сравнению с R1-0528 (44.6%)
66.0%api-docs.deepseek.com ↗
SWE-bench Multilingual
54.5%api-docs.deepseek.com ↗
Terminal-bench
31.3%api-docs.deepseek.com ↗
Aider
Превосходит Claude 3.5 Sonnet (70.6%)
71.6%localllm.in ↗
AIME 2025
Pass@1; +17.5 к R1-0528 (70.0)
87.5%api-docs.deepseek.com ↗
GPQA Diamond
74.9%localllm.in ↗
MMLU-Redux
91.8%localllm.in ↗

Примеры API

Для новых интеграций используйте глобальный endpoint api.therouter.ai из примеров ниже; старый China accelerated endpoint выведен из эксплуатации.

cURL
curl https://api.therouter.ai/v1/chat/completions   -H "Content-Type: application/json"   -H "Authorization: Bearer $THE_ROUTER_API_KEY"   -d '{
    "model": "deepseek/deepseek-v3.1",
    "messages": [
      {"role": "user", "content": "Summarize the key points from this input."}
    ]
  }'

Чат

Стандартный не-думающий чат через алиас deepseek-chat или прямой model id.

cURL
curl -X POST https://api.therouter.ai/v1/chat/completions \
  -H "Authorization: Bearer $THEROUTER_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{"model":"deepseek/deepseek-v3.1","messages":[{"role":"user","content":"Hello"}]}'

Ещё от deepseek

Похожие модели

Аналоги в других провайдерах

Новости и изменения

2026-04-24

Запуск V4-Flash / V4-Pro; старые алиасы теперь указывают на V4

Семейство DeepSeek-V4 становится дефолтом. Алиасы deepseek-chat и deepseek-reasoner теперь резолвятся в не-думающий/думающий режимы V4-Flash. V3.1 остаётся доступной, но для новых проектов больше не рекомендуется.

переработано TheRouterapi-docs.deepseek.com ↗
2025-12-01

V3.2 заменяет V3.1 на дефолтных эндпоинтах

deepseek-chat и deepseek-reasoner были обновлены до V3.2 (не-думающий/думающий). V3.1-Terminus был кратким промежуточным релизом, сфокусированным на языковой согласованности и исправлениях агентов.

переработано TheRouterapi-docs.deepseek.com ↗
2025-08-21

DeepSeek-V3.1: запуск гибридной думающей модели

Первая гибридная модель DeepSeek. Один чекпоинт поддерживает и думающий, и не-думающий режимы. Значительный рост на агентских бенчмарках (SWE-bench Verified 66.0) и быстрее мышление, чем R1-0528.

переработано TheRouterapi-docs.deepseek.com ↗

Частые вопросы

Как переключаться между думающим и не-думающим режимами?

model='deepseek-chat' — не-думающий режим, model='deepseek-reasoner' — думающий. В веб-интерфейсе переключайте кнопку DeepThink. Веса одни и те же; меняется только шаблон инференса.

Рекомендуется ли V3.1 для новых проектов?

Нет. V4-Flash / V4-Pro запущены в апреле 2026 и являются текущим дефолтом. V3.1 остаётся доступной для совместимости, но новые интеграции должны целиться в V4, если нет конкретной причины оставаться на V3.1.

Можно ли self-host V3.1?

Да. Веса опубликованы на Hugging Face под мягкой лицензией. Поддерживаемые движки: SGLang, vLLM, LMDeploy, TensorRT-LLM, LightLLM. Self-hosting даёт полный контроль над data residency и стоимостью.

Реестр фактов — каждая утверждаемая величина имеет источник
источникURLполучено
Дата релизаapi-docs.deepseek.com ↗2026-05-25проверено
Архитектураapi-docs.deepseek.com ↗2026-05-25проверено
Контекстное окноapi-docs.deepseek.com ↗2026-05-25проверено
Гибридные режимыapi-docs.deepseek.com ↗2026-05-25проверено
Лицензия — кодhuggingface.co ↗2026-05-25проверено
Лицензия — весаhuggingface.co ↗2026-05-25проверено
Поддерживаемые backend инференсаhuggingface.co ↗2026-05-25проверено
Преемник——проверено
SWE-bench Verifiedapi-docs.deepseek.com ↗2026-05-25проверено
SWE-bench Multilingualapi-docs.deepseek.com ↗2026-05-25проверено
Terminal-benchapi-docs.deepseek.com ↗2026-05-25проверено
Aiderlocalllm.in ↗2026-05-25к проверке
AIME 2025api-docs.deepseek.com ↗2026-05-25проверено
GPQA Diamondlocalllm.in ↗2026-05-25к проверке
MMLU-Reduxlocalllm.in ↗2026-05-25к проверке
Запуск V4-Flash / V4-Pro; старые алиасы теперь указывают на V4api-docs.deepseek.com ↗2026-05-25проверено
V3.2 заменяет V3.1 на дефолтных эндпоинтахapi-docs.deepseek.com ↗2026-05-25проверено
DeepSeek-V3.1: запуск гибридной думающей моделиapi-docs.deepseek.com ↗2026-05-25проверено
Как переключаться между думающим и не-думающим режимами?api-docs.deepseek.com ↗2026-05-25к проверке
Рекомендуется ли V3.1 для новых проектов?api-docs.deepseek.com ↗2026-05-25к проверке
Можно ли self-host V3.1?huggingface.co ↗2026-05-25к проверке
Помощь и контакты