Назад к моделям

DeepSeek V4 Pro

deepseekdeepseek/deepseek-v4-pro

DeepSeek V4 Pro — high-capability model with 1M context window. Superior reasoning, coding, and agent performance with tool calling and structured output.

DeepSeek-V4-Pro — флагманский вариант превью DeepSeek V4 апреля 2026 года. Это MoE-модель 1.6T параметров всего / 49B активных с контекстом 1M токенов и архитектурой Compressed Sparse Attention (CSA). Выпущена вместе с меньшей V4-Flash (284B / 13B активных). Pro ориентирована на нагрузки, требующие frontier-уровня агентного кодирования, глубокого reasoning и фактической надёжности, где больший бюджет параметров даёт измеримый прирост.

Для оператора TheRouter V4-Pro — выбор среди open-weight моделей, когда галлюцинационно-чувствительные enterprise-стэки, многошаговые агентные циклы или graduate-level STEM-задачи оправдывают более высокую стоимость за токен. Поддерживает тот же API режима мышления, что и V4-Flash (non-thinking / high / max), и полностью OpenAI-совместима через api.therouter.ai/v1. DeepSeek сообщает, что при контексте 1M Pro использует 27% FLOPs и 10% KV cache по сравнению с V3.2 — всё ещё радикально эффективнее предыдущих поколений несмотря на большее число активных параметров.

Когда выбирать
  • • Галлюцинационно-чувствительные enterprise- или regulated-нагрузки — официальный запуск V4 позиционирует Pro как более сильный вариант по world knowledge
  • • Глубокие многошаговые агентные циклы coding и tool-use — официальный запуск DeepSeek подчёркивает enhanced agentic capabilities и open-source SOTA agentic coding
  • • Graduate-level математика, STEM и длинноконтекстное factual recall, где больший tier Pro на 49B active parameters и native 1M context оправдывают доплату
  • • Стоимостно-нечувствительный frontier reasoning — официальный запуск V4 утверждает, что Pro rivals top closed-source models, а Flash является economical tier
Когда не выбирать
  • • Высоконагруженный продакшен reasoning или RAG — Flash при max-усилии даёт качество близкое к Pro, но стоимость вывода примерно в 3 раза ниже; рациональный выбор по умолчанию для большинства нагрузок
  • • Vision или мультимодальный ввод — V4-Pro text-only; для изображений маршрутизируйте на Claude Opus 4.7, Amazon Nova 2 Lite или GPT-5.4
  • • Крайне чувствительные к задержкам чаты — когда даже overhead мышления Pro неприемлем; лучше non-thinking режим или меньшие модели

Чем обслуживание в TheRouter отличается от вендорского

Как её эксплуатирует вендор

DeepSeek first-party отдаёт V4-Pro на api.deepseek.com и api.deepseek.com/anthropic, с OpenAI Chat Completions и Anthropic-compatible форматами, контекстом 1M, максимумом вывода 384K, включённым по умолчанию thinking на high effort и без Responses API для Pro на цитируемой странице pricing.

На TheRouter

TheRouter отдаёт ту же модель через api.therouter.ai/v1/chat/completions как OpenAI-compatible routed endpoint. Запросы наследуют routing аккаунта TheRouter, выбор upstream, regional policy, нормализацию tool-call и цены TheRouter, а не точно first-party concurrency limits или billing rates DeepSeek.

Размер контекста
1M
Максимальный вывод
384K
Цена Входза 1M токенов
$0.7128за 1 млн токенов
Цена Выходза 1M токенов
$2.14за 1 млн токенов

Модальности

Текст→Текст

Разбивка цен

ТипСтавка
Вход$0.7128 за 1 млн токенов
Выход$2.14 за 1 млн токенов

Поддерживаемые параметры

temperaturetop_pfrequency_penaltypresence_penaltymax_tokensmax_completion_tokensstoptoolstool_choiceresponse_formatstreamreasoning

Характеристики

Дата релиза (превью)2026-04-24api-docs.deepseek.com ↗проверено
Архитектура1.6T всего / 49B активных MoE; Compressed Sparse Attention (CSA) + DeepSeek Sparse Attention (DSA); нативный контекст 1Mapi-docs.deepseek.com ↗проверено
Контекстное окно1 000 000 токеновapi-docs.deepseek.com ↗проверено
Максимальный вывод384 000 токеновapi-docs.deepseek.com ↗проверено
Режимы мышленияNon-thinking, Thinking (high / max); reasoning_content возвращается отдельноapi-docs.deepseek.com ↗проверено
Лицензия — кодMIThuggingface.co ↗проверено
Лицензия — весаDeepSeek Model License (коммерческое использование разрешено)huggingface.co ↗проверено
Открытые весаДа — доступны на Hugging Facehuggingface.co ↗проверено
Токены претрейнаНе раскрыто публично в launch notes V4, model card, pricing page или thinking-mode guide DeepSeekapi-docs.deepseek.com ↗неизвестно

Бенчмарки

BenchmarkDistributionScoreSource
Artificial Analysis Intelligence Index
Официальный запуск V4 утверждает, что Pro rivals top closed-source models, но цитируемые vendor pages не публикуют score Artificial Analysis Intelligence Index для V4-Pro.
—Не раскрыто—
LiveCodeBench Pass@1
Официальный запуск V4 описывает Pro как open-source SOTA on agentic coding benchmarks, но не публикует LiveCodeBench Pass@1 score на цитируемой vendor page.
—Не раскрыто—
MMLU-Pro
Официальный анонс V4 заявляет rich world knowledge для Pro, но цитируемые страницы DeepSeek не раскрывают named MMLU-Pro score.
—Не раскрыто—
GPQA Diamond
Официальный запуск V4 говорит, что Pro beats current open models in Math/STEM/Coding, но цитируемые vendor pages не публикуют GPQA Diamond score.
—Не раскрыто—
SWE-bench Verified
Официальный запуск отмечает силу agentic coding, но не раскрывает SWE-bench Verified score для V4-Pro в цитируемых vendor sources.
—Не раскрыто—
Terminal-Bench 2.0
Запуск DeepSeek позиционирует Pro для enhanced agentic capabilities, но Terminal-Bench 2.0 score публично не раскрыт в цитируемых vendor sources.
—Не раскрыто—
SimpleQA-Verified
Официальный запуск V4 говорит, что Pro leads current open models on world knowledge, но цитируемые vendor pages не раскрывают SimpleQA-Verified score.
—Не раскрыто—
BrowseComp
Официальный запуск DeepSeek в целом отмечает agent capabilities, но не публикует BrowseComp score для V4-Pro на цитируемых vendor pages.
—Не раскрыто—

Примеры API

Для новых интеграций используйте глобальный endpoint api.therouter.ai из примеров ниже; старый China accelerated endpoint выведен из эксплуатации.

cURL
curl https://api.therouter.ai/v1/chat/completions   -H "Content-Type: application/json"   -H "Authorization: Bearer $THE_ROUTER_API_KEY"   -d '{
    "model": "deepseek/deepseek-v4-pro",
    "messages": [
      {"role": "user", "content": "Summarize the key points from this input."}
    ]
  }'

Chat Completions

Стандартный OpenAI-совместимый чат-эндпоинт. Поддерживает non-thinking и thinking режимы.

cURL
curl https://api.therouter.ai/v1/chat/completions \
  -H "Authorization: Bearer $THEROUTER_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "deepseek/deepseek-v4-pro",
    "messages": [{"role":"user","content":"Explain quantum error correction in 3 sentences."}]
  }'

Ещё от deepseek

Похожие модели

Аналоги в других провайдерах

Новости и изменения

2026-05-22

DeepSeek делает 75% скидку на V4-Pro постоянной

С немедленным вступлением в силу цена deepseek-v4-pro input/output переходит с промо-цены $0.435/$0.87 на постоянную. Цена cache-hit input также снижена до $0.003625/1M. TheRouter сохраняет цену $2.50/$5.00.

переработано TheRouterapi-docs.deepseek.com ↗
2026-04-24

Запуск серии DeepSeek V4: контекст 1M и двухуровневая MoE-архитектура

DeepSeek одновременно выпустила V4-Pro (1.6T/49B) и V4-Flash (284B/13B). Обе поддерживают нативный контекст 1M, режим мышления и OpenAI/Anthropic-совместимые API. deepseek-chat и deepseek-reasoner будут выведены 24 июля 2026.

переработано TheRouterapi-docs.deepseek.com ↗

Свежие материалы

Частые вопросы

Когда стоит выбирать V4-Pro вместо V4-Flash?

Выбирайте V4-Pro, когда фактическая точность, глубокие agent loops или graduate-level STEM-задачи достаточно критичны, чтобы оправдать tier Pro. Официальный запуск DeepSeek позиционирует Pro как более сильную модель для agentic coding, rich world knowledge и Math/STEM/Coding; для большинства высоконагруженных production workloads V4-Flash остаётся economical default.

переработано TheRouterapi-docs.deepseek.com ↗
Поддерживает ли V4-Pro тот же API режима мышления, что и V4-Flash?

Да. Обе модели используют идентичные параметры extra_body: { thinking: { type: "enabled" } } и reasoning_effort (high/max). Поле reasoning_content возвращается на том же уровне, что и content.

Реестр фактов — каждая утверждаемая величина имеет источник
источникURLполучено
Дата релиза (превью)api-docs.deepseek.com ↗2026-05-25проверено
Архитектураapi-docs.deepseek.com ↗2026-05-25проверено
Контекстное окноapi-docs.deepseek.com ↗2026-05-25проверено
Максимальный выводapi-docs.deepseek.com ↗2026-05-25проверено
Режимы мышленияapi-docs.deepseek.com ↗2026-05-25проверено
Лицензия — кодhuggingface.co ↗2026-05-25проверено
Лицензия — весаhuggingface.co ↗2026-05-25проверено
Открытые весаhuggingface.co ↗2026-05-25проверено
Токены претрейнаapi-docs.deepseek.com ↗2026-08-07неизвестно
Artificial Analysis Intelligence Indexapi-docs.deepseek.com ↗2026-08-07неизвестно
LiveCodeBench Pass@1api-docs.deepseek.com ↗2026-08-07неизвестно
MMLU-Proapi-docs.deepseek.com ↗2026-08-07неизвестно
GPQA Diamondapi-docs.deepseek.com ↗2026-08-07неизвестно
SWE-bench Verifiedapi-docs.deepseek.com ↗2026-08-07неизвестно
Terminal-Bench 2.0api-docs.deepseek.com ↗2026-08-07неизвестно
SimpleQA-Verifiedapi-docs.deepseek.com ↗2026-08-07неизвестно
BrowseCompapi-docs.deepseek.com ↗2026-08-07неизвестно
DeepSeek делает 75% скидку на V4-Pro постояннойapi-docs.deepseek.com ↗2026-05-25проверено
Запуск серии DeepSeek V4: контекст 1M и двухуровневая MoE-архитектураapi-docs.deepseek.com ↗2026-05-25проверено
Когда стоит выбирать V4-Pro вместо V4-Flash?api-docs.deepseek.com ↗2026-08-07к проверке
Поддерживает ли V4-Pro тот же API режима мышления, что и V4-Flash?api-docs.deepseek.com ↗2026-05-25к проверке
Помощь и контакты