← Все статьи

DeepSeek V4 Pro снимается 14 сентября: миграция на V4.1 Flash

DeepSeek V4 Pro уходит 14 сентября 2026 года. Все запросы к V4 Pro будут перенаправлены на V4.1 Flash по тарифу Flash. Разбираем изменения имён моделей, обновления кода, влияние на стоимость и план отката.

· TheRouter

DeepSeek V4 Pro уходит 14 сентября 2026 года в 12:00 по пекинскому времени (04:00 UTC). С этого момента каждый запрос к deepseek-v4-pro будет молча перенаправлен на V4.1 Flash по тарифу Flash. Это не постепенный закат с месяцами пересечения. Это жёсткое переключение через четыре дня.

Модели V4 Flash уже прошли тот же путь. Имена deepseek-v4-flash и deepseek-v4-flash-vision-exp по-прежнему принимаются API, но за ними стоит V4.1 Flash под каноническим именем deepseek-flash. DeepSeek объясняет консолидацию тем, что V4.1 Flash «всесторонне превзошла V4 Pro по производительности, стоимости, скорости и общему времени» (источник, получено 2026-09-10).

Мы используем DeepSeek как target в TheRouter, поэтому это затрагивает наш стек напрямую. Ниже — что изменилось, что нужно сделать и где риски.

Хронология

ДатаСобытиеВлияние
24 апреля 2026Запуск V4 PreviewПоявились deepseek-v4-pro и deepseek-v4-flash
До 10 сентябряV4 Flash снятdeepseek-v4-flash и deepseek-v4-flash-vision-exp перенаправляются на V4.1 Flash под именем deepseek-flash
14 сентября 2026V4 Pro снимаетсяdeepseek-v4-pro перенаправляется на V4.1 Flash, тарификация по Flash
Не объявленоВыход V4.1 ProDeepSeek подтвердила выпуск V4.1 Pro, но без даты и цены

Изменения имён моделей

Это та часть, которая с наибольшей вероятностью сломает вашу конфигурацию. DeepSeek объединила три имени в одно.

До (до сентября 2026):

deepseek-v4-flash            → DeepSeek-V4-Flash
deepseek-v4-flash-vision-exp → DeepSeek-V4-Flash (vision)
deepseek-v4-pro              → DeepSeek-V4-Pro-0813

После (с 14 сентября):

deepseek-flash               → DeepSeek-V4.1-Flash (каноническое имя)
deepseek-v4-flash            → DeepSeek-V4.1-Flash (legacy alias, работает)
deepseek-v4-flash-vision-exp → DeepSeek-V4.1-Flash (legacy alias, работает)
deepseek-v4-pro              → DeepSeek-V4.1-Flash (перенаправление, тариф Flash)

Самый безопасный шаг — обновить параметр model на deepseek-flash прямо сейчас. Legacy-имена пока работают, но скрывают, какую модель вы вызываете на самом деле.

Обновление кода

Если вы используете OpenAI-compatible SDK, изменение занимает одну строку.

До:

from openai import OpenAI

client = OpenAI(
    api_key="YOUR_DEEPSEEK_KEY",
    base_url="https://api.deepseek.com",
)

response = client.chat.completions.create(
    model="deepseek-v4-pro",  # снимается 14 сентября
    messages=[{"role": "user", "content": "Объясни async generators в Python."}],
)

После:

from openai import OpenAI

client = OpenAI(
    api_key="YOUR_DEEPSEEK_KEY",
    base_url="https://api.deepseek.com",
)

response = client.chat.completions.create(
    model="deepseek-flash",  # V4.1 Flash — каноническое имя
    messages=[{"role": "user", "content": "Объясни async generators в Python."}],
)

Для Anthropic-compatible endpoint (base_url="https://api.deepseek.com/anthropic") — та же правка: model с deepseek-v4-pro на deepseek-flash.

Влияние на стоимость

V4.1 Flash дешевле V4 Pro по всем параметрам. После 14 сентября, даже если вы продолжите отправлять deepseek-v4-pro, вам будут выставлять счёт по тарифу Flash.

ПараметрV4 Pro (текущий)V4.1 Flash (после 14 сентября)Изменение
Input (cache miss, off-peak)$0.66 / 1M tokens$0.15 / 1M tokens−77%
Input (cache miss, peak)$1.32 / 1M tokens$0.30 / 1M tokens−77%
Input (cache hit, off-peak)$0.022 / 1M tokens$0.003 / 1M tokens−86%
Input (cache hit, peak)$0.044 / 1M tokens$0.006 / 1M tokens−86%
Output (off-peak)$1.98 / 1M tokens$0.60 / 1M tokens−70%
Output (peak)$3.96 / 1M tokens$1.20 / 1M tokens−70%
Concurrency limit5002,500×5

Данные с страницы тарификации DeepSeek (получено 2026-09-10). Пиковые часы: 01:00–04:00 и 06:00–10:00 UTC, с понедельника по пятницу.

Снижение затрат реальное. Вопрос в том, насколько критична для вашей нагрузки разница в качестве.

Что меняется с V4.1 Flash на практике

V4.1 Flash поддерживает тот же набор функций, что и V4 Pro, с двумя отличиями.

Новая возможность: поддержка vision. deepseek-flash принимает изображения на вход. V4 Pro vision не поддерживала.

Без изменений: Thinking mode (включён по умолчанию, уровни low/high/max), tool calls, JSON output, Responses API, FIM completion (только в non-thinking mode), Anthropic API format, 1M context window, 384K max output.

Зона риска: DeepSeek утверждает, что V4.1 Flash превосходит V4 Pro по всем направлениям. Если ваша нагрузка зависит от специфического поведения V4 Pro в задачах сложного reasoning или agentic coding, протестируйте до 14 сентября. Независимых бенчмарков V4 Pro vs V4.1 Flash DeepSeek не публиковала.

Изменение rate limits

Лимит конкурентности увеличивается с 500 (V4 Pro) до 2 500 (V4.1 Flash). Для нагрузок, чувствительных к пропускной способности, это чистый апгрейд. Никаких действий не требуется — повышенный лимит применяется автоматически.

Для расширения сверх 2 500 конкурентных соединений подайте заявку в DeepSeek — без дополнительной платы.

Обновление routing-конфигурации

Если вы используете TheRouter для маршрутизации запросов, обновите конфигурацию provider на каноническое имя модели.

# До
providers:
  - id: deepseek
    models:
      - deepseek-v4-pro
      - deepseek-v4-flash

# После
providers:
  - id: deepseek
    models:
      - deepseek-flash  # V4.1 Flash — заменяет и V4 Pro, и V4 Flash

Если ранее у вас были разные routing-правила для V4 Pro (качественный уровень) и V4 Flash (бюджетный уровень), теперь это одна модель. Рассмотрите добавление fallback chain, чтобы при необходимости переключаться на модель Pro-уровня другого провайдера.

  1. Меняйте три значения, а не три SDK. Замените api_key, base_url и model в существующем клиенте OpenAI. Код запроса и ответа оставьте неизменным.
  2. Сопоставьте model ID явно. ID модели у целевого провайдера почти никогда не совпадает с OpenAI ID. Держите словарь { openai_id: target_id } вне бизнес-логики.
  3. Проверьте формат streaming. SSE-чанки должны соответствовать контракту OpenAI: data: {...} + data: [DONE]. Прогоните один streaming вызов до продакшена.
  4. Проверьте rate-limit заголовки. Некоторые провайдеры не возвращают x-ratelimit-*. Добавьте обёртку с безопасным дефолтом.
  5. Оставьте путь отката. Раскатайте замену под feature flag, гоняйте оба endpoint в shadow-режиме 24 часа, затем переключайтесь.

План отката

После 14 сентября откатиться на V4 Pro невозможно. DeepSeek безусловно перенаправит все запросы V4 Pro на V4.1 Flash.

Если V4.1 Flash не устраивает по качеству для Pro-нагрузок, варианты следующие.

  1. Дождаться V4.1 Pro. DeepSeek подтвердила выпуск V4.1 Pro, но без конкретной даты или цены. До тех пор Pro-уровень на DeepSeek недоступен.
  2. Маршрутизировать на другого провайдера. Для задач, требующих frontier-уровня reasoning, рассмотрите Claude Opus 4, GPT-6 Astra или Kimi K3 как primary или fallback target.
  3. Протестировать V4.1 Flash сейчас. Запустите ваш eval-набор на deepseek-flash до 14 сентября. Если результат устраивает, вы экономите 70–86% при 5-кратном увеличении конкурентности. Для большинства нагрузок это наиболее вероятный исход.

Затронутые статьи TheRouter

Пять наших опубликованных статей упоминают deepseek-v4-pro. После 14 сентября это имя будет фактически указывать на V4.1 Flash. Мы обновим эти статьи.

FAQ

deepseek-v4-pro перестанет работать 14 сентября? Нет. Запросы будут приниматься. Обслуживать их будет V4.1 Flash по тарифу Flash. API-вызовы не сломаются, но модель за ними изменится.

V4.1 Flash — это та же старая V4 Flash? Нет. V4.1 Flash — новая модель (DeepSeek-V4.1-Flash). Старая V4 Flash (DeepSeek-V4-Flash) уже снята, её имя перенаправлено на V4.1 Flash.

Когда выйдет V4.1 Pro? DeepSeek подтвердила выпуск, но дату не назвала. На странице тарификации указано, что V4 Pro будет перенаправляться на V4.1 Flash «до выхода V4.1 Pro в будущем».

Нужно менять API key? Нет. Тот же ключ работает. Обновить нужно только параметр model.

Эти изменения затрагивают DeepSeek R1? Нет. DeepSeek R1 — отдельная линейка моделей, не входит в эту консолидацию.

Модели, упомянутые в статье

Помощь и контакты