DeepSeek V4 вводит пиковое ценообразование: время суток становится параметром маршрутизации для каждого AI-шлюза
DeepSeek V4 выходит в середине июля с двукратным повышением цен на API в пиковые часы — первое пиковое ценообразование в AI API. Каждому слою маршрутизации теперь нужен учёт часовых поясов в расчёте затрат и fallback-логике.
Архивный материал, подготовленный с помощью ИИ по указанному источнику и опубликованный без индивидуальной проверки. Ответственный редактор: Joe Werner.

Запуск DeepSeek V4 — это не просто выход более сильной модели. Это событие заставит каждый AI-шлюз, прокси и слой маршрутизации добавить измерение, которого у них никогда не было: время суток. С середины июля DeepSeek V4 удваивает цену за token в пиковые часы — 9:00–12:00 и 14:00–18:00 по пекинскому времени — в то время как вызовы в непиковые часы остаются по стандартному тарифу. Это первый случай, когда крупный AI-провайдер ввёл пиковое ценообразование на уровне API, и это навсегда меняет правила маршрутизации.
Что произошло
30 июня 2026 года команда DeepSeek объявила, что официальный релиз V4 выйдет в середине июля с тремя ключевыми изменениями:
- Полный набор возможностей V4 — официальный релиз расширяет текущую preview-версию, улучшая выполнение agent-задач, математическое мышление и генерацию кода, а также включает контекстное окно в 1 миллион token для всей линейки моделей.
- Пиковое ценообразование API — впервые в истории AI API крупный провайдер будет взимать двойную ставку в течение двух дневных окон: 9:00–12:00 и 14:00–18:00 по пекинскому времени (01:00–04:00 и 06:00–10:00 UTC).
- Стандартные непиковые тарифы — вне этих окон цены остаются на уровне текущих ставок V4 Flash/Pro, объявленных в мае.
Это следует за агрессивным снижением цен DeepSeek за последние два месяца, включая постоянную 75-процентную скидку на доступ к V4 Pro API, объявленную в мае. Пиковая надбавка — это частичный откат, сигнал о том, что ценовая война не может поддерживать неограниченную ёмкость в самые загруженные часы.
Почему это важно для AI-инженерных команд
Ценообразование, зависящее от времени, никогда не было фактором при выборе AI API. Команды сейчас маршрутизируют запросы на основе качества модели, стоимости, задержки и доступности — все это статические или квазистатические измерения. Добавление времени суток означает:
Каждая команда, запускающая production-нагрузки AI в рабочие часы Азии, увидит изменение счёта за DeepSeek. Если ваши CI-пайплайны срабатывают в 10:00 по пекинскому времени, ваш тестовый набор использует reasoning-модели в послеобеденное окно кодирования, или ваш клиентский чат-бот достигает пика в обеденные часы — эти вызовы теперь стоят вдвое дороже на DeepSeek V4.
Прогнозирование затрат усложняется. Большинство моделей затрат команд предполагают фиксированную ставку за token. С двухуровневым ценообразованием DeepSeek точные прогнозы требуют знания временного распределения вашего API-трафика. Нагрузка, которая на 60% приходится на пиковые часы, стоит на 40% дороже, чем тот же объём token по непиковым тарифам — и этот разрыв растёт с масштабом.
Выбор провайдера получает временное измерение. Если пиковое ценообразование DeepSeek окажется эффективным для управления ёмкостью, другие провайдеры последуют примеру. Слои маршрутизации, которые сегодня не поддерживают выбор провайдера с учётом времени, потребуют архитектурного обновления, когда второй провайдер объявит пиковое ценообразование.
Взгляд оператора маршрутизации
Это не мелкая корректировка цен. Это изменение, определяющее категорию для инфраструктуры API-маршрутизации:
Таблицам маршрутизации теперь нужны часы. Каждый AI-шлюз — включая TheRouter — должен понимать, когда делается запрос относительно часового пояса провайдера. В 10:00 по пекинскому времени DeepSeek V4 стоит вдвое дороже. В 20:00 по пекинскому времени — возвращается к стандартному тарифу. Политика маршрутизации, которая предпочитает DeepSeek для чувствительных к затратам нагрузок, больше не может применять это правило единообразно.
Биллинг с учётом часовых поясов. Большинство панелей биллинга агрегируют затраты по модели и дате. Пиковое ценообразование DeepSeek требует более тонкой детализации: затраты по модели × дата × час. Enterprise-команды, сверяющие счета нескольких провайдеров, будут нуждаться в этой детализации для точной атрибуции затрат.
Логика fallback получает проверку времени суток. Если DeepSeek V4 становится вашей основной моделью, но его пиковая ставка превышает фиксированную ставку резервного провайдера, ваша политика маршрутизации должна пропускать DeepSeek в пиковые часы и направлять запросы напрямую к более дешёвой альтернативе. Это решение должно приниматься для каждого запроса с учётом часов — а не на этапе конфигурации деплоя.
Контекстное окно в 1M token усиливает влияние ценообразования. Один вызов с длинным контекстом в пиковые часы, заполняющий 500K входных token, будет стоить значительно дороже, чем тот же вызов в непиковое время. Для команд, строящих RAG-пайплайны или agent-воркфлоу с большими system prompt, планирование пакетной обработки или длительных запусков агентов вне пиковых окон становится тактикой контроля затрат.
На что обратить внимание пользователям TheRouter
Движок маршрутизации TheRouter поддерживает весовые коэффициенты затрат по провайдерам, а наш биллинговый пайплайн уже отслеживает стоимость каждого запроса с секундной гранулярностью. По мере внедрения DeepSeek временного ценообразования вот на что стоит обратить внимание:
- Проведите аудит паттернов трафика DeepSeek. Проверьте, какой процент вашего API-трафика DeepSeek попадает в пиковые окна после вступления ценообразования в силу. Если доля пикового окна превышает 40%, рассмотрите корректировку весов маршрутизации в эти часы.
- Настройте fallback-политики с учётом времени. Когда DeepSeek переходит на пиковое ценообразование, ваше правило минимизации затрат должно автоматически выбирать провайдеров с фиксированными ценами для подходящих запросов — без ущерба для порогов качества.
- Внимательно следите за анонсами провайдеров. Если пиковое ценообразование DeepSeek сократит глубину очереди в рабочие часы Китая, другие провайдеры могут принять аналогичные модели. Команды с инфраструктурой маршрутизации, учитывающей время, адаптируются быстрее тех, у кого её нет.
Пиковое ценообразование API — новинка для AI, но оно знакомо каждой команде облачной инфраструктуры, которая управляла резервными инстансами, spot-ценами и скидками на вычисления в зависимости от времени суток. DeepSeek только что принёс эту модель в сферу инференса моделей. Шлюзам и прокси, маршрутизирующим AI-трафик, нужно догонять — и быстро.
Похожие материалы
Новости AI-роутинга и провайдеров →
OpenAI Agents API Beta: Новый обход шлюза, который операторам необходимо учесть
Публичная бета Agents API от OpenAI вводит отдельное пространство имён client.beta.agents, не проходящее через /v1/chat/completions. Для команд с AI-шлюзами: слепые зоны в биллинге, пробелы в аудите и новый scope API key.

DeepSeek V4 Reasoning Effort в трёх API-форматах: почему ваш прокси, скорее всего, передаёт параметры неверно
DeepSeek V4-Pro и V4-Flash теперь поддерживают трёхуровневое управление глубиной рассуждений в форматах OpenAI, Anthropic и Responses API. Проблема в том, что каждый формат использует разные поля — и прокси, отбрасывающий extra_body, молча переводит усилие на уровень max.

DeepSeek V4-Pro-0813 и ценовой обрыв 16 августа: что операторам gateway нужно проверить за ближайшие 48 часов
Алиас DeepSeek V4-Pro перешел на новую GA-модель с сильными agent-бенчмарками, а peak/off-peak pricing вступает в силу 16 августа. Экономика production routing изменилась.