Теги

Новости по тегу "deepseek"

RSS-лента
Диаграмма маршрутизации с двумя активными API-эндпоинтами deepseek-v4-pro и deepseek-flash с разными лимитами конкурентности и ценовыми уровнями

DeepSeek V4 Pro пережил собственный дедлайн: что разворот означает для вашей политики маршрутизации

DeepSeek объявил 10 сентября, что V4 Pro будет отключён сегодня в 04:00 UTC. Вместо этого они отыграли назад под давлением пользователей, сохранив V4 Pro на прежних ценах. Разбираем актуальные параметры двух моделей и решения для routing-операторов.

источник DeepSeek
Abstract API routing diagram showing deepseek-v4-pro requests being silently redirected to V4.1-Flash with a September 14 deadline

DeepSeek V4.1-Flash выходит с нативным зрением — и через четыре дня убивает deepseek-v4-pro

DeepSeek запустил V4.1-Flash с новым именем deepseek-flash и нативным зрением. 14 сентября в 12:00 по Пекину все запросы к deepseek-v4-pro уйдут на V4.1-Flash по ценам Flash. Имя и URL не меняются, код 200 — но модель другая. Дельта возможностей и что изменить до дедлайна.

источник DeepSeek
Абстрактная техническая схема: image-токены проходят через слой API-маршрутизации, где текстовые и мультимодальные запросы идут по разным путям

DeepSeek V4-Flash-Vision-Exp добавляет поддержку изображений в API: что нужно изменить в вашем routing-слое

DeepSeek выпустил первую мультимодальную модель 21 августа. Главная routing-проблема не в самой модели, а в том, что vision-запросы требуют content в виде массива блоков, тогда как ваш прокси может обрабатывать только строку.

источник DeepSeek
Диаграмма различий полей API DeepSeek V4 reasoning effort в форматах OpenAI, Anthropic и Responses API

DeepSeek V4 Reasoning Effort в трёх API-форматах: почему ваш прокси, скорее всего, передаёт параметры неверно

DeepSeek V4-Pro и V4-Flash теперь поддерживают трёхуровневое управление глубиной рассуждений в форматах OpenAI, Anthropic и Responses API. Проблема в том, что каждый формат использует разные поля — и прокси, отбрасывающий extra_body, молча переводит усилие на уровень max.

источник DeepSeek
Абстрактная иллюстрация разветвления API-маршрутизации между уровнями Flash и Pro с градиентами конкурентности и стоимости

DeepSeek-V4-Flash-0731 стал GA: Responses API доступен только для Flash, а разрыв в конкурентности превратился в решение по маршрутизации

DeepSeek выпустил V4-Flash-0731 в публичную бету: бенчмарки превышают V4-Pro-Preview. Responses API эксклюзивен для Flash до начала августа — единственный путь для Codex-native и Responses API рабочих процессов.

источник DeepSeek
deepseek-chat deprecated July 24 routing audit checklist

deepseek-chat выводится из эксплуатации 24 июля: аудит routing-конфигурации, который каждый оператор AI-шлюза обязан завершить на этой неделе

deepseek-chat и deepseek-reasoner перестанут отвечать 24 июля в 15:59 UTC. Осталось 7 дней — приводим чеклист аудита routing-конфигурации, который необходимо выполнить до дедлайна.

источник DeepSeek
Чистая редакционная иллюстрация двух параллельных routing-каналов — US frontier и cost tier — сходящихся в единый узел принятия решений на нейтральном приглушённом фоне

Китайские AI-модели захватили 46% token-трафика US-предприятий: что изменить в политике маршрутизации

Модели DeepSeek, Z.ai и Qwen стабильно держат более 30% API token-трафика американских корпоративных клиентов на крупных мультипровайдерных платформах — с пиком 46%. Разбираем routing-фреймворк, который нужен operator'у до переключения production-нагрузки.

источник CNBC
Циферблат часов поверх схемы сетевой маршрутизации, с выделенными зонами пиковых часов, сигнализирующими о 2× ценообразовании на трафик DeepSeek API

DeepSeek V4 вводит пиковое ценообразование: время суток становится параметром маршрутизации для каждого AI-шлюза

DeepSeek V4 выходит в середине июля с двукратным повышением цен на API в пиковые часы — первое пиковое ценообразование в AI API. Каждому слою маршрутизации теперь нужен учёт часовых поясов в расчёте затрат и fallback-логике.

источник DeepSeek / TechNode
Диаграмма нотации [1m] и маппинга моделей DeepSeek V4 Pro для роутинга Claude Code

Официальное руководство по интеграции агентов DeepSeek: нотация [1m] и таблица маппинга моделей, которые должен освоить каждый AI-шлюз

DeepSeek опубликовал официальную документацию для 15 агентных инструментов. Суффикс [1m] и серверная таблица маппинга моделей переопределяют выбор модели на уровне шлюза — критически важные детали для операторов AI-шлюзов.

источник DeepSeek
Схема миграции DeepSeek на V4 Flash и маршрут через Anthropic API

DeepSeek прекращает поддержку имён deepseek-chat и deepseek-reasoner: миграция на V4 Flash и новый маршрут через Anthropic API

DeepSeek упраздняет имена deepseek-chat и deepseek-reasoner 24 июля и запускает эндпоинт в формате Anthropic API. Разбираемся, что меняется для команд, которые маршрутизируют трафик через DeepSeek.

источник DeepSeek
Постоянное снижение цены DeepSeek V4 Pro: схема выбора routing-уровней для AI-инженерных команд

DeepSeek закрепляет снижение цены на V4 Pro: что ценовая война в AI значит для вашей routing-политики

DeepSeek подтвердила, что 75% скидка на V4 Pro теперь постоянная. При цене «$0,87/M» за output-токены и результатах SWE-bench выше 80% модель переписывает карту routing-уровней — V4 Pro больше не премиальный fallback, а основная reasoning-модель.

источник DeepSeek
Миграция моделей DeepSeek V4 API: график deprecation, два endpoint для SDK и последствия для маршрутизации

DeepSeek API: названия моделей 2026 — deepseek-chat → deepseek-v4-flash, deepseek-reasoner → deepseek-v4-pro | депрекейшн 24 июля

DeepSeek API названия моделей 2026: deepseek-chat → deepseek-v4-flash, deepseek-reasoner → deepseek-v4-flash (режим рассуждений) или deepseek-v4-pro (1M контекст). Депрекейшн 24 июля 2026 г. Новый Anthropic-совместимый endpoint /anthropic для прямой маршрутизации Claude Code.

источник DeepSeek
Помощь и контакты