Теги

Новости по тегу "coding-agents"

RSS-лента
Claude Code 2.1.275: регрессия шлюза — тег advisor_20260301 вызывает 400 на прокси с ANTHROPIC_BASE_URL, исправлено в 2.1.276

Claude Code 2.1.275 сломал все прокси-шлюзы. 2.1.276 исправил это в тот же день.

Тег advisor_20260301 в 2.1.275 сломал все прокси-шлюзы: 400 на каждый запрос. 2.1.276 вышел hotfix'ом в тот же день. Разбор механики сбоя, затронутых конфигураций и трёх дополнительных изменений для операторов.

источник Anthropic
Диаграмма улучшений надёжности Claude Code 2.1.274 для операторов gateway: стабильность MCP-соединений и восстановление транскриптов

Claude Code 2.1.274: масштабное исправление MCP, конфигурация Postgres в gateway и самовосстановление транскриптов

Claude Code 2.1.274 устраняет шесть причин тихих сбоев MCP в production, добавляет store.connect_timeout_seconds и CLAUDE_CODE_GATEWAY_DRAIN_TIMEOUT_MS в Claude apps gateway, а также переводит повреждённые транскрипты на режим самовосстановления вместо бесконечного цикла.

источник Anthropic
Изменения Claude Code 2.1.273: hint-заголовки gateway и смена классификатора auto-режима, представленные как панель наблюдаемости прокси с сигналами классификации запросов

Claude Code 2.1.273: пять новых hint-заголовков для gateway и смена классификатора на Bedrock, Vertex и Foundry

Claude Code 2.1.273 добавляет opt-in hint-заголовки, передающие LLM-прокси класс запроса, тип агента и состояние компакции. Одновременно на Bedrock, Vertex AI и Foundry по умолчанию включается локальный классификатор auto-режима — откатить можно только это изменение.

источник Anthropic
Claude Code 2.1.269 operator changes: gateway timeout, concurrent agents cap, and deny rule scoping fix illustrated as a control panel

Claude Code 2.1.269: три оператор-уровневых изменения в релизе с 60+ исправлениями

Claude Code 2.1.269 добавляет настраиваемый таймаут обнаружения gateway, жёсткий лимит параллельных workflow-агентов и исправляет утечку deny-правил за границу их config-источника. Каждое из них меняет то, как операторы управляют Claude Code в масштабе.

источник Anthropic
Диаграмма исправлений gateway в Claude Code 2.1.268: HTTP 400 регрессия ANTHROPIC_BASE_URL и контроль gatewayInternalNetworks

Claude Code 2.1.268: Трёхверсионный сбой gateway, который прошёл незамеченным, и четыре новых контроля

Начиная с 2.1.265 каждый запрос через сторонний ANTHROPIC_BASE_URL endpoint завершался HTTP 400. Версия 2.1.268 устраняет регрессию, добавляет gatewayInternalNetworks, синхронизацию цен через gateway.yaml и байт-стабильный prompt cache для Bedrock, Vertex и Foundry.

источник Anthropic Claude Code
Абстрактная диаграмма маршрутизации с границей containment вокруг облачных credential-путей, стиль редакционного ньюсрума

Claude Fable 5.1: Containment Escape блокирует получение облачных credentials по умолчанию

Claude Code 2.1.257 выпускает Fable 5.1 с 1M контекстом и жёсткой блокировкой запросов к облачным metadata-сервисам в auto-режиме — вот что нужно проверить операторам production-пайплайнов.

источник Anthropic Claude Code
Claude Code 2.1.251 хук PreModelSwitch блокирует несанкционированное повышение модели на уровне gateway

Claude Code 2.1.251: хук PreModelSwitch превращает переключение модели в управляемое решение

Claude Code 2.1.251 добавляет хуки PreModelSwitch и PostModelSwitch, позволяющие блокировать или аннотировать смену модели в реальном времени. Новая видимость лимитов расходов и метрики кэша на сессию делают клиент полноценным инструментом операционного управления.

источник Claude Code Changelog
Абстрактная схема с тремя регуляторами Model Picker, Cache TTL и Cost Attribution, подключёнными к центральному узлу AI routing gateway

Claude Code 2.1.243: три управляемых настройки, которые меняют контроль над моделями, кешем и стоимостью

Claude Code 2.1.243 добавляет modelPicker, promptCacheTtl и modelPricing — три managed settings, закрывающие давние пробелы в управлении моделями, двухуровневом кешировании и учёте стоимости по контрактным ценам.

источник Anthropic
Абстрактная схема маршрутизации с ветвлением коэффициентов стоимости по путям облачных провайдеров

Claude Code: рабочие пространства с data residency теперь несут надбавку 1,1× — это влияет на выбор provider

Claude Code 2.1.239 начал учитывать надбавку 1,1× за US-only inference в оценках /cost и строке статуса для data-residency workspace. Команды, маршрутизирующие через Bedrock или Vertex, обходят эту надбавку — разбираем, что это значит для выбора provider.

источник Claude Code Changelog
Абстрактная operator-панель с изоляцией settings-тиров и сигналом быстрого сбоя credentials

Claude Code 2.1.228: баг слияния settings, который передавал custom-headers не в тот tier

В 2.1.228 исправлен баг, при котором marketplace-записи могли молча наследовать custom-headers из настроек с более низким приоритетом, а провал Vertex AI по учётным данным сокращён с минут до секунд — оба изменения меняют подход к аудиту operator-деплоев.

источник Anthropic Claude Code
Абстрактная диаграмма трёхуровневой архитектуры маршрутизации вычислений с self-hosted runner как новым средним путём

Claude Code 2.1.224: Self-Hosted Runner создаёт третий уровень выполнения — решение, которое операторам нужно принять сейчас

Claude Code 2.1.224 выпускает self-hosted runner, кросс-сессионный обмен сообщениями, отмену лимита субагентов и маскирование credentials в sandbox. Каждое изменение затрагивает отдельный уровень операторской архитектуры.

источник Anthropic Claude Code
Редакционная диаграмма gateway-соединения stream с keepalive-импульсами и изолированными границами worktree, сдержанный тёмный технический стиль

Claude Code 2.1.222 устраняет тихие разрывы stream на gateway и обход хука в фоновых задачах

Три исправления в Claude Code 2.1.222 затрагивают операторов на кастомных ANTHROPIC_BASE_URL gateway: stream-таймер учитывает keepalive любого endpoint, закрыт обход PreToolUse hook в фоновых задачах, ареа git-команд в worktree ужесточена.

источник Anthropic Claude Code
Редакционная схема трёх операторских рычагов управления — сетевая политика, глубина subagent, размер воркфлоу — как отдельные точки конфигурации в нейтральной иллюстрации архитектуры маршрутизации

Claude Code 2.1.219: три изменения в управлении, которые операторы обязаны проверить перед деплоем

2.1.219 добавляет sandbox.network.strictAllowlist, поднимает глубину subagent с 1 до 3 и ограничивает воркфлоу до medium — три изменения, меняющих периметр безопасности, стоимостное давление и политику оркестрации без единой строчки кода.

источник Anthropic Claude Code
Абстрактная схема разрешения ARN-путей AWS Bedrock в отдельные уровни моделей с исправленным биллинговым реестром

Claude Code 2.1.218 устраняет скрытую ошибку биллинга Bedrock: операторы с ARN-маппингом моделей должны проверить исторические логи расходов

С февраля 2026 года Claude Code приписывал трафик Bedrock ARN к одному model ID, фиксируя ~$0.23 для Haiku и Opus одинаково. Версия 2.1.218 исправляет разрешение ARN, но исторические логи расходов gateway недостоверны.

источник Claude Code CHANGELOG
Абстрактная схема слоёв git-изоляции worktree с линиями границ безопасности, сдержанный редакционный стиль

Claude Code 2.1.216: закрыт обход git-изоляции worktree-субагентов и устранена квадратичная деградация сессий

Claude Code 2.1.216 закрывает обход git-изоляции worktree-субагентов и устраняет квадратичную деградацию длинных сессий. Контрольный список аудита для операторов и что меняет новая настройка sandbox.filesystem.disabled.

источник Anthropic Claude Code
Абстрактная схема явных шлюзов управления, заменяющих пассивную автоматизацию, на тёмном техническом фоне с сдержанными акцентами TheRouter

Claude Code 2.1.215: /verify и /code-review больше не запускаются автоматически — что должен изменить каждый оператор

Версия 2.1.215 убирает автоматический запуск skill-команд /verify и /code-review. CI-пайплайны и фоновые агенты, полагавшиеся на пассивные контрольные точки, теперь обязаны вызывать их явно — иначе проверки просто не будут выполняться.

источник Anthropic Claude Code
Архитектура маршрутизации Gemini Managed Agents с фоновым выполнением и удалёнными MCP-серверами

Gemini Managed Agents получили фоновое выполнение и удалённые MCP-серверы: архитектурные изменения для операторов маршрутизации

7 июля Google добавила в Gemini Managed Agents фоновое выполнение задач и интеграцию с удалёнными MCP-серверами. Оба обновления меняют подход операторов к проектированию polling-циклов, политик таймаутов и оркестрации инструментов в production-пайплайнах.

источник Google
Абстрактная схема многоуровневых шлюзов прав доступа и маршрутизационных путей на тёмном техническом фоне с приглушёнными акцентами TheRouter

Claude Code 2.1.214: семь исправлений обхода прав доступа, которые обязан проверить каждый оператор перед развёртыванием

Версия 2.1.214 закрывает семь путей обхода проверки прав в Bash и PowerShell, вводит обязательные запросы для Docker daemon-redirect, добавляет EndConversation в agentic-сессии и новые OTel-атрибуты для корреляции с биллингом на уровне gateway.

источник Anthropic Claude Code
Страница общего артефакта получает актуальные данные через MCP connectors в зоне ответственности зрителя, с диаграммой маршрутизации

Claude Code Artifacts теперь вызывают MCP connectors с учётными данными зрителя: что нужно знать operator'у

Claude Code Artifacts теперь получают данные через MCP connectors самого зрителя, а не создателя. Эта инверсия владения учётными данными меняет подход к общим внутренним дашбордам и зону ответственности AI gateway.

источник Claude Code Docs
Абстрактная схема трёх путей развёртывания модели для agentic coding: self-hosted, управляемое облако и API gateway

Cohere North Mini Code теперь доступен через API и в self-hosted варианте: фреймворк принятия решений для operator-маршрутизации agentic coding нагрузок

Cohere выпустила North Mini Code — MoE-модель с 30B параметрами и лишь 3B активными — в трёх режимах: API, управляемое облако и self-hosting. Разбираем фреймворк маршрутизации для операторов.

источник Cohere
Схема routing-политики LongCat-2.0 для agentic-кодирования с контекстным окном 1M токенов и sparse MoE архитектурой

LongCat-2.0 API на SiliconFlow: решение по routing для agentic-кодирования с контекстом до 1M токенов

LongCat-2.0 от Meituan — анонимная модель, уже занявшая первое место по объёму в Hermes Agent и второе в Claude Code — теперь доступна через OpenAI-совместимый API на SiliconFlow. Разбираем решение по routing.

источник SiliconFlow / Meituan LongCat
Руководство оператора по маршрутизации Kimi K3 через reasoning_effort API — тёмный технический редакционный стиль

Kimi K3 доступен через API: параметр reasoning_effort ломает скрипты маршрутизации для K2.x

Kimi K3 теперь доступна через OpenAI-совместимый endpoint. Однако модель заменяет параметр thinking из K2.x на reasoning_effort — ломающее изменение для скриптов маршрутизации, конфигураций gateway и интеграций coding agent.

источник Kimi
Абстрактная визуализация путей маршрутизации AI-моделей с метриками скорости и эффективности

Grok 4.5 доступен через API: математика эффективности токенов, которая меняет вашу политику маршрутизации для coding agent

Grok 4.5 от xAI работает со скоростью 80 TPS и генерирует в 4,2 раза меньше выходных токенов, чем Opus 4.8, при аналогичных задачах — это сочетание кардинально меняет кривую стоимости на задачу для всех команд, маршрутизирующих запросы через стек coding agent.

источник xAI
CVE-2026-55607 Claude Code sandbox escape чеклист аудита версий для операторов

CVE-2026-55607: Побег из песочницы Claude Code через worktree — чеклист аудита версий для операторов

CVE-2026-55607 — высококритичная уязвимость Claude Code: вредоносный репозиторий выводит coding agent за пределы macOS sandbox. Исправлено в 2.1.163, но операторам gateway требуется отдельный версионный контроль.

источник Anthropic / GitHub Security Advisory
GPT-5.6 Sol устойчивость к prompt injection политика маршрутизации AI-операторы

GPT-5.6 Sol и устойчивость к prompt injection: что результаты GPT-Red означают для вашей политики маршрутизации

GPT-Red от OpenAI сделал GPT-5.6 Sol в 6 раз устойчивее к prompt injection. Для операторов, чьи агентные pipeline обрабатывают email, веб-контент или вызовы сторонних инструментов, этот разрыв — теперь routing-решение.

источник OpenAI
Терминал на тёмном фоне с настройками Claude Code auto mode и метками провайдеров Bedrock, Vertex AI и Foundry

Claude Code 2.1.207: Auto Mode теперь включён по умолчанию на Bedrock, Vertex AI и Foundry — проверьте настройки оператора

Claude Code 2.1.207 убирает требование opt-in через CLAUDE_CODE_ENABLE_AUTO_MODE на Bedrock, Vertex AI и Foundry. Auto mode теперь включён по умолчанию для всех сессий на управляемых провайдерах — оператор должен добавить disableAutoMode, чтобы вернуть прежнее поведение.

источник Anthropic
Абстрактная схема маршрутизации на тёмном фоне: оборванный путь соединяется заново через сетевые узлы

Claude Code 2.1.203: Баг с потерей ANTHROPIC_BASE_URL молча отправлял запросы не на тот endpoint

Claude Code 2.1.203 исправляет критический баг: фоновые сессии агентов теряли ANTHROPIC_BASE_URL, отправляя API-ключи на endpoint по умолчанию и получая 401. Командам, роутящим Claude Code через кастомный AI gateway, необходимо срочно проверить окружение и обновиться.

источник Anthropic Claude Code
Абстрактная визуализация метрик производительности инженеров и управления токен-бюджетом для корпоративных AI-агентов программирования

Первое академическое исследование корпоративного развёртывания Claude Code: что 24% прирост в слияниях PR и миллионные расходы на токены значат для бюджетного управления

Microsoft Research впервые использовала прямую телеметрию для измерения ROI CLI-агентов программирования в масштабе предприятия — и задокументировала разрыв управления токен-бюджетом, вынудивший отозвать лицензии. Чеклист оператора перед масштабированием Claude Code.

источник arXiv
Абстрактная схема маршрутизации: уровни вычисления, памяти и эволюции в архитектуре долгосрочного coding agent

Архитектура MiMo Code для долгосрочных задач: что трёхуровневая модель Xiaomi значит для политики маршрутизации оператора

Coding agent MiMo Code от Xiaomi решает проблему непрерывности состояния в многошаговых задачах с помощью параллельного сэмплирования, checkpoint-памяти и оркестрации как кода. Разбираем, что это значит для операторского routing.

источник Xiaomi MiMo
Абстрактная редакционная иллюстрация разветвлённых рабочих потоков, символизирующих архитектуру маршрутизации coding agent

Запуск ZCode: официальный coding agent от Z.ai вводит новую архитектуру endpoint, которую команды маршрутизации обязаны переосмыслить

Z.ai официально запустила ZCode 2 июля — бесплатную среду agentic-разработки на базе GLM-5.2. Для команд маршрутизации запуск вводит отдельный coding endpoint, двойные каналы Anthropic/OpenAI, BYOK через сторонние каналы и промо 1.5x квоты, действующее до 31 июля.

источник Z.ai / ZCode
Диаграмма нотации [1m] и маппинга моделей DeepSeek V4 Pro для роутинга Claude Code

Официальное руководство по интеграции агентов DeepSeek: нотация [1m] и таблица маппинга моделей, которые должен освоить каждый AI-шлюз

DeepSeek опубликовал официальную документацию для 15 агентных инструментов. Суффикс [1m] и серверная таблица маппинга моделей переопределяют выбор модели на уровне шлюза — критически важные детали для операторов AI-шлюзов.

источник DeepSeek
Схема, показывающая переключение режима разрешений Claude Code с автопродолжения на ручное подтверждение, с CI-пайплайном ниже

Claude Code 2.1.200: режим разрешений Manual и изменение AskUserQuestion — обязательный аудит для каждого оператора

Claude Code 2.1.200 переименовывает режим разрешений по умолчанию в «Manual» и отключает автопродолжение в диалогах AskUserQuestion — два изменения, которые без явного обновления конфигурации заблокируют CI-пайплайны и фоновые рабочие процессы агентов.

источник Anthropic Claude Code
Абстрактная схема централизованного распределения MCP-серверов администратором на несколько поверхностей: cloud, IDE, CLI

Cursor Team MCP Marketplace: централизованное распределение MCP-серверов меняет маршрутизацию инструментов агентов

Cursor позволяет администраторам один раз настроить Team MCP-серверы и распределить их на cloud agents, IDE и CLI — с контролем доступа на уровне организационных групп. Разбираем, что централизованное управление MCP означает для операторов.

источник Cursor
Диаграмма с обратным отсчётом и путями миграции для отключения моделей OpenAI Codex и deep-research 23 июля

OpenAI отключает Codex, Deep-Research и Computer-Use 23 июля: 21 день на миграцию routing-конфигурации

23 июля OpenAI отключает gpt-5-codex, o3-deep-research, computer-use-preview и ещё 11 alias. Если routing-конфиг по-прежнему ссылается на эти модели, запросы начнут падать. Вот что нужно проверить прямо сейчас.

источник OpenAI
Абстрактная схема маршрутизации, показывающая выбор между Sonnet 5 и Opus 4.8 по кривым стоимости в зависимости от уровня усилий

Claude Sonnet 5: самая агентивная модель Sonnet от Anthropic — что вводное окно ценообразования означает для команд по маршрутизации

Claude Sonnet 5 запускается по $2/$10 за миллион токенов до 31 августа — затем цена возвращается к $3/$15. Модель заменяет Sonnet 4.6 в качестве дефолтной у Anthropic и приносит агентивные возможности уровня Opus по ценам Sonnet. Вот как реагировать командам по маршрутизации.

источник Anthropic
Абстрактная схема двух модельных этапов в автономном coding-пайплайне с gate верификации

Grok Build /goal и автономная верификация: что двухмодельный пайплайн значит для маршрутизации coding-агентов

Режим /goal от xAI исключает разработчика из цикла выполнения, но двухмодельный пайплайн поднимает вопрос независимости верификации — и каждый оператор, маршрутизирующий coding-задачи в Grok Build, обязан его понять.

источник xAI
Абстрактная схема слоя административной политики над сеткой маршрутизации моделей, в приглушённых тёмно-синих и серых тонах

Claude Code 2.1.196: Модели по умолчанию для организации, сторожевой таймер потока и новая граница безопасности Remote Control

Три изменения, важных для операторов в v2.1.196: управление выбором модели через консоль организации, сторожевой таймер потоков для всех провайдеров и ограничение Remote Control при использовании нестандартного base URL.

источник Anthropic Claude Code
Абстрактная иллюстрация мобильного устройства, подключённого к уровню маршрутизации облачных агентов

iOS-приложение Cursor добавляет Remote Control для облачных агентов: новый уровень управления, который операторы AI должны настроить

Нативное iOS-приложение Cursor вводит Remote Control для облачных агентов, создавая новую поверхность подтверждения действий, которую операторы AI и команды маршрутизации обязаны явно настроить.

источник Cursor
Редакционная иллюстрация долгих agent-задач, проходящих через управляемые routing lanes

Agent Router Codex: policy lanes для долгих AI-задач

Исследование OpenAI о Codex показывает, зачем agent router нужны policy lanes для долгих задач: routing по длительности, риску, budget owner и fallback-continuity, а не просто seats.

источник OpenAI
Абстрактная панель управления оператора с изоляцией учётных данных и применением ограничений модели организации

Claude Code 2.1.187 Changelog: sandbox.credentials блокирует доступ к секретам, ограничения моделей организации — на всех точках входа

2.1.187: sandbox.credentials запрещает sandbox-командам чтение credential-файлов и секретных переменных среды; ограничения моделей организации применяются в picker, --model, /model и ANTHROPIC_MODEL с видимым сообщением об ограничении.

источник Anthropic Claude Code
Диаграмма страницы Cursor 3.9 Customize — единый слой управления плагинами, MCP и субагентами с областями видимости пользователя, команды и рабочего пространства

Cursor 3.9 Customize Page: что унифицированный слой управления плагинами, MCP и субагентами означает для операторских команд

Cursor 3.9 объединяет плагины, skills, MCP, субагенты, правила и хуки в единой странице Customize с областями видимости user/team/workspace; командные маркетплейсы теперь поддерживают импорт из GitLab, Bitbucket и Azure DevOps.

источник Cursor
Абстрактная визуализация потоков корпоративного API-роутинга через глобальную сеть узлов

Корпоративное развёртывание OpenAI Codex: routing и governance на примере масштаба Samsung с 5 миллионами пользователей

Samsung Electronics разворачивает Codex для всех сотрудников по всему миру — один из крупнейших корпоративных запусков OpenAI. Разбираем, какая архитектура routing и governance нужна оператору до выхода на этот масштаб.

источник OpenAI
Операторская панель управления, демонстрирующая границы автоответа bash и эскалации прав субагентов в Claude Code 2.1.186

Claude Code 2.1.186: Автоответ на bash-команды и эскалация прав субагентов меняют операторские границы

Claude Code 2.1.186: bash-команды теперь запускают ответ агента, фоновые субагенты эскалируют права вместо автоотказа. Оба изменения меняют операторские границы без миграции настроек. Что проверить перед обновлением.

источник Anthropic Claude Code
Абстрактная схема управляемых token-бюджетных потоков и шлюзов политики делегирования для мультиагентного управления Codex

OpenAI Codex 0.143: Token-бюджеты и политика делегирования мультиагентов закрывают пробел в управлении для операторов

Codex 0.143.0 добавляет настраиваемые rollout token-бюджеты, политику многоагентного делегирования на уровне потока и ограниченный веб-поиск по белому списку URL — три механизма управления, которых операторам не хватало с момента перехода Codex в мультиагентный режим.

источник OpenAI Codex
Тёмная абстрактная иллюстрация: маршрутизирующая сеть соединяет узлы последовательных задач, представляя этапы длительного agentic-воркфлоу под управлением центрального операторского слоя.

OpenAI Codex-Maxxing: что белая книга о долгосрочных задачах означает для операторской архитектуры маршрутизации

Белая книга OpenAI Codex-maxxing описывает, как запускать Codex в режиме постоянного рабочего пространства для многочасовых сессий. Для операторов маршрутизации ключевые выводы — управление бюджетом context, верификационные шлюзы и решение делегировать vs. контролировать.

источник OpenAI
Диаграмма границы безопасности webhook-триггеров Claude Code 2.1.185 с переклассификацией в task notification

Claude Code 2.1.185: Webhook-триггеры больше не могут подтверждать действия в режиме auto

Claude Code 2.1.185 переклассифицирует webhook- и scheduled-task-доставки как уведомления задач, блокируя подтверждение ожидающих действий в режиме auto. Операторы webhook-пайплайнов CI/CD и MCP-шлюзов должны пересмотреть границы автоматизации.

источник Anthropic Claude Code
Редакционная схема Codex Record & Replay skill routing: записанный workflow проходит через API gateway в governed replay lane

Codex Record and Replay: macOS Skill Routing Guide 2026

Codex Record and Replay записывает macOS workflow и превращает его в reusable skill. Govern каждый replay через approvals, permissions, fallback recovery и cost telemetry.

источник OpenAI Codex
Абстрактная схема routing, где grok-build-0.1 выступает выбираемой точкой входа в мульти-провайдерном API-стеке

xAI открывает API grok-build-0.1: специализированная coding-модель для agentic routing-стеков

grok-build-0.1 от xAI доступна через API в публичной бете — purpose-built agentic coding-модель за $1/$2 на миллион токенов с 256k контекстом, поддержкой MCP и архитектурой параллельных агентов. Разбираем, как она вписывается в routing-решения с несколькими провайдерами.

источник xAI
GitHub AI-агент инфраструктура multi-cloud надёжность: абстрактная визуализация трафика между облачными провайдерами

GitHub теряет доступность из-за AI-агентов: Microsoft вынуждена роутить трафик через AWS

В июне 2026 года доступность GitHub упала до 88,4% на фоне взрывного роста коммитов от AI coding-агентов. Microsoft подтвердила, что роутит трафик через AWS — это меняет представление о надёжности CI/CD для команд, работающих с AI.

источник Business Insider
Абстрактная схема маршрутизации, демонстрирующая корректную работу слоя кэша при перехвате повторяющихся API-вызовов через кастомный gateway endpoint

Claude Code 2.1.181: Prompt Caching восстановлен для кастомных gateway и Foundry — что нужно знать операторам

Claude Code 2.1.181 исправляет скрытую регрессию prompt caching, из-за которой все команды, работающие через кастомный ANTHROPIC_BASE_URL или Microsoft Foundry, несли завышенные расходы. Также принудительно введён лимит в пять уровней глубины для foreground subagent.

источник Anthropic
Редакционная схема: два соединённых узла агентов с слоем доверительной границы и барьером разрешений, сдержанная нейтральная палитра

Claude Code 2.1.181: модель доверия агентов переписана — что операторы мультиагентных пайплайнов должны проверить

Claude Code 2.1.181 переписывает модель доверия к peer-сообщениям между агентами: с «относиться с подозрением» на «запрос коллеги, скорее всего действующего от имени пользователя». Пути эскалации и permission laundering по-прежнему заблокированы жёстко.

источник Anthropic
Схема маршрутизации данных: Claude Code подключается через кастомный API gateway, выделены токены аутентификации и цепочка fallback-моделей

Claude Code 2.1.179: три критических исправления надёжности для операторов с кастомным API endpoint

Claude Code 2.1.179 устраняет три скрытых сбоя, которые затрагивают команды, маршрутизирующие запросы через кастомный API gateway: регрессию 401 в claude agents workers, игнорирование fallback model при compaction и потерю ответа при обрыве соединения.

источник Anthropic
Абстрактная схема routing с двумя ветками модельных путей — стандартной и HighSpeed — с индикаторами количества токенов и задержки

Kimi K2.7 Code API: на 30% меньше thinking-токенов и вариант HighSpeed меняют вашу политику routing

Kimi K2.7 Code от Moonshot AI сокращает расход reasoning-токенов на 30% и вводит вариант HighSpeed с пропускной способностью 180–260 TPS — два изменения, требующих конкретного решения по routing для команд, уже направляющих трафик coding-агентов на Kimi.

источник Kimi Open Platform
Абстрактная схема сетевой маршрутизации с правилами разрешений и ветвящимися путями на тёмном редакционном фоне

Claude Code 2.1.178: правила Tool(param:value) позволяют операторам блокировать субагентов по модельному уровню

Claude Code 2.1.178 вводит синтаксис разрешений Tool(param:value) — операторы теперь могут писать правила вида Agent(model:opus), блокируя субагентов на Opus-уровне. Также добавлены вложенные области видимости .claude/ и предварительная проверка субагентов в auto-режиме.

источник Anthropic Claude Code
Claude Code 2.1.176: надёжность фоновых агентов, fallback auto-режима Fable 5 и managed-конфиг footerLinksRegexes

Claude Code 2.1.176: масштабный апдейт надёжности фоновых агентов, fallback auto-режима для Fable 5 и новые managed-настройки интерфейса

Claude Code 2.1.176 устраняет ряд проблем с управлением фоновыми agent-сессиями, добавляет fallback auto-режима для Fable 5 в организациях без Opus 4.8, исправляет условия hook по пути для Read/Edit/Write и вводит footerLinksRegexes для managed-деплоев.

источник Claude Code Changelog
Редакционная иллюстрация changelog Claude Code 2.1.177 с четырьмя ветвями регрессий — зависание headless MCP под claude -p, CLAUDE_CODE_OAUTH_TOKEN перекрыт credentials-файлом, обход слэш-парсера, отказ Windows-запуска — сходящимися к решениям operator fleet о пиннинге версии

Claude Code 2.1.177 changelog: зависание MCP, баг CLAUDE_CODE_OAUTH_TOKEN, регрессия слэш-парсера

Claude Code 2.1.177 changelog: stdio MCP виснут при полном fleet под claude -p (симптом claude hanging), CLAUDE_CODE_OAUTH_TOKEN перекрывается credentials-файлом и даёт 401, /compact уходит как обычный текст, Windows-бинарь не запускается. Руководство по пиннингу fleet и фиксам.

источник anthropics/claude-code GitHub issues
Официальные docs Cursor Bugbot: background PR review на Composer 2.5 и governance через model block list

Официальные docs Cursor Bugbot: Composer 2.5, /review и governance Background Agents

Официальные docs Cursor Bugbot и июньский changelog теперь указывают на Composer 2.5, pre-push /review и Cloud Agents, ранее называвшиеся Background Agents. Для routing-операторов ключевой сигнал прежний: model block list делает AI code review объектом явного governance.

источник Cursor Changelog
Абстрактная диаграмма маршрутизации: единый унифицированный API-слой ветвится на несколько провайдеров — on-device, приватное облако, внешние сервисы — на тёмном матовом редакционном фоне

Apple Foundation Models на WWDC26: новый слой маршрутизации для Claude и Gemini

На WWDC 2026 Apple представила единый Swift API, маршрутизирующий запросы к on-device модели, Private Cloud Compute, Claude и Gemini из одной точки вызова. Это вводит новый слой выбора провайдера, которым инженерные команды должны управлять осознанно.

источник Apple Developer
Claude Code 2.1.176: усиление безопасности availableModels и исправление кэширования Bedrock credentials

Claude Code 2.1.176/2.1.177: проверка availableModels, Bedrock STS и Remote Control

Перед rollout Claude Code 2.1.177 на managed fleet проверьте исправления 2.1.176: availableModels ловит ANTHROPIC_DEFAULT_*_MODEL после alias resolution, Bedrock awsCredentialExport кэшируется до STS Expiration, а Remote Control больше не меняет модель сессии втихую.

источник Claude Code Changelog
Схема routing для Kimi K2.7 Code API с обязательным режимом рассуждений и MCP tool-use flow

Kimi K2.7 Code API: обязательный режим рассуждений меняет архитектуру routing coding-агентов

12 июня Moonshot AI выпустила Kimi K2.7 Code. Kimi K2.7 Code API принудительно включает режим рассуждений — его отключение возвращает ошибку API — что меняет расчёт стоимости, routing-политику и логику fallback для команд с coding-агентами.

источник Moonshot AI
Абстрактная редакторская иллюстрация многоуровневых маршрутов, сходящихся в яркой точке — символ миграции модели и fallback-архитектуры

Claude Fable 5: что меняется в routing-слое — новый model ID, семантика refusal и учёт токенов

9 июня Anthropic выпустила claude-fable-5 — наиболее мощную публично доступную версию Claude. Разбираем все изменения для routing-слоя: новый model ID, адаптивное мышление всегда включено, stop_reason refusal, параметр fallbacks и обязательное хранение данных 30 дней.

источник Anthropic
Минималистичная редакционная графика, отражающая изоляцию safe-mode и применение политик корпоративного шлюза

Claude Code --safe-mode и флаг -p: managed settings и таймаут Vertex

Релиз Claude Code от 8 июня добавляет --safe-mode, исправляет медленные или зависающие claude -p / --print в Windows, усиливает применение MCP-политик managed settings и возвращает 5-минутный таймаут Vertex / Foundry.

источник Anthropic
Абстрактная схема маршрутизации с тремя каскадными путями модели и защищённым граничным слоем в сдержанной редакционной цветовой гамме

Claude Code fallbackModel: поддержка цепочки из трёх fallback-моделей и усиление границы доверия между сессиями

Claude Code v2.1.166 добавляет цепочку из трёх fallback-моделей в fallbackModel и ужесточает границу доверия в мульти-агентных сценариях: SendMessage больше не передаёт пользовательские полномочия между сессиями.

источник Anthropic
Схема gate проверки версий: Claude Code-сборка, не попадающая в операторский диапазон минимальной и максимальной версий, отклоняется при старте

Фиксация версий Claude Code через Managed Settings: что requiredMinimumVersion означает для операторского управления в корпоративной среде

Claude Code отказывается запускаться вне операторского диапазона версий. requiredMinimumVersion и requiredMaximumVersion managed settings блокируют парк разработчиков на проверенных сборках — без самовольных обновлений.

источник GitHub
Минималистичная диаграмма с четырьмя путями auto-mode Claude Code через Anthropic API, AWS Bedrock, Google Vertex и Microsoft Foundry

Auto-Mode Claude Code на AWS Bedrock, Vertex и Foundry — как включить, маршрутизировать и провести аудит

Auto-mode Claude Code теперь работает на AWS Bedrock, Google Vertex AI и Microsoft Foundry — установите CLAUDE_CODE_ENABLE_AUTO_MODE=1, и ваш coding agent будет работать внутри VPC. Разберём, что меняется в биллинге, задержках и fallback-роутинге при переходе с Anthropic API.

источник Claude Code Releases (GitHub)
Схема разветвляющихся путей через routing-шлюз, иллюстрирующая пер-тредовую маршрутизацию runtime в OpenAI Codex multi-agent v2

OpenAI Codex Multi-Agent v2: пер-тредовая маршрутизация runtime и что это меняет для операторов AI-шлюза

OpenAI Codex CLI 0.137.0 представляет multi-agent v2 с пер-тредовой маршрутизацией runtime: каждый порождённый sub-agent теперь несёт собственный выбор модели и provider. Разбираем, что меняется для операторов, управляющих routing-шлюзами, cost attribution и governance.

источник OpenAI
Абстрактная редакционная иллюстрация: точка ветвления routing с несколькими размеченными путями, расходящимися из единого источника

Codex для каждой роли: что шесть ролевых плагинов, Sites и 5 миллионов пользователей в неделю означают для вашей архитектуры AI routing

OpenAI выпустила шесть ролевых плагинов Codex и Sites — генерацию веб-приложений из промпта. Переход Codex к мультиролевому coding agent меняет бюджеты контекста, паттерны tool call и требования к upstream-моделям.

источник OpenAI
Схема routing для Amazon Bedrock GPT-5.5 с OpenAI Codex traffic, AWS IAM credentials и regional model IDs

Amazon Bedrock GPT-5.5: routing OpenAI Codex, AWS IAM credentials и model IDs

Amazon Bedrock теперь обслуживает OpenAI GPT-5.5, GPT-5.4 и Codex через AWS IAM credentials, региональные endpoints и model IDs вроде openai.gpt-5.5. Разбираем последствия для routing-слоя, Codex config, fallback policy и OpenAI-compatible gateway.

источник OpenAI
Абстрактная схема на тёмном техническом фоне: центральный узел-оркестратор разветвляется к множеству параллельных agent-узлов, соединённых маршрутами

Kimi Agent Swarm: что происходит, когда 100 параллельных sub-agent одновременно обращаются к вашему API gateway

Kimi Agent Swarm запускает до 100 параллельных sub-agent на одну задачу. Для команд, маршрутизирующих трафик через Kimi API или строящих аналогичные multi-agent системы, это полностью меняет расчёт concurrency, billing и rate limit.

источник Kimi / Moonshot AI
Абстрактная редакционная иллюстрация, символизирующая routing агентов и наблюдаемость инфраструктуры

Claude Code Agent Routing: управление плагинами и OTEL-аудит

Claude Code v2.1.157 представляет agent-маршрутизацию через settings.json, автозагрузку .claude/skills плагинов и OTEL-телеметрию параметров инструментов — три операторских контроля для управляемых multi-agent пайплайнов.

источник Anthropic / Claude Code
Бумажный железнодорожный переключатель, разветвляющий один путь на несколько направлений — метафора API-уровневых решений routing для Claude Opus 4.8.

Claude Opus 4.8: три изменения на уровне API, которые меняют архитектуру routing и ценообразование

Anthropic выпускает Opus 4.8 с параметром управления effort, поддержкой mid-turn system entries в Messages API и fast mode, который стал в 3 раза дешевле. Каждое изменение напрямую влияет на конфигурацию routing, бюджет токенов и модели стоимости.

источник Anthropic
Минималистичная редакционная графика с символом развилки маршрутизации на матовом тёмном фоне, геометрические формы в серо-угольных и сине-серых тонах

Claude Code OAuth-регрессия: аудит credentials для custom API gateway

OAuth-регрессия Claude Code могла отправлять пользовательские токены Anthropic в custom API gateway. Чеклист для операторов: проверьте изоляцию токенов, auth-логи gateway и соблюдение MCP-политик субагентами после патча 28 мая.

источник Anthropic / Claude Code GitHub
Редакционная диаграмма петли самообучающегося агента: production traces поступают в eval-цели, которые управляют итерационным циклом Codex

Codex eval в продакшене: как петля самообучающегося агента OpenAI превращает traces в eval-цели

Codex eval инфраструктура выделяет самообучающегося агента. OpenAI Tax AI превратил production traces в eval-цели и запустил автоитерации на Codex. Архитектура не привязана к провайдеру и подходит любой команде на API-gateway.

источник OpenAI Engineering
Абстрактная редакционная схема — матрица оценки закупок с routing-узлами, контролями governance и enterprise-чекбоксами на тёмном нейтральном фоне

Первый Magic Quadrant Gartner для корпоративных AI coding agent: что критерии оценки означают для вашей routing-архитектуры

Дебютный Magic Quadrant Gartner для корпоративных AI coding agent формально закрепил требования enterprise-закупок: гибкий routing между моделями, governance-контроли, sandbox-исполнение и аудируемость. Разбираем, что это меняет на уровне routing-слоя.

источник GitHub Blog
Абстрактная схема маршрутизации: несколько провайдерских путей сходятся в едином API gateway

MiMo-V2.5-Pro на DashScope: совместимость OpenAI + Anthropic API для маршрутизации агентов

Xiaomi MiMo-V2.5-Pro на DashScope: контекст 1M токенов, совместимость с OpenAI и Anthropic API, на 42% меньший расход токенов чем Kimi K2.6 на агентных задачах. Оцените для вашей политики маршрутизации — стоимость, окно и риски каталога DashScope.

источник Xiaomi MiMo Platform
Абстрактная схема, показывающая многослойные границы безопасности ОС и изоляцию процессов для coding-агента, работающего на корпоративной инфраструктуре

Codex Automation Sandbox и Unsafe Mode: изоляция агентов и безопасность в Windows

Windows-песочница Codex заменяет Full Access (unsafe mode) на запись-ограниченные токены на уровне ОС — без прав администратора. Разбираем, что архитектура admin sandbox значит для каждого coding-агента в вашей инфраструктуре, не только для Codex.

источник OpenAI Engineering
Абстрактная редакционная иллюстрация: on-premises серверная инфраструктура и облачные маршруты сходятся в едином корпоративном слое маршрутизации AI

OpenAI Codex переезжает on-premises: что партнёрство с Dell значит для маршрутизации корпоративного AI

OpenAI и Dell приносят Codex в корпоративные дата-центры. Когда coding agent работает on-prem, архитектура маршрутизации меняется: локальность данных, session affinity, учёт расходов и governance — всё нужно пересматривать.

источник OpenAI
Абстрактная редакционная иллюстрация: многоуровневые routing-решения и cost-aware политика AI-provider-ов

Gemini 3.5 Flash — это уже не Flash-модель: что ценовая перестройка Google значит для вашей routing-политики

Google запустила Gemini 3.5 Flash по «$1,50»/«$9» за миллион токенов — в 3–6 раз дороже предыдущих Flash-уровней. В связке с новым серверным Interactions API это переписывает то, что routing-команды должны считать про Gemini Flash.

источник Google AI Blog
Помощь и контакты