Claude Code 2.1.273: пять новых hint-заголовков для gateway и смена классификатора на Bedrock, Vertex и Foundry

Claude Code 2.1.273 добавляет opt-in hint-заголовки, передающие LLM-прокси класс запроса, тип агента и состояние компакции. Одновременно на Bedrock, Vertex AI и Foundry по умолчанию включается локальный классификатор auto-режима — откатить можно только это изменение.

TheRouter Newsroomисточник Anthropic
Изменения Claude Code 2.1.273: hint-заголовки gateway и смена классификатора auto-режима, представленные как панель наблюдаемости прокси с сигналами классификации запросов

Claude Code 2.1.273 вышел 15 сентября. Для операторов, которые запускают LLM-gateway, в этом релизе два изменения. Первое — новые hint-заголовки: их стоит включить немедленно. Второе — смена классификатора auto-режима на AWS Bedrock, Google Vertex AI и Azure Foundry: это уже работает по умолчанию, вне зависимости от ваших предпочтений.

Архитектурно эти изменения не связаны, но в реальной эксплуатации они пересекаются: если вы хотите наблюдать за тем, что происходит в auto-режиме после смены классификатора, новые заголовки — это именно тот инструмент.

Пять заголовков, которые показывают gateway, что делает Claude Code

Установите CLAUDE_CODE_GATEWAY_HINT_HEADERS=1 — и Claude Code начнёт отправлять пять дополнительных HTTP-заголовков на каждом запросе:

ЗаголовокСодержимое
x-claude-code-request-classauto, default, fast или plan
x-claude-code-agent-typeuser, background или subagent
x-claude-code-prev-tool-durationsJSON-массив времени выполнения инструментов предыдущего хода (мс)
x-claude-code-compactiontrue, если текущий запрос — это ход компакции контекста
x-claude-code-context-compactedtrue, если контекст был свёрнут до этого хода

Это именно hint-заголовки: Claude Code их отправляет, а что с ними делать — решаете вы.

Маршрутизация по классу запроса: gateway может применять отдельные ограничения скорости, бюджеты и выбор провайдера для auto-сессий и default-сессий. Агент в auto-режиме, запустивший многошаговый tool-loop, и разработчик в интерактивном режиме сильно отличаются по допустимой задержке и профилю расходов. Раньше у gateway не было способа их различить. Теперь есть.

Теги по типу агента: запросы типа background и subagent порождаются оркестровым слоем Claude Code, а не человеком за клавиатурой. Если пометить их отдельно в системе наблюдаемости, можно разделить расходы агентов и интерактивные расходы без изменения кода приложений.

Осведомлённость о компакции: x-claude-code-compaction: true означает, что текущий запрос — это ход суммаризации, который переписывает длинный контекст в компактную форму. Такие запросы структурно отличаются от обычных: входные данные обычно короче, выход всегда длинный прозаический текст. Они случаются редко, но при каждом срабатывании стоимость резко растёт. Если знать, какие ходы являются компакционными, их можно направить на более дешёвую модель или отдельно пометить в биллинге.

Телеметрия длительности инструментов: x-claude-code-prev-tool-durations появляется на ходу, следующем после завершения tool-loop. Для gateway, которые хотят коррелировать задержку инструментов с задержкой последующих LLM-запросов, сырые данные теперь есть прямо в заголовке — без дополнительных side-каналов.

Заголовки отключены по умолчанию и требуют явного включения. На каждый запрос они добавляют минимальный объём данных, а сам выбор в пользу opt-in гарантирует, что существующие установки gateway не затрагиваются до момента обновления.

Смена классификатора на Bedrock, Vertex и Foundry

В auto-режиме Claude Code использует классификатор, чтобы решить, требует ли та или иная операция подтверждения пользователя. До 2.1.273 этот классификатор по умолчанию работал на стороне сервера на всех платформах. В 2.1.273 на Bedrock, Vertex AI и Foundry значение по умолчанию молча переключается на локальный классификатор.

В примечаниях к релизу Anthropic кратко: «Auto-режим на Bedrock, Vertex и Foundry теперь использует локальный классификатор по умолчанию — пока что». Формулировка «пока что» указывает на исправление нестабильности: серверный классификатор, судя по всему, давал неожиданные результаты на запросах, проходящих через endpoint сторонних платформ. Причина — одно, практические последствия — другое.

Локальный классификатор работает на клиенте, использует те же веса модели, что и серверный, но не получает последних обновлений серверного классификатора, которые Anthropic выкатывает независимо от релизов Claude Code. Если команды полагаются на серверный классификатор Anthropic для принятия решений об обходе подтверждения в auto-режиме, на этих трёх платформах они теперь работают со слегка устаревшей границей решения.

Откат: установите CLAUDE_CODE_AUTO_MODE_SERVER=1 — это принудительно включает серверную классификацию. Единственный задокументированный Anthropic путь к возврату прежнего поведения.

Кого это касается: все команды, запускающие Claude Code auto-режим через AWS Bedrock, Google Vertex AI или Azure Foundry без явного CLAUDE_CODE_AUTO_MODE_SERVER=1. Прямые API-сессии через ANTHROPIC_API_KEY и сессии через Claude apps gateway не затронуты — у них по умолчанию по-прежнему серверный классификатор.

2.1.271: разрешённые домены по командам и исправление обновления org policy

Два изменения из 2.1.271, которые вошли в этот же пакет, тоже заслуживают внимания.

allowed_domains на уровне команды в auto-режиме с sandboxing: вызовы инструментов Bash, PowerShell и Monitor теперь могут декларировать нужные им имена хостов. Gateway проверяет их вместе с командой, открывает доступ к этим хостам только для данной команды, блокируя остальные. Для организаций, которым нужен контроль исходящих подключений без написания глобальных правил запрета, это более точный sandbox-подход. Сессии без включённого sandboxing это изменение не затрагивает.

Исправление кэша org policy: в предыдущих версиях кэшированная org policy могла оставаться активной после смены аккаунта, организации или ротации API-ключа — вплоть до следующей плановой проверки раз в час. Это означало, что сессии могут работать в неправильных рамках policy — с устаревшим списком разрешённых инструментов или моделей. 2.1.271 исправляет это: policy немедленно сбрасывается при смене учётных данных.

Для gateway, которые используют ротацию API-ключей как часть управления учётными данными, этот баг означал, что старая policy могла действовать в течение всего окна ротации. С исправлением это окно закрывается.

Множитель для внутреннего биллинга

В 2.1.271 поле multiplier в managed setting modelPricing (и в блоке pricing: конфигурации Claude apps gateway) теперь принимает значения больше 1, вплоть до 10. Это коэффициент наценки для внутреннего chargeback: если ваша организация выставляет командам 3× от API-стоимости для покрытия накладных расходов, установите multiplier: 3 — и отчёты /cost и OTEL-телеметрия будут автоматически показывать полную стоимость с наценкой. Раньше для этого приходилось применять множитель постфактум в биллинговом пайплайне.

Это не влияет на то, что Anthropic фактически списывает — только на то, что ваш внутренний интерфейс /cost и телеметрия отображают.

Что проверить в конфигурации gateway

  • Включите CLAUDE_CODE_GATEWAY_HINT_HEADERS=1 на всех Claude Code-установках, работающих через gateway. Заголовки обратно совместимы: неизвестные gateway заголовки пробрасываются или игнорируются без ошибок.
  • Проверьте Bedrock-, Vertex- и Foundry-развёртывания на предмет использования auto-режима. Если консистентность серверного классификатора важна для вашей политики авторизации, явно добавьте CLAUDE_CODE_AUTO_MODE_SERVER=1 для этих сессий.
  • Проверьте воркфлоу с ротацией учётных данных, если они опирались на обновление policy раз в час. С исправлением policy обновляется немедленно при смене учётных данных — это правильное поведение, но оно может сделать видимыми разрывы в policy, которые раньше были замаскированы.
  • Протестируйте allowed_domains в sandbox-режиме, если вы запускаете auto-режим с сетевой изоляцией. Декларация allowed_domains на уровне команды теперь — правильный способ задать потребности в исходящих подключениях для конкретных инструментов.

Hint-заголовки начинают работать после установки одной переменной окружения — никаких изменений на стороне gateway не требуется. Что делать с этими сигналами при маршрутизации — решаете вы.

Диаграмма исправлений gateway в Claude Code 2.1.268: HTTP 400 регрессия ANTHROPIC_BASE_URL и контроль gatewayInternalNetworks

Claude Code 2.1.268: Трёхверсионный сбой gateway, который прошёл незамеченным, и четыре новых контроля

Начиная с 2.1.265 каждый запрос через сторонний ANTHROPIC_BASE_URL endpoint завершался HTTP 400. Версия 2.1.268 устраняет регрессию, добавляет gatewayInternalNetworks, синхронизацию цен через gateway.yaml и байт-стабильный prompt cache для Bedrock, Vertex и Foundry.

источник Anthropic Claude Code
Диаграмма улучшений надёжности Claude Code 2.1.274 для операторов gateway: стабильность MCP-соединений и восстановление транскриптов

Claude Code 2.1.274: масштабное исправление MCP, конфигурация Postgres в gateway и самовосстановление транскриптов

Claude Code 2.1.274 устраняет шесть причин тихих сбоев MCP в production, добавляет store.connect_timeout_seconds и CLAUDE_CODE_GATEWAY_DRAIN_TIMEOUT_MS в Claude apps gateway, а также переводит повреждённые транскрипты на режим самовосстановления вместо бесконечного цикла.

источник Anthropic
Диаграмма конфигурации оператора Claude Code 2.1.267 и архитектуры кэша промптов

Claude Code 2.1.267: Ограничение уровня Effort для операторов, стабилизация кэша промптов и исправление обхода контейнера маркетплейса

В 2.1.267: новый maxEffortLevel для Bedrock, Vertex и Foundry; флаг отключения снапшота промпта; исправление обхода контейнера маркетплейса. Плюс двенадцать исправлений кэша промптов, напрямую влияющих на стоимость токенов.

источник Anthropic Claude Code
Помощь и контакты