Claude Code 2.1.243: три управляемых настройки, которые меняют контроль над моделями, кешем и стоимостью

Claude Code 2.1.243 добавляет modelPicker, promptCacheTtl и modelPricing — три managed settings, закрывающие давние пробелы в управлении моделями, двухуровневом кешировании и учёте стоимости по контрактным ценам.

Опубликовано источник Anthropic

Архивный материал, подготовленный с помощью ИИ по указанному источнику и опубликованный без индивидуальной проверки. Ответственный редактор: Joe Werner.

Абстрактная схема с тремя регуляторами Model Picker, Cache TTL и Cost Attribution, подключёнными к центральному узлу AI routing gateway
Машинный перевод с английского оригинала — читать оригинал

В Claude Code 2.1.243 появились три managed settings, которые нужно настроить командам с централизованным управлением развёртыванием — желательно до следующего аудита стоимости или ротации моделей. Каждая настройка решает отдельную задачу; вместе они закрывают пробелы, существовавшие с момента появления enterprise managed settings в Claude Code.

Что делают три настройки

modelPicker позволяет организации ограничить меню /model — интерактивный список, через который разработчик переключает модели прямо внутри сессии — до утверждённого набора идентификаторов в заданном порядке с читаемыми метками. Принимается любой формат model ID, включая Vertex AI и Amazon Bedrock. Список можно добавить к встроенному или полностью его заменить. Одновременно исправлен баг, при котором выбор Ultracode в пикере проходил без эффекта; это исправление приобретает смысл именно теперь, когда пикер можно надёжно наполнить через modelPicker.

promptCacheTtl и subagentPromptCacheTtl — два независимых TTL. Пользователи API-ключей и облачных провайдеров теперь могут держать prompt cache основного разговора час, пока subagent-ы остаются на стандартных пяти минутах. Таймеры работают независимо: долгоживущая оркестрирующая сессия накапливает горячий кеш, а короткоживущие subagent-ы с высоким оборотом — file lookup, быстрые задачи — не тратят впустую слоты кеша.

modelPricing принимает таблицу ставок по моделям и необязательный множитель скидки. После применения Claude Code использует эти цифры вместо прайс-листа при расчёте /cost, в строке статуса и при экспорте телеметрии. Команды с enterprise-соглашениями, объёмными скидками или BYOK-схемами раньше были вынуждены мысленно корректировать каждую отображаемую цифру.

Почему это важно сейчас

Отсутствие modelPicker было постоянной точкой трения для операторов gateway. Claude Code при старте запрашивает /v1/models у gateway и добавляет возвращённые модели в пикер. Динамическое обнаружение работало давно, но если организации нужен фиксированный, подписанный, упорядоченный список — например, чтобы показать gpt-5.6-sol под именем «Ultrafast (preview)», а не в виде сырого ID, или дать понятное название для Bedrock ARN — managed-settings пути для этого не было. Теперь есть.

Двухуровневые TTL важны потому, что Anthropic тарифицирует prompt cache по кешированным токен-часам. Subagent, запущенный и завершённый менее чем за пять минут, порождает слоты кеша, которые истекают раньше, чем поступит второй запрос, способный их использовать. Укорочение subagentPromptCacheTtl уменьшает оплачиваемые, но не используемые окна. Основная сессия, напротив, выигрывает от длинного окна: многоходовой разговор накапливает большой системный префикс, стоящий кеширования. Единый TTL раньше заставлял искать компромисс; разделение позволяет оптимизировать каждый уровень независимо.

modelPricing напрямую влияет на chargeback и видимость стоимости внутри компании. Многие организации договариваются о ставках, которые на 30–50% ниже прайса при наличии committed-use tier. Когда Claude Code отображал /cost по прайсу, показатель стоимости задачи был систематически завышен — либо искажал AI-расходы во внутренней отчётности, либо требовал ручных поправочных коэффициентов от финансовых команд. Телеметрия страдала от того же искажения.

Как это соотносится с работой gateway-оператора

Три настройки работают на трёх разных уровнях управления.

modelPicker — управление моделями: определяет, какие модели разработчик может выбрать внутри сессии. Для операторов, маршрутизирующих Claude Code через gateway с кастомным каталогом моделей, пикер должен соответствовать этому каталогу. Без modelPicker разработчик мог выбрать модель, которую gateway не предоставляет, — и получать ошибку только во время выполнения запроса. Теперь пикер становится проекцией утверждённого списка.

promptCacheTtl / subagentPromptCacheTtl — экономика кеша: управляет временем жизни кешированного состояния на каждом уровне агентов. Оптимальные значения зависят от профиля нагрузки: сессия с 30-минутным анализом кодовой базы выигрывает от часового TTL; пакет коротких subagent-ов с файловым поиском — нет.

modelPricing — атрибуция стоимости: устраняет разрыв между тем, что Anthropic выставляет оператору по контракту, и тем, что Claude Code показывает и экспортирует. Счёт Anthropic не меняется; меняются цифры в отображении и телеметрии. Это означает, что пайплайны учёта стоимости теперь требуют синхронизации managed settings при изменении контрактных ставок.

Что настраивать

Если развёртывание использует managed settings (managed-settings.json или облачный managed source):

  • Добавьте в modelPicker утверждённый список моделей, включая Vertex и Bedrock ID, выставляемые вашим gateway. Используйте поле label для читаемого имени, совпадающего с внутренней документацией.
  • Установите promptCacheTtl в 3600 (1 час) для долгоживущих аналитических сессий; оцените, нужно ли сокращать subagentPromptCacheTtl — дефолтные 300 секунд остаются оправданными для быстро оборачивающихся задач.
  • Заполните modelPricing контрактными ставками и множителем скидки до следующего внутреннего аудита стоимости. После применения перепроверьте dashboard-ы, потребляющие экспорт телеметрии Claude Code: цифры изменятся.

В 2.1.243 также появилась разбивка Loops в /usage — количество запусков на цикл, суммарные токены, токены на запуск и время последнего запуска — для выявления неуправляемых или чрезмерно активных /loop-задач.

Claude Code 2.1.243 доступен через npm install -g @anthropic-ai/claude-code@latest. Managed settings применяются при следующем старте сессии после обновления файла настроек.

Claude Code 2.1.269 operator changes: gateway timeout, concurrent agents cap, and deny rule scoping fix illustrated as a control panel

Claude Code 2.1.269: три оператор-уровневых изменения в релизе с 60+ исправлениями

Claude Code 2.1.269 добавляет настраиваемый таймаут обнаружения gateway, жёсткий лимит параллельных workflow-агентов и исправляет утечку deny-правил за границу их config-источника. Каждое из них меняет то, как операторы управляют Claude Code в масштабе.

источник Anthropic
Диаграмма исправлений gateway в Claude Code 2.1.268: HTTP 400 регрессия ANTHROPIC_BASE_URL и контроль gatewayInternalNetworks

Claude Code 2.1.268: Трёхверсионный сбой gateway, который прошёл незамеченным, и четыре новых контроля

Начиная с 2.1.265 каждый запрос через сторонний ANTHROPIC_BASE_URL endpoint завершался HTTP 400. Версия 2.1.268 устраняет регрессию, добавляет gatewayInternalNetworks, синхронизацию цен через gateway.yaml и байт-стабильный prompt cache для Bedrock, Vertex и Foundry.

источник Anthropic Claude Code
Терминал на тёмном фоне с настройками Claude Code auto mode и метками провайдеров Bedrock, Vertex AI и Foundry

Claude Code 2.1.207: Auto Mode теперь включён по умолчанию на Bedrock, Vertex AI и Foundry — проверьте настройки оператора

Claude Code 2.1.207 убирает требование opt-in через CLAUDE_CODE_ENABLE_AUTO_MODE на Bedrock, Vertex AI и Foundry. Auto mode теперь включён по умолчанию для всех сессий на управляемых провайдерах — оператор должен добавить disableAutoMode, чтобы вернуть прежнее поведение.

источник Anthropic
Помощь и контакты