Claude Code теперь разбивает расходы по skill, agent и MCP-серверу в VSCode — что операторам нужно знать

Релиз Claude Code от 12 июня добавляет per-skill/per-agent/per-MCP атрибуцию затрат в /usage, исправляет inference-profile на Bedrock GovCloud и закрывает утечку credentials в фоновых сессиях.

TheRouter Newsroomисточник Anthropic (Claude Code Releases)
Редакционная схема атрибуции нагрузки Claude Code, разветвляющейся на измерения per-skill, per-agent и per-MCP через routing-слой

Релиз Claude Code от 12 июня объединяет три изменения, которые вместе закрывают значительный пробел в том, как корпоративные команды понимают и управляют расходами на agentic-разработку. Главное нововведение — обновлённый VSCode-диалог /usage: теперь он детально разбивает потребление токенов по категориям cache miss, длинный контекст, вызовы subagent, а также — впервые — по каждому skill, agent, plugin и MCP-серверу в окнах 24 часа и 7 дней.

Если вы запускаете Claude Code в командном режиме и до сих пор управляли расходами по суммарным счётчикам токенов, этот релиз меняет то, что можно измерить. Два других исправления из того же релиза устраняют операционные риски для compliance-критичных и мультитенантных развёртываний.

Что произошло

Релиз Claude Code от 12 июня включает:

  • Диалог атрибуции затрат /usage в VSCode. Раздел Account & usage (/usage) в расширении для VSCode теперь показывает детальный разброс потребления за последние 24 часа или 7 дней. Разбивка включает cache misses, длинноконтекстные сессии, токены subagent, а также — впервые — per-skill, per-agent, per-plugin и per-MCP-server атрибуцию. Командам больше не нужно строить собственный telemetry-pipeline, чтобы понять, какой компонент сжигает токен-бюджет.

  • Исправление inference-profile-префикса для Bedrock GovCloud. Регионы AWS GovCloud (us-gov-*) использовали неверный префикс inference-profile — global вместо us-gov, — из-за чего попытки Claude Code разрешить производные model ID завершались ошибкой 400. Теперь GovCloud-сессии корректно используют префикс us-gov, восстанавливая доступ к моделям для команд, работающих в рамках FedRAMP High и DoD IL4/5.

  • Изоляция переменных окружения фоновых сессий. Фоновые сессии наследовали ANTHROPIC_*-переменные — gateway URL, кастомные заголовки, псевдонимы /model — из оболочки, запустившей фоновый демон. Это означало, что фоновый agent, запущенный на прогретом worker, мог маршрутизировать запросы через API gateway или использовать credentials, принадлежащие другой команде или сессии. Теперь каждая фоновая сессия разрешает provider-окружение самостоятельно.

Дополнительные исправления: пауза в 1–2 секунды при выходе после прерванной shell-команды, некорректная атрибуция соавтора в git-коммитах, предварительный выбор заблокированной модели в диалоге /advisor, skill hot-reload теперь переотправляет только изменённые skill (а не весь список), а также заголовки атрибуции для subagent Workflow-инструмента.

Почему это важно для AI-инженерных команд

Per-компонентная атрибуция меняет аудит расходов на agent-задачи

До этого релиза лучшим способом отнести расходы Claude Code на конкретные компоненты было построить OpenTelemetry-pipeline и вручную проставлять метки — как описано в релизе с OTEL-метриками от 2 июня. OTEL-путь остаётся правильным выбором для команд, которым нужна шлюзовая верификация и долгосрочное хранение. Но для типичного вопроса — «какой skill съедает наш месячный бюджет?» — диалог /usage теперь отвечает без какой-либо инфраструктуры.

Это особенно актуально, поскольку экосистема skill и MCP в Claude Code продолжает расти. Команды запускают кастомные skill для ревью кода, генерации документации, валидации деплоев и миграций баз данных — у каждого свой токен-профиль. Skill ревью кода, запускающий subagent на каждый PR, может накапливать существенные расходы, не отражая их ни в одном отдельном контексте сессии. Новый диалог /usage делает такие расходы видимыми на уровне IDE — до того, как они появятся в счёте.

Исправление GovCloud восстанавливает compliance-критичную маршрутизацию

Команды, запускающие Claude Code на AWS GovCloud в рамках FedRAMP High или DoD IL4/5, были заблокированы ошибкой деривации префикса inference-profile. Система inference-profile сопоставляет региональный префикс с доступностью моделей: каталог моделей us-gov отличается от global. Когда Claude Code выводил global вместо us-gov, разрешение модели завершалось ошибкой 400.

Исправление точечное, но критически важное. GovCloud-команды — как правило, регулируемые предприятия с жёсткими требованиями к маршрутизации: они не могут откатиться на коммерческие регионы AWS. Ошибка inference-profile-префикса не деградирует мягко — она падает жёстко. Если вы приостановили развёртывание Claude Code на GovCloud из-за ошибок доступа к моделям в последние недели, этот релиз — точка возобновления.

Изоляция фоновых сессий закрывает мультитенантный риск

Утечка credentials в фоновых сессиях — наиболее чувствительное с точки зрения безопасности исправление в этом релизе. До него фоновый agent мог унаследовать ANTHROPIC_BASE_URL, ANTHROPIC_API_KEY или кастомные заголовки из оболочки, запустившей демона. В общей среде разработки, где несколько разработчиков запускают фоновые демоны из разных терминальных сессий, это создаёт риск перекрёстного загрязнения credentials.

Типичный сценарий: разработчик А запускает демон Claude Code из оболочки, настроенной на командный API gateway. Разработчик Б запускает фоновую сессию с той же машины. Сессия Б наследовала конфигурацию gateway А и маршрутизировала запросы через credentials А. Теперь каждая фоновая сессия разрешает provider-окружение независимо.

Router/operator-угол

Три изменения этого релиза сходятся к единой операционной теме: компонентная видимость и изоляция в agentic-разработческих рабочих процессах.

Для команд, запускающих Claude Code через routing-слой — будь то shared API gateway, TheRouter или кастомный proxy — диалог /usage меняет модель атрибуции. Раньше gateway видел единый upstream и был вынужден выводить атрибуцию расходов из метаданных сессии или кастомных заголовков. Теперь клиентская атрибуция достаточно детальна, чтобы строить per-компонентную модель затрат без какой-либо gateway-инструментации.

Это открывает полезный паттерн верификации: сопоставляйте клиентскую разбивку /usage с шлюзовым журналом запросов. Если клиент показывает, что skill code-review потребил 40 000 токенов, а gateway зафиксировал 60 000 от сессий этой команды — разницу стоит расследовать: либо skill генерирует скрытый subagent-трафик, либо есть ошибка конфигурации.

Исправление GovCloud закрепляет принцип, который compliance-ориентированным командам стоит усвоить: маршрутизация по provider-региону в Claude Code зависит от модели. Система inference-profile не просто выбирает модель — она сопоставляет регион с каталогом моделей. Команды с жёсткими региональными требованиями должны после обновления убедиться, что конфигурация выводит правильный префикс.

Изоляция фоновых credentials имеет практические последствия для команд с общим CI/CD. Если ваш CI-pipeline запускает фоновые агенты Claude Code на shared runner, теперь provider-окружение каждого job изолировано. Это устраняет класс трудноотслеживаемых утечек credentials между job: агенты выглядели работающими нормально — просто маршрутизировали через чужие credentials.

На что обратить внимание

  • Проверьте разбивку /usage. После обновления изучите 7-дневное окно. Если какой-то один skill, plugin или MCP-сервер занимает более 30% потребления токенов команды — это кандидат на оптимизацию уровня модели: leaf-задачи можно маршрутизировать на более дешёвую модель, оставив сильнейшую для планирования.
  • GovCloud-команды: проверьте inference-profile. После обновления запустите /status и убедитесь, что региональный префикс читается как us-gov, а не global. Если по-прежнему global — конфигурация, вероятно, всё ещё указывает неверный регион.
  • Пересмотрите конфигурацию фонового демона. Изоляция credentials означает, что фоновые сессии больше не наследуют окружение shell. Если вы рассчитывали на неявное наследование — например, устанавливали ANTHROPIC_BASE_URL в .bashrc в надежде, что фоновые агенты подхватят настройку — теперь нужно явно настраивать provider routing на уровне сессии или через managed settings.
  • Кросс-верификация клиентской и шлюзовой атрибуции. Диалог /usage даёт клиентскую видимость, шлюзовой журнал запросов — верификацию на стороне provider. Совмещайте их для выявления расхождений, особенно для MCP-серверов: клиент атрибутирует их как «MCP-сервер», а gateway может логировать как отдельные запросы.
  • Skill hot-reload теперь переотправляет только изменённые skill. Это оптимизация производительности, но она также означает, что telemetry-pipeline должен уметь обрабатывать инкрементальные обновления списка skill. Если ваша атрибуция расходов опирается на события skill-list, проверьте, поддерживает ли ваш collector инкрементальные обновления.
Схема разделённого billing: кредитный канал подписки Claude и канал прямой маршрутизации через API key для агентных нагрузок

Раздельный billing для Claude Agent SDK с 15 июня: когда хватает кредита подписки, а когда нужен прямой API key

Anthropic разделила billing для Agent SDK с 15 июня 2026 г. Новый ежемесячный кредит на пользователя ($20–$200 в зависимости от тарифа) работает на отдельном счётчике — и его потолок меняет логику маршрутизации для каждой production-команды.

источник Anthropic
Помощь и контакты