Claude Code теперь разбивает расходы по skill, agent и MCP-серверу в VSCode — что операторам нужно знать
Релиз Claude Code от 12 июня добавляет per-skill/per-agent/per-MCP атрибуцию затрат в /usage, исправляет inference-profile на Bedrock GovCloud и закрывает утечку credentials в фоновых сессиях.

Релиз Claude Code от 12 июня объединяет три изменения, которые вместе закрывают значительный пробел в том, как корпоративные команды понимают и управляют расходами на agentic-разработку. Главное нововведение — обновлённый VSCode-диалог /usage: теперь он детально разбивает потребление токенов по категориям cache miss, длинный контекст, вызовы subagent, а также — впервые — по каждому skill, agent, plugin и MCP-серверу в окнах 24 часа и 7 дней.
Если вы запускаете Claude Code в командном режиме и до сих пор управляли расходами по суммарным счётчикам токенов, этот релиз меняет то, что можно измерить. Два других исправления из того же релиза устраняют операционные риски для compliance-критичных и мультитенантных развёртываний.
Что произошло
Релиз Claude Code от 12 июня включает:
-
Диалог атрибуции затрат
/usageв VSCode. Раздел Account & usage (/usage) в расширении для VSCode теперь показывает детальный разброс потребления за последние 24 часа или 7 дней. Разбивка включает cache misses, длинноконтекстные сессии, токены subagent, а также — впервые — per-skill, per-agent, per-plugin и per-MCP-server атрибуцию. Командам больше не нужно строить собственный telemetry-pipeline, чтобы понять, какой компонент сжигает токен-бюджет. -
Исправление inference-profile-префикса для Bedrock GovCloud. Регионы AWS GovCloud (
us-gov-*) использовали неверный префикс inference-profile —globalвместоus-gov, — из-за чего попытки Claude Code разрешить производные model ID завершались ошибкой 400. Теперь GovCloud-сессии корректно используют префиксus-gov, восстанавливая доступ к моделям для команд, работающих в рамках FedRAMP High и DoD IL4/5. -
Изоляция переменных окружения фоновых сессий. Фоновые сессии наследовали
ANTHROPIC_*-переменные — gateway URL, кастомные заголовки, псевдонимы/model— из оболочки, запустившей фоновый демон. Это означало, что фоновый agent, запущенный на прогретом worker, мог маршрутизировать запросы через API gateway или использовать credentials, принадлежащие другой команде или сессии. Теперь каждая фоновая сессия разрешает provider-окружение самостоятельно.
Дополнительные исправления: пауза в 1–2 секунды при выходе после прерванной shell-команды, некорректная атрибуция соавтора в git-коммитах, предварительный выбор заблокированной модели в диалоге /advisor, skill hot-reload теперь переотправляет только изменённые skill (а не весь список), а также заголовки атрибуции для subagent Workflow-инструмента.
Почему это важно для AI-инженерных команд
Per-компонентная атрибуция меняет аудит расходов на agent-задачи
До этого релиза лучшим способом отнести расходы Claude Code на конкретные компоненты было построить OpenTelemetry-pipeline и вручную проставлять метки — как описано в релизе с OTEL-метриками от 2 июня. OTEL-путь остаётся правильным выбором для команд, которым нужна шлюзовая верификация и долгосрочное хранение. Но для типичного вопроса — «какой skill съедает наш месячный бюджет?» — диалог /usage теперь отвечает без какой-либо инфраструктуры.
Это особенно актуально, поскольку экосистема skill и MCP в Claude Code продолжает расти. Команды запускают кастомные skill для ревью кода, генерации документации, валидации деплоев и миграций баз данных — у каждого свой токен-профиль. Skill ревью кода, запускающий subagent на каждый PR, может накапливать существенные расходы, не отражая их ни в одном отдельном контексте сессии. Новый диалог /usage делает такие расходы видимыми на уровне IDE — до того, как они появятся в счёте.
Исправление GovCloud восстанавливает compliance-критичную маршрутизацию
Команды, запускающие Claude Code на AWS GovCloud в рамках FedRAMP High или DoD IL4/5, были заблокированы ошибкой деривации префикса inference-profile. Система inference-profile сопоставляет региональный префикс с доступностью моделей: каталог моделей us-gov отличается от global. Когда Claude Code выводил global вместо us-gov, разрешение модели завершалось ошибкой 400.
Исправление точечное, но критически важное. GovCloud-команды — как правило, регулируемые предприятия с жёсткими требованиями к маршрутизации: они не могут откатиться на коммерческие регионы AWS. Ошибка inference-profile-префикса не деградирует мягко — она падает жёстко. Если вы приостановили развёртывание Claude Code на GovCloud из-за ошибок доступа к моделям в последние недели, этот релиз — точка возобновления.
Изоляция фоновых сессий закрывает мультитенантный риск
Утечка credentials в фоновых сессиях — наиболее чувствительное с точки зрения безопасности исправление в этом релизе. До него фоновый agent мог унаследовать ANTHROPIC_BASE_URL, ANTHROPIC_API_KEY или кастомные заголовки из оболочки, запустившей демона. В общей среде разработки, где несколько разработчиков запускают фоновые демоны из разных терминальных сессий, это создаёт риск перекрёстного загрязнения credentials.
Типичный сценарий: разработчик А запускает демон Claude Code из оболочки, настроенной на командный API gateway. Разработчик Б запускает фоновую сессию с той же машины. Сессия Б наследовала конфигурацию gateway А и маршрутизировала запросы через credentials А. Теперь каждая фоновая сессия разрешает provider-окружение независимо.
Router/operator-угол
Три изменения этого релиза сходятся к единой операционной теме: компонентная видимость и изоляция в agentic-разработческих рабочих процессах.
Для команд, запускающих Claude Code через routing-слой — будь то shared API gateway, TheRouter или кастомный proxy — диалог /usage меняет модель атрибуции. Раньше gateway видел единый upstream и был вынужден выводить атрибуцию расходов из метаданных сессии или кастомных заголовков. Теперь клиентская атрибуция достаточно детальна, чтобы строить per-компонентную модель затрат без какой-либо gateway-инструментации.
Это открывает полезный паттерн верификации: сопоставляйте клиентскую разбивку /usage с шлюзовым журналом запросов. Если клиент показывает, что skill code-review потребил 40 000 токенов, а gateway зафиксировал 60 000 от сессий этой команды — разницу стоит расследовать: либо skill генерирует скрытый subagent-трафик, либо есть ошибка конфигурации.
Исправление GovCloud закрепляет принцип, который compliance-ориентированным командам стоит усвоить: маршрутизация по provider-региону в Claude Code зависит от модели. Система inference-profile не просто выбирает модель — она сопоставляет регион с каталогом моделей. Команды с жёсткими региональными требованиями должны после обновления убедиться, что конфигурация выводит правильный префикс.
Изоляция фоновых credentials имеет практические последствия для команд с общим CI/CD. Если ваш CI-pipeline запускает фоновые агенты Claude Code на shared runner, теперь provider-окружение каждого job изолировано. Это устраняет класс трудноотслеживаемых утечек credentials между job: агенты выглядели работающими нормально — просто маршрутизировали через чужие credentials.
На что обратить внимание
- Проверьте разбивку
/usage. После обновления изучите 7-дневное окно. Если какой-то один skill, plugin или MCP-сервер занимает более 30% потребления токенов команды — это кандидат на оптимизацию уровня модели: leaf-задачи можно маршрутизировать на более дешёвую модель, оставив сильнейшую для планирования. - GovCloud-команды: проверьте inference-profile. После обновления запустите
/statusи убедитесь, что региональный префикс читается какus-gov, а неglobal. Если по-прежнемуglobal— конфигурация, вероятно, всё ещё указывает неверный регион. - Пересмотрите конфигурацию фонового демона. Изоляция credentials означает, что фоновые сессии больше не наследуют окружение shell. Если вы рассчитывали на неявное наследование — например, устанавливали
ANTHROPIC_BASE_URLв.bashrcв надежде, что фоновые агенты подхватят настройку — теперь нужно явно настраивать provider routing на уровне сессии или через managed settings. - Кросс-верификация клиентской и шлюзовой атрибуции. Диалог
/usageдаёт клиентскую видимость, шлюзовой журнал запросов — верификацию на стороне provider. Совмещайте их для выявления расхождений, особенно для MCP-серверов: клиент атрибутирует их как «MCP-сервер», а gateway может логировать как отдельные запросы. - Skill hot-reload теперь переотправляет только изменённые skill. Это оптимизация производительности, но она также означает, что telemetry-pipeline должен уметь обрабатывать инкрементальные обновления списка skill. Если ваша атрибуция расходов опирается на события skill-list, проверьте, поддерживает ли ваш collector инкрементальные обновления.
Похожие материалы
Новости AI-роутинга и провайдеров →
Claude Code Origin Story Routing: почему история terminal agent от Anthropic важна
Claude Code origin story routing превращает официальную историю Anthropic в operator checklist для terminal agents, permissions, context и parallel swarms.

Claude Code security review routing: Alberta переводит 466 млн строк в governed agent lane
Claude Code security review routing выходит на government scale: Alberta сканирует 466 млн строк, запускает 50 agents и оставляет human approval в loop.

Раздельный billing для Claude Agent SDK с 15 июня: когда хватает кредита подписки, а когда нужен прямой API key
Anthropic разделила billing для Agent SDK с 15 июня 2026 г. Новый ежемесячный кредит на пользователя ($20–$200 в зависимости от тарифа) работает на отдельном счётчике — и его потолок меняет логику маршрутизации для каждой production-команды.