Claude Platform on AWS: третий путь развёртывания, который обязан учитывать каждый оператор при настройке роутинга

Claude Platform on AWS предоставляет инфраструктуру под управлением Anthropic через биллинг AWS — с полной поддержкой beta-заголовков, Agent Skills и отдельным пулом мощностей для многоуровневого failover.

Опубликовано источник Anthropic Claude Platform

Архивный материал, подготовленный с помощью ИИ по указанному источнику и опубликованный без индивидуальной проверки. Ответственный редактор: Joe Werner.

Диаграмма трёх путей: Anthropic API напрямую, Claude Platform on AWS и Amazon Bedrock — с метками управления и размещения данных
Машинный перевод с английского оригинала — читать оригинал

Когда Claude Code 2.1.198 добавил gateway-провайдер anthropicAws, на поверхность вышел вариант развёртывания, который многие команды воспринимали как сноску: Claude Platform on AWS. Это не Amazon Bedrock под другим названием — это архитектурно иной путь. Инженерные команды, не включившие его в политику роутинга провайдеров, принимают это решение по умолчанию, а не осознанно.

Что такое Claude Platform on AWS на самом деле

Поверхностное описание обманчиво просто: Claude на AWS с инфраструктурой под управлением Anthropic и биллингом через AWS Marketplace. Архитектурные отличия от Amazon Bedrock гораздо глубже.

На Amazon Bedrock весь стек инференса управляет AWS. Сотрудники Anthropic не имеют доступа к инфраструктуре. AWS является оператором данных, владельцем периметра соответствия требованиям и менеджером мощностей. Это правильный выбор при наличии требований FedRAMP High, IL4, IL5, HIPAA-совместимости или строгого ограничения обработки данных в рамках AWS.

На Claude Platform on AWS стек инференса управляет Anthropic. AWS обеспечивает аутентификацию (SigV4 или API-ключ), контроль доступа на основе IAM и интеграцию биллинга через Marketplace. Anthropic является оператором данных. Данные инференса остаются под операционным контролем Anthropic, однако закупки, идентификация и аудит проходят через AWS.

Практическое следствие для операторов: Claude Platform on AWS предоставляет тот же API-интерфейс, что и первичный Claude API, с той же частотой обновления функций и поддержкой beta-заголовков.

Разрыв в API-интерфейсе, меняющий решения по роутингу

Именно здесь большинство сравнительных материалов не договаривают. Вот что это различие означает на практике:

Beta-заголовки работают. Заголовок anthropic-beta проходит через Claude Platform on AWS. На Amazon Bedrock в текущем поколении anthropic-beta не поддерживается. Любая команда, использующая mcp-tunnels-2026-06-22, managed-agents-2026-04-01, fallback-credit-2026-06-01, server-side-fallback-2026-06-01 или другие недавние бета-функции Anthropic, не может получить к ним доступ через Amazon Bedrock сегодня. Через Claude Platform on AWS — может.

Agent Skills доступны. Claude Managed Agents с Agent Skills — размещённая среда выполнения навыков — работает на Claude Platform on AWS. Она не работает на Amazon Bedrock (который требует code execution в качестве альтернативы) и не поддерживается в устаревшей интеграции Bedrock.

Задержка доступности функций устранена. Bedrock следует расписанию Anthropic, но не в день релиза. Claude Platform on AWS как правило соответствует темпу выпуска первичного API — в тот же день выхода функции.

Эти три различия определяют, какие команды вообще могут использовать Claude Platform on AWS для конкретного рабочего процесса — и напрямую влияют на политику роутинга при работе с несколькими провайдерами.

Почему это важно для AI-инженерных команд

Наиболее прямое следствие: если команда стандартизировала закупки на AWS и сталкивается с ограничениями доступа к beta-функциям на Bedrock, Claude Platform on AWS — это решение, не требующее отказа от биллинга AWS или повторной интеграции с новой системой идентификации.

Два операторских сценария, где это меняет решение по роутингу:

Сценарий 1: команды, использующие Claude Managed Agents или beta-функции Anthropic через AWS. Если организация уже оформила подписку через AWS Marketplace и хочет запускать Claude Managed Agents с per-session config override, дельтами событий или deployment-вебхуками (всё это вышло 30 июня) — эти функции требуют интерфейса Claude API. Claude Platform on AWS предоставляет его через биллинг AWS без отдельного контракта с Anthropic.

Сценарий 2: команды, выстраивающие стратегию многоплатформенного failover. Claude Platform on AWS работает в отдельном пуле мощностей от первичного Claude API и Amazon Bedrock. Anthropic явно поддерживает запуск рабочих процессов на нескольких платформах с переключением между ними. Это позволяет настроить цепочку failover: основной узел — Anthropic API напрямую → переполнение — Claude Platform on AWS → переполнение — Claude in Amazon Bedrock (для поддерживаемых моделей). Каждое звено использует отдельный пул мощностей — это ключевой операционный момент: событие нагрузки в одном пуле не обязательно затрагивает остальные.

Угол роутинга и оператора

Трёхпутевой роутинг Claude требует явной политики. Большинство конфигураций роутинга сегодня воспринимают «Anthropic» как единого провайдера. Claude Platform on AWS вводит третий отдельный base URL (aws-external-anthropic.{region}.api.aws), отдельный класс SDK-клиента (AnthropicAWS в Python beta) и отдельный пул мощностей. Каждый из них — это отдельный upstream в реестре провайдеров gateway. Отсутствие явной конфигурации означает неполную цепочку fallback.

Ключевые конфигурационные решения для каждого пути:

ПутьФормат base URLПул мощностейBeta-заголовкиКогда использовать
Anthropic напрямуюapi.anthropic.comОсновной AnthropicДаПервичный биллинг, максимальный охват функций
Claude Platform on AWSaws-external-anthropic.{region}.api.awsОтдельный AnthropicДаБиллинг AWS + функции Anthropic, многопулный failover
Claude in Amazon Bedrockbedrock-mantle.{region}.api.awsAWSНетПериметр соответствия под управлением AWS, без anthropic-beta

Размещение данных — на уровне запроса, а не аккаунта. На Claude Platform on AWS инференс по умолчанию может маршрутизироваться в основное облако Anthropic. Параметр inference_geo позволяет командам закрепить конкретные запросы за определённой географией — us, eu или другими поддерживаемыми значениями. Это сигнал на уровне запроса, а не конфигурация на уровне региона. Команды с требованиями к размещению данных должны устанавливать его в каждом запросе, а не полагаться только на выбор AWS-региона.

Путь через AWS PrivateLink доступен. Для команд, которым необходима частная VPC-связь с Claude без прохождения через публичный интернет, Claude Platform on AWS поддерживает AWS PrivateLink. Это та же схема, что доступна для Amazon Bedrock, но на endpoint под управлением Anthropic. Это важно для корпоративных развёртываний, где выход на публичные endpoint должен быть минимизирован.

Что пользователям TheRouter стоит проверить или попробовать

Провайдер anthropicAws, добавленный в Claude Code 2.1.198, использует тот же архитектурный путь. Команды, тестирующие Claude Code с anthropicAws в качестве gateway-failover, уже используют этот пул мощностей. Если эта конфигурация стабильно работает в Claude Code, тот же базовый endpoint доступен для более широких API-рабочих процессов.

Для команд, оценивающих политику роутинга провайдеров на TheRouter, трёхпутевая модель меняет конфигурацию upstream с двух вариантов (Anthropic vs Bedrock) на три. Каждый путь требует отдельной конфигурации аутентификации (SigV4 для Bedrock-путей; API-ключ или SigV4 для Claude Platform on AWS; API-ключ для Anthropic напрямую), что влияет на управление ротацией учётных данных и контроль доступа на уровне gateway.

Свойство отдельного пула мощностей — наиболее операционно значимая деталь для команд, занимающихся роутингом. Когда один пул испытывает задержки из-за нагрузки, другие могут работать нормально. Построение цепочки failover, охватывающей пулы, а не только провайдеров, — именно та стратегия роутинга, которую обеспечивает эта архитектура.

Архитектурная диаграмма: промпт проходит через routing-шлюз, затем через сервер безопасности AI и только потом попадает в модель Claude

Anthropic Inference Hooks переносит точку перехвата на уровень до запуска модели: что это значит для вашей routing-архитектуры

Inference Hooks от Anthropic перехватывают каждый управляемый промпт до того, как модель его обработает. Командам, фильтрующим на уровне gateway, это создаёт двухуровневую архитектуру контроля и требует ответа на вопрос, кто и что проверяет.

источник Anthropic Platform Docs
Абстрактная визуализация потока текстовых токенов со скрытыми паттернами водяного знака в распределении вероятностей

Текстовый водяной знак Claude приходит ко всем операторам: что Detection API SynthID-Text значит для вашего пайплайна

Будущие модели Claude встраивают водяной знак SynthID-Text глобально, отказаться нельзя. Detection API готовится. Операторам пайплайнов контент-модерации и compliance нужно понять, что знак доказывает и какие операции с токенами его уничтожают.

источник Anthropic
Абстрактная редакционная иллюстрация: классификатор биологии перенаправляет запросы на резервную модель в узле маршрутизации, представляя управляемый провайдером fallback в инфраструктуре AI API

Исправление классификатора биологии Fable 5: тихая замена модели, о которой ваш биллинг не предупредил

Fable 5 сократил fallback по биологическим запросам на 85%. Для API-операторов это обнажило скрытый риск: запросы к Fable 5 обслуживал Opus 5 без каких-либо предупреждений. Что нужно проверить, прежде чем считать, что паритет модели восстановлен.

источник Anthropic
Помощь и контакты