Конфиденциальность и хранение данных LLM API у разных провайдеров: что происходит с вашими промптами после отправки
Сравнительный справочник по политикам хранения данных и конфиденциальности API у OpenAI, Anthropic, Google, DeepSeek и DashScope. Мы сопоставили сроки хранения по умолчанию, варианты zero data retention, механизмы отказа от обучения, сертификаты соответствия и соглашения об обработке данных, чтобы вы могли принять решение о закупке, не перечитывая шесть разных политик конфиденциальности.
Любое корпоративное обсуждение закупки AI-сервисов рано или поздно упирается в один и тот же вопрос: что происходит с промптами и ответами после завершения API-вызова?
Ответ кардинально различается от провайдера к провайдеру. Кто-то удаляет API-трафик за 7 дней. Кто-то — за 30. Кто-то предлагает соглашение о zero data retention, при котором данные исчезают сразу после обработки. А как минимум один крупный провайдер до сих пор не опубликовал конкретных сроков хранения API-трафика.
Мы изучили опубликованные политики конфиденциальности, соглашения об обработке данных и корпоративную документацию пяти провайдеров, через которые проходит большая часть нашего трафика. Ниже — наши выводы по состоянию на август 2026 года.
Сводная таблица
| Провайдер | Хранение API (по умолчанию) | Используется для обучения? | ZDR доступен? | Ключевые сертификаты |
|---|---|---|---|---|
| OpenAI | 30 дней | Нет | Да (на уровне организации) | SOC 2, HIPAA BAA |
| Anthropic | 7 дней | Нет | Да (корпоративное соглашение) | SOC 2, HIPAA BAA |
| Google (Gemini API) | Зависит от тарифа | Нет (платные тарифы) | Да (платные тарифы) | SOC 2, ISO 27001, HIPAA BAA |
| DeepSeek | Не опубликовано | Нет явного обязательства | Нет | Ограниченная публичная документация |
| DashScope | Не опубликовано | Нет (явное обязательство) | Не задокументирован | SOC 2, AES-256 |
OpenAI: 30 дней по умолчанию, ZDR для корпоративных клиентов
Страница Enterprise Privacy OpenAI подтверждает: данные, отправленные через API, не используются для обучения моделей. Это касается API, ChatGPT Enterprise и ChatGPT Team. Потребительский ChatGPT (бесплатный и Plus) работает по другим правилам.
API-входы и выходы по умолчанию хранятся 30 дней для мониторинга злоупотреблений. После этого данные удаляются, если иное не требуется по закону.
OpenAI предлагает zero data retention (ZDR) для соответствующих клиентов. При ZDR промпты и ответы не сохраняются после завершения запроса. Параметр store принудительно устанавливается в false, даже если в коде указан true. ZDR охватывает /v1/chat/completions, /v1/responses, /v1/embeddings, /v1/audio/transcriptions, /v1/audio/translations, /v1/moderations и другие endpoint'ы из документации по контролю данных.
ZDR не включается самостоятельно. Его должен активировать ваш аккаунт-менеджер на уровне организации или проекта.
Стоит помнить об одном прецеденте. Во время судебного процесса New York Times против OpenAI в 2025 году суд обязал OpenAI сохранять определённые выходные данные. API-клиенты с ZDR-соглашением, ChatGPT Enterprise и ChatGPT Edu были исключены из этого предписания. OpenAI заявил, что обязательство по перспективному хранению данных закончилось 26 сентября 2025 года.
Источники: OpenAI Data Controls (получено 2026-08-12), OpenAI Enterprise Privacy (получено 2026-08-12)
Anthropic: 7 дней по умолчанию, самая короткая опубликованная базовая линия
В сентябре 2025 года Anthropic сократил срок хранения API-логов с 30 до 7 дней. Входы и выходы API автоматически удаляются через 7 дней. Они никогда не используются для обучения моделей.
Организации, которым нужен более длительный срок для аудита, могут выбрать 30-дневное окно через Data Processing Addendum. Но значение по умолчанию — самое короткое среди крупных провайдеров.
Для корпоративных API-клиентов доступно соглашение о zero data retention, при котором входы и выходы не сохраняются вообще (за исключением проверки на злоупотребления). Важный нюанс: Anthropic сохраняет результаты User Safety classifier даже при ZDR для применения политик использования.
Коммерческие продукты (Claude for Work, Enterprise, Edu, Gov) явно исключены из политик обучения для потребителей. Переключатель opt-in обучения для потребителей, введённый в августе 2025 года, не затрагивает API и коммерческих клиентов.
Anthropic предлагает HIPAA-совместимые услуги с BAA для квалифицированных медицинских клиентов. В рамках BAA некоторые функции (например, веб-поиск) отключаются.
Источники: Anthropic API and Data Retention (получено 2026-08-12), Anthropic Privacy Center (получено 2026-08-12), Anthropic Training Policy (получено 2026-08-12)
Google Gemini: конфиденциальность зависит от тарифа
Подход Google к обработке данных Gemini существенно различается в зависимости от тарифного плана и пути доступа.
Gemini Developer API (бесплатный тариф): Google может использовать промпты и ответы для улучшения продуктов и обучения моделей. Контент может проверяться живыми рецензентами. Не подходит для чувствительных или production-нагрузок.
Gemini Developer API (платный тариф): Google обязуется не использовать промпты и ответы для обучения моделей. Для пользователей платного тарифа по умолчанию действует zero data retention — входы и выходы не сохраняются после обработки.
Vertex AI: Действуют корпоративные условия Google Cloud. Данные клиентов не используются для обучения. Доступны контроль размещения данных, VPC Service Controls и CMEK (Customer-Managed Encryption Keys). Vertex AI поддерживает HIPAA, SOC 2 и ISO 27001.
Разница между бесплатным и платным тарифами у Google — самая резкая среди всех провайдеров. Если вы оцениваете Gemini для чего-то серьёзнее прототипирования, различие между тарифами принципиально.
Источники: Google Gemini API ZDR (ссылка 2026-08-12), Gemini API Terms (ссылка 2026-08-12)
DeepSeek: отличные open-weight модели, непрозрачные практики обработки данных
DeepSeek занимает необычную позицию. Модели серии V4 предлагают выдающееся соотношение цены и производительности, а open-weight релизы (V3, R1) позволяют развернуть модель на собственной инфраструктуре. Но у hosted API практики обработки данных — наименее прозрачные среди крупных провайдеров.
Политика конфиденциальности DeepSeek указывает, что компания собирает «text input, voice input, prompt, uploaded files, photos, feedback, chat history, or other content». Политика не указывает конкретный срок хранения API-трафика. Нет публичного заявления, аналогичного «not used for training» у OpenAI или «deleted after 7 days» у Anthropic.
DeepSeek не публиковал шаблон Data Processing Agreement, HIPAA BAA или вариант ZDR.
Для команд, которым нужна производительность уровня DeepSeek с более строгим управлением данными, развёртывание open-weight моделей — самый практичный путь. Веса DeepSeek V4 доступны на Hugging Face, а такие провайдеры, как SiliconFlow, предлагают hosted inference на своих условиях конфиденциальности.
Источники: DeepSeek Privacy Policy (получено 2026-08-12), DeepSeek API Documentation (получено 2026-08-12)
DashScope (Alibaba Cloud Model Studio): без обучения, SOC 2
Уведомление о конфиденциальности Alibaba Cloud Model Studio формулирует одно обязательство предельно чётко: «Alibaba Cloud strictly protects your data privacy and will never use your data for model training.»
Все данные, передаваемые во время API-вызовов, шифруются AES-256. DashScope имеет сертификат SOC 2 с безоговорочным заключением, покрывающий безопасность, доступность и конфиденциальность.
DashScope не опубликовал конкретный срок хранения API-входов и выходов. Уведомление о конфиденциальности отсылает к условиям обслуживания продуктов Alibaba Cloud за подробностями.
DashScope публично не предлагает ZDR-соглашение или HIPAA BAA, хотя корпоративные клиенты Alibaba Cloud могут согласовать индивидуальные условия обработки данных через своего аккаунт-менеджера.
Источники: DashScope Privacy Notice (получено 2026-08-12), Alibaba Cloud Compliance Repository (получено 2026-08-12)
Дерево решений: выбор провайдера по уровню чувствительности данных
Нужен HIPAA: OpenAI (с BAA), Anthropic (с BAA) или Google Vertex AI. DashScope и DeepSeek не предлагают HIPAA-совместимых услуг для международных клиентов.
Нужен zero data retention: OpenAI ZDR (запрос через аккаунт-менеджера), Anthropic ZDR (корпоративное соглашение) или Google Gemini платный тариф / Vertex AI.
Нужен минимальный срок хранения по умолчанию: Anthropic с 7 днями — самый короткий, далее OpenAI с 30 днями.
Нужна гарантия «без обучения» для работы преимущественно в Китае: DashScope предоставляет явное обязательство не использовать данные для обучения плюс SOC 2.
Стоимость — главное ограничение, чувствительность данных низкая: API DeepSeek предлагает лучшее соотношение цены и производительности, но нужно учитывать пробел в управлении данными. При высоких требованиях к соответствию рассмотрите развёртывание open-weight моделей.
Как единый шлюз упрощает управление данными
Когда вы направляете трафик к нескольким LLM-провайдерам напрямую, каждый из них — это отдельное соглашение об обработке данных, отдельная проверка соответствия и отдельная поверхность аудита.
OpenAI-совместимость означает, что провайдер предоставляет endpoint chat-completions, чей контракт запроса и ответа достаточно близок к API OpenAI, чтобы немодифицированный вызов OpenAI SDK работал после замены трёх значений: API key, base URL, название модели. Минимальная поверхность на практике —POST /v1/chat/completions с messages, model и потоковым ответом в форме OpenAI.
Единый шлюз вроде TheRouter консолидирует поверхность управления поставщиками. Код вашего приложения обращается к одному endpoint. Команда compliance проверяет один набор правил маршрутизации. Когда практики обработки данных у провайдера меняются, вы обновляете одну конфигурацию маршрутизации, а не патчите каждый сервис, обращающийся к этому провайдеру напрямую.
Это не отменяет политик провайдеров. Ваши данные по-прежнему попадают к тому провайдеру, на который вы маршрутизируете. Но операционная поверхность сокращается с N отношений с поставщиками до одного шлюза плюс N провайдерских соглашений, и у вас появляется единая точка для активации fallback-маршрутизации, если практики обработки данных провайдера изменятся так, что ваша организация не сможет это принять.
Что не вошло в этот справочник
Справочник сосредоточен на хранении API-данных и политиках обучения. Мы не охватили:
- Хранение данных fine-tuning, которое у каждого провайдера регулируется отдельными и обычно более длительными правилами
- Данные Stored Completions / Assistants API, которые вы подключаете явно и которые имеют свой жизненный цикл
- Политики потребительских продуктов (ChatGPT бесплатный, Claude бесплатный, Gemini бесплатное потребительское приложение), которые работают по другим и обычно менее строгим условиям
- Размещение данных (в каком географическом регионе обрабатываются ваши данные), которое мы планируем рассмотреть в отдельном справочнике
Источники и даты получения
Все утверждения о политиках в этом справочнике проверены по указанным источникам 12 августа 2026 года. Политики конфиденциальности LLM API могут меняться. Перед принятием решений о закупке сверяйтесь с актуальной опубликованной политикой.
| Провайдер | Источник | Получено |
|---|---|---|
| OpenAI | Data Controls, Enterprise Privacy | 2026-08-12 |
| Anthropic | API and Data Retention, Privacy Center | 2026-08-12 |
| Gemini API ZDR, Gemini API Terms | 2026-08-12 | |
| DeepSeek | Privacy Policy, API Docs | 2026-08-12 |
| DashScope | Privacy Notice, Compliance Repository | 2026-08-12 |