LLM API 数据隐私与留存策略跨厂商对比:你的 Prompt 发出后去了哪里
OpenAI、Anthropic、Google、DeepSeek、DashScope 五家厂商在 API 数据留存、训练退出机制、零数据留存协议和合规认证上的做法差异巨大。我们梳理了每家厂商的隐私政策、DPA 条款和企业级选项,帮你在采购前做一次全面比对,而不用逐份读完六份隐私协议。
做企业 AI 采购的人迟早都会问同一个问题。我通过 API 发出去的 Prompt 和拿回来的回复,到底在厂商那边留了多久?有没有拿去训练模型?出了合规事故谁来兜底?
答案在不同厂商之间差距惊人。有的 7 天就删,有的 30 天,还有的可以签零留存协议让数据在请求完成后立刻消失。但也有厂商至今没有公开发布过一个明确的留存窗口。
我们逐一查阅了五家我们路由流量最多的厂商在 2026 年 8 月的隐私政策、数据处理协议和企业文档。下面是我们找到的全部结论。
速查表
| 厂商 | 默认 API 留存 | 是否用于训练? | 零留存可用? | 关键合规 |
|---|---|---|---|---|
| OpenAI | 30 天 | 否 | 是(组织级申请) | SOC 2, HIPAA BAA |
| Anthropic | 7 天 | 否 | 是(企业协议) | SOC 2, HIPAA BAA |
| Google (Gemini API) | 按套餐区分 | 否(付费版) | 是(付费版) | SOC 2, ISO 27001, HIPAA BAA |
| DeepSeek | 未公开 | 未明确承诺 | 否 | 公开文档有限 |
| DashScope | 未公开 | 否(明确承诺) | 未记录 | SOC 2, AES-256 加密 |
OpenAI:默认 30 天,企业可申请零留存
OpenAI 的企业隐私页面承诺,通过 API 提交的数据不会用于训练模型。这一承诺覆盖 API、ChatGPT Enterprise 和 ChatGPT Team。消费级 ChatGPT(免费版和 Plus)适用不同条款。
API 输入和输出默认留存 30 天,用于滥用监控。30 天后数据删除,除非法律义务要求更长的留存。
OpenAI 为符合条件的客户提供零数据留存(ZDR)。启用 ZDR 后,Prompt 和回复在请求完成后不再存储。store 参数被强制设为 false,即使你的代码把它设成了 true。ZDR 覆盖 /v1/chat/completions、/v1/responses、/v1/embeddings、/v1/audio/transcriptions、/v1/audio/translations、/v1/moderations 等端点。
ZDR 不能自助开通,必须通过客户经理在组织或项目级别启用。
有一个值得记住的先例。2025 年纽约时报版权诉讼期间,法院的保全令要求 OpenAI 留存特定输出数据。持有 ZDR 协议的 API 客户、ChatGPT Enterprise 和 ChatGPT Edu 被排除在保全令之外。OpenAI 表示该项前瞻性留存义务已于 2025 年 9 月 26 日终止。
来源 OpenAI Data Controls(检索于 2026-08-12)、OpenAI Enterprise Privacy(检索于 2026-08-12)
Anthropic:默认 7 天,公开发布的最短基线
Anthropic 在 2025 年 9 月将 API 日志留存从 30 天缩短到 7 天。API 输入和输出在 7 天后自动删除,不会用于模型训练。
需要更长留存窗口用于审计的组织可以通过数据处理附录(DPA)选择 30 天窗口。但默认值是主流厂商中公开发布的最短基线。
企业级 API 客户可签署零数据留存协议,让输入输出完全不被存储(滥用筛查除外)。但即使在 ZDR 下,Anthropic 仍然留存用户安全分类器的结果,用于执行使用政策。
商业产品(Claude for Work、Enterprise、Edu、Gov)明确排除在 2025 年 8 月消费者训练政策变更之外。API 客户和商业客户不受消费者训练开关影响。
Anthropic 为合格医疗客户提供 HIPAA 级别的 BAA。在 BAA 下,某些功能(如网页搜索)会被禁用。
来源 Anthropic API and Data Retention(检索于 2026-08-12)、Anthropic Privacy Center(检索于 2026-08-12)、Anthropic Training Policy(检索于 2026-08-12)
Google Gemini:看套餐定隐私
Google 对 Gemini 的数据处理方式因套餐和访问路径的不同而差别很大。
Gemini Developer API(免费版) 允许 Google 使用 Prompt 和回复来改进产品和训练模型。内容可能被人工审阅者查看。不适用于敏感或生产工作负载。
Gemini Developer API(付费版) 则相反,Google 承诺不使用 Prompt 和回复进行模型训练。付费用户默认享有零数据留存,输入输出在处理后不再存储。
Vertex AI 适用 Google Cloud 企业级条款。客户数据不用于模型训练。提供数据驻留控制、VPC Service Controls 和 CMEK(客户管理加密密钥)。Vertex AI 支持 HIPAA、SOC 2 和 ISO 27001。
免费版和付费版之间的策略差距在所有厂商中最为突出。如果评估 Gemini 的目的不只是做原型验证,付费版与免费版的区别是绕不过去的。
来源 Google Gemini API ZDR 文档(参考于 2026-08-12)、Gemini API 服务条款(参考于 2026-08-12)
DeepSeek:开源权重出色,托管 API 数据实践不透明
DeepSeek 的位置比较特殊。V4 系列模型性价比出色,开源权重(V3、R1)允许自行部署。但托管 API 的数据实践在主流厂商中透明度最低。
DeepSeek 的隐私政策声明会收集「文本输入、语音输入、Prompt、上传文件、照片、反馈、聊天记录或其他内容」。政策中没有给出 API 流量的具体留存时长,也没有类似 OpenAI 那样「不用于训练」的公开声明,更没有 Anthropic 那样「7 天后删除」的明确承诺。
DeepSeek 没有发布过数据处理协议(DPA)模板、HIPAA BAA,也没有零数据留存选项。
对于需要 DeepSeek 级别性能但数据治理要求更严格的团队,自行部署开源权重是最务实的路径。DeepSeek V4 权重可在 Hugging Face 下载,SiliconFlow 等服务商也提供各自隐私条款下的托管推理。
来源 DeepSeek Privacy Policy(检索于 2026-08-12)、DeepSeek API Documentation(检索于 2026-08-12)
DashScope(阿里云模型服务):不训练、SOC 2 认证
阿里云模型服务的隐私声明把一个承诺写得很清楚。原文说「阿里云严格保护您的数据隐私,绝不会将您的数据用于模型训练。」
API 调用期间传输的所有数据使用 AES-256 加密。DashScope 持有 SOC 2 无保留意见认证,覆盖安全性、可用性和机密性。
DashScope 没有公开发布过 API 输入输出的具体留存时长。隐私声明引导用户参阅阿里云国际站产品服务条款了解详细数据处理条款。
DashScope 目前没有公开提供零数据留存协议或 HIPAA BAA,不过企业级阿里云客户可以通过客户经理协商定制数据处理条款。
来源 DashScope Privacy Notice(检索于 2026-08-12)、阿里云合规资质库(检索于 2026-08-12)
决策树:按数据敏感度选厂商
HIPAA 合规场景适合选 OpenAI(需签 BAA)、Anthropic(需签 BAA)或 Google Vertex AI。DashScope 和 DeepSeek 目前没有面向国际客户的 HIPAA 级别服务。
零数据留存场景适合选 OpenAI ZDR(通过客户经理申请)、Anthropic ZDR(企业协议)或 Google Gemini 付费版 / Vertex AI。
追求最短默认留存的团队应优先看 Anthropic 的 7 天窗口,其次是 OpenAI 的 30 天。
在中国境内需要「不训练」保证的团队,DashScope 提供了明确的不训练承诺加上 SOC 2 认证。
成本是首要约束而数据敏感度较低的团队,DeepSeek 的 API 价格性能比最好,但需要为数据治理的缺口做好预案。合规要求高的话,考虑自行部署开源权重。
统一网关如何简化数据治理
直接对接多家 LLM 厂商时,每一家都是一份单独的数据处理协议、一次单独的合规审查、一块单独的审计面。
OpenAI 兼容指供应商提供一个 chat-completions 接口,其请求与响应结构与 OpenAI API 契约足够接近——只需替换三个值(API key、base URL、模型名),原来的 OpenAI SDK 调用即可直接工作。最小实践面是POST /v1/chat/completions 带 messages、model, 并返回 OpenAI 形式的流式响应。
像 TheRouter 这样的统一网关可以收敛供应商管理面。你的应用代码只对接一个端点,合规团队只审查一套路由规则。当某家厂商的数据实践发生变化时,你调整一个路由配置就够了,不用给每个调用该厂商的服务打补丁。
这并不消除底层厂商的政策约束。你的数据仍然会到达你路由到的那个厂商。但它把运维面从 N 个供应商关系降到了一个网关加 N 个厂商协议。如果某家厂商的数据实践发生了你的组织无法接受的变化,你可以通过回退路由一键切换到其他厂商。
本文未覆盖的内容
本参考聚焦于 API 数据留存和训练策略,以下内容不在本文范围内。
- Fine-tuning 数据留存,每家厂商都有单独且通常更长的留存规则
- Stored Completions / Assistants API 数据,你需要显式启用,有自己的生命周期
- 消费级产品策略(ChatGPT 免费版、Claude 免费版、Gemini 免费消费者应用),它们适用不同且通常限制更少的条款
- 数据驻留(你的数据在哪个地理位置被处理),我们计划在另一篇参考中覆盖
来源与检索日期
本参考中的所有政策声明均于 2026 年 8 月 12 日依据下方链接的来源核实。LLM API 隐私政策随时可能变更。在做采购决策前请核实厂商当前发布的政策。
| 厂商 | 来源 | 检索日期 |
|---|---|---|
| OpenAI | Data Controls、Enterprise Privacy | 2026-08-12 |
| Anthropic | API and Data Retention、Privacy Center | 2026-08-12 |
| Gemini API ZDR、Gemini API Terms | 2026-08-12 | |
| DeepSeek | Privacy Policy、API Docs | 2026-08-12 |
| DashScope | Privacy Notice、Compliance Repository | 2026-08-12 |