一句话总结
企业用大模型,最敏感的问题从来不是「聪明不聪明」,而是「我的数据会不会被拿走」。2026 年 8 月,OpenAI 与 Anthropic 两家头部实验室在这个问题上公开站到了对立面:OpenAI 预览 Private Safety Processing,宣称能在「零数据保留」下做安全监控;而 Anthropic 上个月刚要求对旗舰模型保留 30 天数据用于安全审查。安全与隐私,第一次被摆到了同一天平的两端。
数据来源
本文事实依据来自 TechCrunch(2026-08-19)、The Register(2026-08-20)、The Next Web 的报道,以及 OpenAI 官方博客《Offering Zero Data Retention for frontier models》与 Anthropic 官方风险报告。
事件背景:两条相反的路线
事情的起点,是 Anthropic 在 7 月发布的一则数据保留政策:对「covered models」(覆盖 Mythos 5、Fable 5 等旗舰,以及未来能力相近的模型),要求保留用户提示与模型输出 30 天,理由是「安全监控需要」。
这个政策立刻引发企业客户反弹——大量处理敏感数据的公司,不愿让自己的会话被 AI 实验室「留存并审查」哪怕一天。于是 OpenAI 看准机会,在 8 月 19 日打出反击:预览一套名为 Private Safety Processing(PSP) 的新机制,宣称能在保留零数据的前提下,完成跨会话的安全监控。
两家公司其实描述了同一个问题——「危险行为往往跨多次请求才显现,单看一次请求看不出来」——却给出了相反的解法:
| 公司 | 政策 | 核心理由 |
|---|---|---|
| Anthropic | 旗舰模型保留 30 天数据 | 只有留存数据,才能发现跨请求的攻击 |
| OpenAI | 零数据保留(ZDR)+ PSP | 用 Agent 跨会话分析,但人类不接触原始内容 |

Anthropic 的「30 天保留」:安全优先的代价
Anthropic 的逻辑很直接:如果一个攻击者把恶意请求拆散、分散在几十次对话里,系统只有跨请求地审视这些数据,才能拼出攻击的全貌。而要做到这一点,数据就得先「留下来」。
所以 Anthropic 的政策是:
- 对 Mythos 5、Fable 5 等「covered models」,提示与输出保留 30 天;
- 保留的数据「默认无人可读」,仅当被自动化安全系统标记时,才通过受控访问路径由一小批授权审查者查看;
- 每次人工审查都记录在不可篡改的日志里。
Anthropic 自己也承认,这个政策「会不受欢迎」——尤其对已经习惯了「零保留」的企业客户。它在风险报告里预判了真实业务损失的风险,尤其担心「竞争对手不跟进」。
OpenAI 的 PSP:隐私优先的「技术秀」
OpenAI 的回应,本质上是一次「技术打脸」:你 Anthropic 说「要安全就得保留数据」,我 OpenAI 偏要说「不保留数据,也能安全」。
Private Safety Processing 的核心机制:
- 基于 OpenAI 已有的 ZDR(Zero Data Retention,零数据保留) 政策,将其从「单次请求」扩展到「多次相关请求的跨会话分析」;
- 由 Agent 自动监控,分析跨会话的输入输出,寻找滥用信号;
- 一旦触发,只向 OpenAI 发出一个「窄义信号」(如「检测到某类活动」),原始提示和回复不被任何 OpenAI 员工接触。
用 OpenAI 的话说:「自动系统能识别潜在滥用并返回有限的安全信号,而不把底层的提示或响应暴露给 OpenAI 人员。」9 月它还会发布配套白皮书,解释这套系统到底怎么做到「既监控、又不看内容」。

对企业意味着什么:三道选择题
这场「隐私之争」的直接后果,是企业客户被推到了十字路口。选模型时,除了价格和能力,现在还要多问三个问题:
- 我的数据会不会被保留? 如果用 Anthropic 旗舰,答案是「会,30 天」;用 OpenAI 的 ZDR 客户,答案是「不会」。
- 谁可能看到我的数据? 两边都声称「默认无人可读」,但 Anthropic 保留了「受控人工审查」的通道,OpenAI 则强调「员工零接触」。
- 安全监控到底怎么做的? Anthropic 靠「留存 + 审查」,OpenAI 靠「Agent 跨会话分析」。前者透明但有隐私成本,后者保护隐私但技术细节尚未公开。
对金融、医疗、法律等强监管行业,「数据出不出得去、留不留得下」直接决定能不能用。这也是为什么 OpenAI 把 PSP 定位成「从 Anthropic 抢客户的武器」——The Wall Street Journal 直接把这次预览读作「针对对 Anthropic 政策不满客户的商业争夺」。

大背景:IPO 前的贴身肉搏
这场隐私之争,不是孤立的技术争论,而是两家公司 IPO 前贴身肉搏的一个切面:
- 营收:Anthropic 年化营收运行率已达 650 亿美元,OpenAI 约 400 亿美元;
- 估值:Anthropic 传以 2 万亿美元 估值 IPO,OpenAI 目标 1 万亿美元以上;
- 安全姿态:OpenAI 此前刚因 Hugging Face 事件放缓 Astra 训练、重写安全规则;Anthropic 则在年初弱化了「无条件暂停」的承诺。
在冲刺上市的当口,谁能在「企业客户最在意的数据隐私」上多拿一分,谁就能在招股书里多写一行。隐私,已经从技术合规问题,变成了商业竞争问题。

总结
- 同题异解:OpenAI 与 Anthropic 都承认「跨请求监控」是安全的刚需,但一个选「零保留 + Agent 分析」,一个选「30 天留存 + 受控审查」;
- 隐私成为卖点:OpenAI 把 PSP 直接当作争夺企业客户的武器,隐私首次以「产品」而非「合规」的面貌出现;
- 企业决策变复杂:选模型从此不只是「看分数、比价格」,还要看「数据保留政策、审查路径、技术透明度」;
- 真正的赢家尚未产生:OpenAI 的 PSP 技术细节要等 9 月白皮书才见分晓,Anthropic 的 30 天政策是否会因竞争压力松动,也值得持续观察。
对普通用户,这场争论带来的最直接启示是:用 AI 处理敏感信息前,先搞清楚平台的保留政策——「你的数据,可能不只是你的数据。」
相关阅读:OpenAI 工具页 · Claude 工具页 · 模型路由:把请求发给对的人