核心事件:安全审查也要“少看数据”
OpenAI正在向部分客户预览一项名为 Private Safety Processing 的新服务,试图在企业客户最敏感的隐私问题上压过 Anthropic:它宣称可监测潜在滥用,同时不保留客户数据。
这场竞争的背景是,大模型能力越强,被用于恶意用途的风险也越高。企业客户一方面希望AI公司能拦截网络攻击、恶意自动化等滥用行为,另一方面又不愿把商业机密、客户资料或内部对话长期交给模型供应商保存。如何在安全与隐私之间取得平衡,正在成为企业AI采购的新门槛。
OpenAI的新方案:跨会话监控但不保留内容
OpenAI现有企业隐私做法主要依赖 Zero Data Retention,简称 ZDR,即“零数据留存”。简单说,ZDR是在API会话中用自动化代理检查异常行为,但公司不保存客户数据,也不需要人工介入逐条查看。
Private Safety Processing被OpenAI描述为对ZDR范围的扩展。过去的监测更偏向单次会话,而新系统面向“长周期安全监控”,可评估多次对话中的输入与输出。如果系统发现触发条件,会跨会话分析是否存在滥用迹象。
OpenAI向TechCrunch表示,这有助于发现分散在多轮会话中的恶意使用。例如,假设有人试图设计用于网络攻击的恶意软件,可能会把请求拆散,以逃避单次会话检测。新系统的目标是识别这种跨会话模式,但仍不让人工审阅用户对话。
其处理路径可概括为:
- 自动化代理监控多次会话中的潜在滥用;
- 触发后只向OpenAI发送“范围很窄的信号”;
- OpenAI据此判断是否需要执行处置;
- 如需进一步了解,OpenAI会联系客户,客户可自行决定是否共享数据。
**关键差异在于,OpenAI强调传回的是特定活动信号,而不是完整会话内容。**这使它能够把安全能力包装成一种更适合高敏感行业的企业功能。
Anthropic的30天留存政策引发对比
OpenAI此举明显针对Anthropic近期的客户数据政策。Anthropic在7月宣布,对于“covered models”,可将用户数据保留30天,用于安全目的,范围包括所有 Mythos-class 模型以及“未来具有类似能力的模型”。报道还提到,Fable属于这类覆盖模型。
Anthropic的逻辑是,留存数据有助于实验室筛查和分析潜在不当行为。但该政策让部分企业客户不安,尤其是那些处理大量敏感信息的机构。它们担心数据不仅被保存,还可能被AI实验室检查。
不过,Anthropic也表示人工审阅并非无限制进行。若发生人工查看,会通过受控访问路径完成,只允许少数获批审阅者参与;每次审阅会话都会记录在不可篡改日志中,审阅者无法压制或修改记录。换言之,Anthropic强调的是受控审查和可追溯性,而OpenAI此轮主打的是尽量不触碰内容。
企业市场的隐私牌正在变硬
这场隐私攻防发生在OpenAI与Anthropic竞争升温之际。报道称,OpenAI第二季度增长速度慢于Anthropic;Anthropic的年化收入运行率据称已达650亿美元。Anthropic投资者曾表示其IPO估值可能达到2万亿美元,而OpenAI也在推进IPO相关工作。
这些数字说明,企业AI市场不仅拼模型能力,也拼合规、安全和信任。对于企业来说,模型是否更强当然重要,但数据能否少留存、少暴露、少被人工查看,同样会影响合同签署。尤其在金融、医疗、法律、网络安全等场景,隐私条款可能比功能演示更早进入采购审查。
走向判断:安全能力将被产品化
Private Safety Processing的意义不只是一次功能更新,而是表明AI公司正在把安全治理做成可销售、可比较的企业产品。过去,“安全审查”常被视为供应商后台工作;现在,它正变成客户可询问、可谈判、可写入合同的能力。
接下来,企业客户可能会要求更细的选择权:哪些模型适用零留存,哪些风险信号会被上报,何时需要人工介入,审计日志如何提供。OpenAI和Anthropic的路线差异,也预示行业不会只有一种答案。更可能出现的趋势是:高能力模型需要更强安全监控,而企业客户会迫使供应商用更少数据完成同样任务。

