两大AI巨头正围绕企业客户数据隐私保护展开竞争,各自推出更强数据隔离方案。
随着 AI 模型变得越来越强大,这些模型被滥用的可能性也在增长——对安全护栏的呼声同样高涨,人们希望这些护栏能够阻止此类滥用行为。AI 公司如今必须在尊重企业客户隐私与监控使用情况以发现潜在问题之间走一条微妙的钢丝。
察觉到有机会超越其竞争对手 Anthropic,OpenAI 刚刚宣布了一种以隐私为中心的安全方法来监控滥用行为。该公司正在向部分客户预览一项名为 Private Safety Processing 的新服务。这是一个自动化系统,用于监视潜在的滥用行为,同时不保留任何客户数据。
该系统显然与 Anthropic 近期宣布的数据保留政策背道而驰。这项政策激怒了一些客户,它使 AI 实验室能够在涉及"覆盖模型"时,保留用户数据(所有会话及其中的对话)长达 30 天。该公司表示,这些模型包括所有 Mythos 系列模型以及"未来具有类似能力的模型"。
该政策于今年 7 月宣布,其目的是为了安全,让实验室能够筛选和分析潜在的违规行为。然而,它深深困扰着一些处理大量敏感数据的企业,这些企业不希望自己的数据被 AI 实验室保存或检查。
OpenAI 与大多数其他 AI 公司一样,已经通过采用名为 Zero Data Retention 的政策为客户提供了一定程度的隐私保护。ZDR 在 OpenAI API 中使用 Agent 来逐个会话地监控滥用行为。通过这种方式,客户数据不会被公司保留,但企业仍然能够扫描不良行为而无需人工干预。值得注意的是,Anthropic 基本上也遵守 ZDR——除了在"覆盖模型"(如 Fable)方面。
OpenAI 表示,Private Safety Processing 是一项扩展 ZDR 覆盖范围的新技术。它被描述为一种长期安全监控形式,评估多个对话的输入和输出——而不仅仅是一个。再次强调,监控由 Agent 执行,如果被触发,会捕获交互并跨会话分析潜在滥用的迹象。
一位发言人向 TechCrunch 透露,这项新技术帮助 OpenAI 检测跨多个会话发生的恶意 AI 使用。一个恶意行为者——假设是试图设计网络攻击恶意软件的人——可能会分散其请求以避免检测。Private Safety Processing 可以分析这些多个对话中的滥用迹象,而无需对用户对话进行人工审查。
该公司表示,在系统被触发的情况下,它可能会向 OpenAI 发送一个"狭义定义的信号",警告特定类型的活动。基于该信号,OpenAI 然后可以决定是否"需要执法"。发言人表示,如果需要,OpenAI 将联系客户获取更多背景信息或与他们合作处理问题,客户可以选择自行决定是否与 OpenAI 共享数据。
相比之下,Anthropic 指出,对客户数据的人工审查可能会发生,但只能"通过受控访问路径",涉及"一小部分经批准的审查员"。该公司表示,每次审查会话都会被记录在"防篡改日志中,审查员无法抑制或修改"。
OpenAI 与 Anthropic 之间的企业竞争目前非常激烈,两家公司都在寻找任何机会来获得对另一方的优势。最近的一份报告显示,OpenAI 第二季度增长慢于 Anthropic。据报道,Anthropic 目前的年化收入运行率为 650 亿美元。Anthropic 投资者表示,该公司可以 2 万亿美元的估值 IPO,而 OpenAI 也在推进自己的 IPO。