OpenAI 预览企业隐私安全监测

TechCrunch AI··作者 Lucas Ropek

关键信息

OpenAI 表示,Private Safety Processing 在 Zero Data Retention 基础上扩展了能力,可以跨多个对话进行长周期监测,而不只是按单次会话检查。如果被触发,它会向 OpenAI 发送一个范围很窄的信号以便决定是否执行处置;相比之下,Anthropic 的方案允许在受控访问和不可篡改日志下进行有限人工审查。

资讯摘要

随着 AI 模型能力不断增强,被滥用的风险也在上升,这迫使公司在加强安全护栏的同时尽量不牺牲企业客户的隐私。OpenAI 现在推出了 Private Safety Processing,这是一个面向部分客户的预览服务,目标是在不保留客户数据的前提下检测滥用行为。OpenAI 将这项系统描述为对其现有 Zero Data Retention 模式的隐私保护扩展。与按单次会话监测不同,Private Safety Processing 可以跨多个对话分析输入和输出,从而识别那些分散、缓慢进行的滥用尝试。OpenAI 表示,这有助于发现可能为了绕过常规防护而刻意拉长时间、拆分请求的恶意行为。

如果系统识别到可疑活动,它会向 OpenAI 发送一个范围很窄的信号,表明具体的风险类型。随后,OpenAI 可以决定是否需要采取处置措施;如果需要,公司可能会联系客户获取更多上下文,或与客户一起处理问题。OpenAI 还表示,客户可以在自己决定的情况下选择进一步分享数据。这项举措也明显是在回应 Anthropic 最近推出的 30 天留存政策,该政策适用于 covered models,包括 Mythos-class 模型以及未来具有类似能力的模型。Anthropic 表示,保留窗口是为了支持安全分析,但这已经让一些企业客户感到不安,因为他们不希望自己的数据被 AI 实验室存储或审查。

OpenAI 预览企业隐私安全监测

资讯正文

随着 AI 模型变得越来越强大,这些模型被滥用的可能性也在增加——与此同时,人们对于能够阻止此类滥用的安全护栏的呼声也越来越高。如今,AI 公司必须在尊重企业客户隐私与监控使用情况、及时发现潜在问题之间走钢丝。

OpenAI 察觉到一个超越竞争对手 Anthropic 的机会,刚刚宣布了一种以隐私为核心的滥用监控安全方案。该公司正在向部分客户预览一项名为 Private Safety Processing 的新服务。这是一套自动化系统,能够监控潜在的滥用行为,同时完全不保留客户数据。

这套系统显然与 Anthropic 近期宣布的数据留存政策相悖。该政策已经令一些客户感到不满:对于“涵盖模型”(covered models),这家 AI 实验室可以将用户数据——包括用户的所有会话及其中的对话——保留 30 天。该公司表示,这些模型包括所有 Mythos 系列模型,以及“未来具备类似能力的模型”。

这项于 7 月宣布的政策旨在用于安全目的,让该实验室能够筛查和分析潜在的不当行为。然而,一些处理大量敏感数据的企业对此深感担忧,因为它们不希望这些数据被 AI 实验室保存(或检查)。

与大多数其他 AI 公司一样,OpenAI 已经通过遵守一项名为 Zero Data Retention 的政策,为客户提供相对程度的隐私保护。ZDR 利用 OpenAI API 中的代理,按会话监控滥用行为。这样一来,客户数据不会被公司保留,但企业仍然可以在无需人工干预的情况下扫描不当活动。值得注意的是,Anthropic 也基本遵守 ZDR——但“涵盖模型”(covered models)除外,例如 Fable。

OpenAI 表示,Private Safety Processing 是一项扩大 ZDR 范围的新技术。该公司将其描述为一种长时段安全监控形式,能够评估多次对话的输入和输出,而不只是单次对话。同样,监控工作由代理执行;一旦触发,该代理便会捕捉相关交互,并跨会话进行分析,以寻找潜在滥用的迹象。

一名发言人告诉 TechCrunch,这项新技术可以帮助 OpenAI 发现跨多个会话发生的恶意 AI 使用行为。恶意行为者——假设是试图为网络攻击设计恶意软件的人——可能会分散提出请求,以避免被发现。Private Safety Processing 可以分析这些多次对话中的滥用迹象,而无需人工审查用户的对话。

该公司表示,如果系统被触发,可能会向 OpenAI 发送一个“定义范围严格的信号”,提醒其某种特定类型的活动。OpenAI 称,公司可以根据这一信号决定“是否有必要采取强制措施”。如果确有必要,OpenAI 将联系客户以获取更多背景信息,或与客户共同处理这一问题;这名发言人表示,客户可以自行决定是否向 OpenAI 分享数据。

相比之下,Anthropic指出,客户数据的人类审查确实可能发生,但仅限于“通过受控访问路径”,且涉及“少数经批准的审查员”。公司表示,每一次审查会话都会“记录在一份审查员无法抑制或修改的防篡改日志中”。

OpenAI与Anthropic之间的企业竞争眼下相当紧张,两家公司都在寻找任何机会来获得对方的优势。最近的一份报告显示,OpenAI第二季度的增长速度慢于Anthropic。Anthropic的年化收入运行率据称已达650亿美元。Anthropic的投资者表示,该公司可能以2万亿美元估值上市,而OpenAI也在推进自己的IPO。

来源与参考

  1. 原始链接
  2. OpenAI seeks to one-up Anthropic with new customer privacy protections | TechCrunch

收录于 2026-08-21