首页
学习
活动
专区
圈层
工具
发布

“零数据保留”,OpenAI解决AI最大隐私矛盾

“随着 AI 系统承担越来越长、越来越复杂的任务,更广泛的上下文对于区分正常活动与滥用行为变得越来越重要。”

OpenAI 今天宣布,面向前沿模型预览“私密安全处理”(Private Safety Processing)。

基于此,符合条件的 API 客户仍可使用零数据保留(ZDR),请求处理完成后,OpenAI 不保留提示词和模型响应,客户内容也不会提供给 OpenAI 员工审核。

新方案进一步将安全检测从“单次交互”扩展到“多次相关交互”,通过自动化系统识别潜在的滥用模式,但不向 OpenAI 员工暴露底层内容。

即使客户选择将数据存储在 OpenAI 基础设施上,内容也会使用客户控制的密钥加密,OpenAI 员工无法访问。发现风险后,OpenAI 只能获得有限的安全信号,例如活动类型和严重程度,而不是具体的提示词或模型响应。

公司计划于今年 9 月开始逐步推出这一机制,并发布技术白皮书。

以下为声明全文——

预览“私密安全处理”(Private Safety Processing),在保持与 ZDR 兼容的同时,加强跨交互的安全防护。

零数据保留(Zero Data Retention,ZDR)为符合条件的 API 客户提供了一项明确承诺:请求处理完成后,OpenAI 不会保留客户的提示词或模型响应。客户内容不会提供给 OpenAI 员工进行审核¹;除非企业客户明确选择加入,否则企业客户数据不会被用于训练我们的模型。

随着模型开始承担更长、更复杂的任务,一些严重风险可能只有在多次交互中才能显现。现有兼容 ZDR 的安全系统会分别评估每一次交互。

今天,我们预览“私密安全处理”(Private Safety Processing),旨在识别相关交互之间的模式,同时不让 OpenAI 员工接触底层内容。

对于 ZDR 部署,客户内容仍保留在客户控制的基础设施上。我们也正在开发一种选项:将内容存储在 OpenAI 的基础设施上,但使用由客户控制的密钥进行加密。

在这两种情况下,自动化系统都可以识别潜在的滥用行为,并返回有限的安全信号,而不会将底层提示词或响应暴露给 OpenAI 员工。

为什么安全系统需要不断演进

最严重的 AI 安全风险并不总能在单次交互中被发现。很多时候,只有将多次交互放在一起观察,潜在的有害意图才会变得清晰。

类似的风险也可能出现在恶意行为者反复探测安全防护、跨账户协同行动,或者将威胁伪装成常规研究活动时。风险还可能在 Agent 任务执行过程中逐渐形成——例如,当系统在用户已经要求其停止后仍继续行动,从而逐渐偏离用户原本的意图。

随着 AI 系统承担越来越长、越来越复杂的任务,更广泛的上下文对于区分正常活动与滥用行为变得越来越重要,也有助于确保 AI Agent 始终处于其预定权限范围之内。

近期,一些前沿模型的部署要求客户允许 AI 服务提供商保留敏感内容,以进行安全监控。对于许多组织而言,这类要求与其自身的安全义务,或对所服务人群作出的承诺相冲突。

“私密安全处理”旨在让我们能够继续提供 ZDR。

“私密安全处理”如何运作

“私密安全处理”建立在 ZDR 以及其他部署模式中已经使用的自动化防护机制之上。

现有兼容 ZDR 的安全系统会分别评估每一次交互。“私密安全处理”则将这些防护扩展到相关联的多次交互,使自动化系统能够识别其中的模式,同时不让 OpenAI 员工访问被保留的客户内容。

无论客户内容存储在哪里——无论是在客户控制的基础设施中(ZDR 部署),还是存储在 OpenAI 提供的基础设施中——“私密安全处理”都会利用这些客户内容。

如果使用 OpenAI 提供的存储空间,客户内容将使用由客户控制的密钥进行加密。OpenAI 员工不会持有这些密钥的副本,因此无法访问底层内容。

当系统识别出风险时,OpenAI 会收到一个范围严格限定的信号,用于说明涉及的活动类型,这与我们目前已有的安全系统类似。该信号可以用于判断是否需要采取执行措施。即使内容被标记为存在风险,OpenAI 员工也不会获得对客户内容的访问权限。

客户可以利用自己系统中可获得的信息,对安全警报和执行决定进行调查。如果客户希望提出申诉、说明某项活动属于合法行为,或协助调查已经确认的滥用行为,可以选择向 OpenAI 分享相关信息。

“私密安全处理”目前正在与早期客户进行测试。

我们现在公布这一预览版本,是因为客户已经非常明确地告诉我们:随着 AI 系统能力不断增强,他们需要对自己的内容将如何受到保护有更明确、可预期的了解。

内容访问控制示意图:API 请求进入“私密安全处理”,客户内容存储在由客户控制、经过加密的存储空间中,并接受自动化安全审查。客户可以获得完整的安全警报,并可以选择向 OpenAI 分享内容;除此之外,OpenAI 只能看到警报类别和严重程度,而无法看到客户内容。

与客户共同构建、为客户而构建的隐私与安全

我们的使命是确保通用人工智能(AGI)造福全人类。与客户和合作伙伴协作,是我们构建有效安全防护机制的核心方式。

正如我们的原则所明确指出的,没有任何一家 AI 实验室能够独自应对不断出现的新风险。“私密安全处理”正体现了这一理念,并正在由来自不同行业、地区以及不同规模企业的客户共同塑造。

我们合作的组织掌握着各自行业中一些最敏感的信息,包括财务记录、健康数据、机密商业计划以及专有研究成果。保护这些信息,对于履行监管义务、维护客户信任以及保持竞争优势至关重要。

客户的反馈正在帮助我们构建更强大的安全防护,同时让他们的信息始终处于自己的控制之下。

“企业采用 AI 完全取决于客户对数据的控制,除了客户选择的服务之外,不进行任何直接或衍生的数据使用。OpenAI 的不训练承诺和 ZDR 让 Glean 有信心使用 OpenAI 构建产品。随着模型能力不断增强,OpenAI 证明了安全能力可以不断提升,同时不会牺牲支撑企业信任的隐私与控制权。”

——Sunil Agrawal,Glean 首席信息安全官

我们将继续与客户合作,完善这一方案的技术和运营细节。我们计划从 9 月开始逐步推出“私密安全处理”,并同步发布一份技术白皮书。

我们会在每一步及时向客户通报进展,尽早分享更新,解释这些变化对现有承诺意味着什么,并给予客户充足的时间和支持进行提前规划。

  • 发表于:
  • 原文链接https://page.om.qq.com/page/OBFyM9nNmxxrSYzmMnarxZ9w0
  • 腾讯「腾讯云开发者社区」是腾讯内容开放平台帐号(企鹅号)传播渠道之一,根据《腾讯内容开放平台服务协议》转载发布内容。
  • 如有侵权,请联系 cloudcommunity@tencent.com 删除。
领券