DIGIPUNK
发表于:2 hours ago

OpenAI 推出 Private Safety Processing,在零数据保留前提下实现跨交互安全监控

数智朋克
发布者:数智朋克
阅读:1 分钟
我要投稿
AI 摘要
约 1 分钟

快速了解本文

01

OpenAI 推出 Private Safety Processing,在零数据保留前提下实现跨交互安全监控。

02

该方案通过客户自持密钥与有限信号机制,确保 OpenAI 人员无法访问底层内容。

03

服务目前正与早期客户测试,计划于 9 月正式发布技术白皮书并全面开放。

本摘要由 AI 辅助整理,请以正文内容为准。

OpenAI 宣布推出 Private Safety Processing,在零数据保留(ZDR)前提下实现对前沿模型的跨交互安全监控。该方案允许企业客户在不向 OpenAI 暴露底层提示或响应内容的情况下,接受针对长周期、复杂任务中潜在滥用行为的自动化安全处理,目前正与早期客户进行测试,计划于 9 月正式发布技术白皮书。

01ZDR 的基本承诺与现有安全系统的局限

对于符合条件的 API 客户,OpenAI 提供零数据保留承诺:请求处理完成后不保留提示或模型响应,企业客户数据不会用于模型训练,除非客户明确选择加入。在 ZDR 部署下,客户内容不向 OpenAI 人员开放审核。

然而,现有兼容 ZDR 的安全系统仅能逐条评估交互。对于长周期、复杂任务与多轮交互中可能显现的严重风险——例如反复探测防护、跨账户协调或将威胁伪装为常规研究——单条交互评估存在盲区。Private Safety Processing 的核心升级,正是在不向 OpenAI 人员暴露底层内容的情况下,识别跨相关交互的模式。

02核心机制:客户自持密钥与有限信号

在 ZDR 部署中,客户内容保留在客户控制的基础设施上。OpenAI 同时在开发一种选项:内容存储于 OpenAI 基础设施,但由客户控制的密钥加密。两种部署路径均支持 Private Safety Processing 使用客户内容进行自动化安全处理,且 OpenAI 人员不持有加密密钥副本,无法访问底层内容。

自动化系统识别潜在滥用后,仅向 OpenAI 返回指明活动类型的狭义安全信号,用于判断是否需要执法。即使在标记情况下,OpenAI 人员也无法访问客户内容。这一机制类似于现有安全系统,但进一步限制了对底层内容的访问,在隐私约束下保留了安全执法能力。

03客户在安全执法中的主动权

当识别到风险时,客户可使用自身系统中的信息调查告警与执法决定。如需申诉、澄清合法活动或支持已核实滥用调查,客户可选择与 OpenAI 共享相关信息。调查与申诉流程由客户主导,OpenAI 不主动获取原始内容。

04ZDR 的法定边界

与所有前沿模型提供商一样,OpenAI 依法须上报明显的儿童性虐待材料(CSAM)。即使在 ZDR 部署下,被标记为潜在 CSAM 的图像仍会被保留用于人工审核与上报。这构成 ZDR 的法定例外情形。

05当前可用性与时间表

Private Safety Processing 目前正与早期客户进行测试,尚未全面开放。OpenAI 计划于 9 月开始推出该服务并发布技术白皮书,届时将提供具体技术细节与操作指南。

Glean CISO Sunil Agrawal 表示,企业 AI 采用取决于客户对数据的控制,OpenAI 的不训练承诺与 ZDR 让 Glean 有信心与 OpenAI 共建。对于处理金融记录、健康数据、商业计划与专有研究等敏感信息的企业客户,Private Safety Processing 提供了在严格合规义务下继续使用前沿模型 API 的路径,但需评估自身基础设施或加密存储的部署成本。

本文链接: https://www.shuzhipunk.com/articles/WaatXKDA6Jg
转载请注明文章出处

文章所属标签
OpenAI
零数据保留
Private Safety Processing
跨交互安全监控
企业合规