OpenAI 扩展零数据留存安全机制,自动化分析跨交互风险
IT之家 8 月 20 日消息,OpenAI 今天发布一篇博文,宣布针对符合条件的前沿模型 API 用户,扩展“零数据留存”(Zero Data Retention)服务。自动化系统现在能识别跨交互的风险模式。
IT之家引述博文介绍,OpenAI 强调请求处理完成后不会保留提示词和模型回复,员工无法查看客户内容,企业数据也不会被用来训练模型(除非客户明确同意)。
OpenAI 指出,随着模型承担更长、更复杂的任务,某些严重安全风险可能需要经过多轮交互才能显现。现有兼容 ZDR 的安全系统一般是逐条评估交互,难以识别跨对话、跨账户或者持续试探安全机制的行为模式。
为解决这个问题,OpenAI 推出私密安全处理(Private Safety Processing)预览版。该机制在不让 OpenAI 员工接触底层内容的情况下,通过自动化系统分析关联交互中的风险模式。

这个系统既适合客户在自己管理的基础设施中控制内容,也适用于 OpenAI 提供的存储服务。在 OpenAI 存储场景中,客户内容会用客户控制的密钥加密,OpenAI 员工不持有密钥,因此无法访问底层的提示词和回复。
当系统发现风险时,OpenAI 只会收到范围有限的安全信号,用来说明相关活动类型,并根据情况判断是否需要采取行动。
即使内容被标记,员工依旧无法查看客户内容。客户可以通过自己系统里的信息来调查警报并决定如何处理;如果需要申诉、说明合法用途,或协助核查确认的滥用行为,客户可以选择把相关信息提供给 OpenAI。
OpenAI 表示,私密安全处理目前正与早期客户测试,公司计划于 9 月正式推出,并发布技术白皮书。届时会提前通知客户新功能细节、对现有承诺的影响,以及客户需要的规划时间和支持。
---
原文链接:[点击查看](https://www.ithome.com/0/991/868.htm)
IT之家引述博文介绍,OpenAI 强调请求处理完成后不会保留提示词和模型回复,员工无法查看客户内容,企业数据也不会被用来训练模型(除非客户明确同意)。
OpenAI 指出,随着模型承担更长、更复杂的任务,某些严重安全风险可能需要经过多轮交互才能显现。现有兼容 ZDR 的安全系统一般是逐条评估交互,难以识别跨对话、跨账户或者持续试探安全机制的行为模式。
为解决这个问题,OpenAI 推出私密安全处理(Private Safety Processing)预览版。该机制在不让 OpenAI 员工接触底层内容的情况下,通过自动化系统分析关联交互中的风险模式。

这个系统既适合客户在自己管理的基础设施中控制内容,也适用于 OpenAI 提供的存储服务。在 OpenAI 存储场景中,客户内容会用客户控制的密钥加密,OpenAI 员工不持有密钥,因此无法访问底层的提示词和回复。
当系统发现风险时,OpenAI 只会收到范围有限的安全信号,用来说明相关活动类型,并根据情况判断是否需要采取行动。
即使内容被标记,员工依旧无法查看客户内容。客户可以通过自己系统里的信息来调查警报并决定如何处理;如果需要申诉、说明合法用途,或协助核查确认的滥用行为,客户可以选择把相关信息提供给 OpenAI。
OpenAI 表示,私密安全处理目前正与早期客户测试,公司计划于 9 月正式推出,并发布技术白皮书。届时会提前通知客户新功能细节、对现有承诺的影响,以及客户需要的规划时间和支持。
---
原文链接:[点击查看](https://www.ithome.com/0/991/868.htm)
评论
暂无评论。