OpenAI新增AI安全层,在不保留企业数据的前提下检测滥用
作者: CBINEWS
责任编辑: 邹大斌
来源: 电脑商情在线
时间: 2026-08-24 10:54
OpenAI正在添加一项新的安全能力,使企业能够跨多次交互检测其AI系统的滥用行为,而无需保留提示词或响应,从而在保持零数据保留(ZDR)承诺的同时实现风险监控。
"OpenAI在请求处理完成后不保留提示词或模型响应,"该公司在一篇博客文章中描述其ZDR方式时表示。新系统名为"Private Safety Processing"(隐私安全处理),"旨在识别跨相关交互的活动模式,而无需让OpenAI人员访问底层内容。"
该功能正在符合条件的企业和API客户中测试,旨在解决现有安全控制的局限性——现有控制逐次评估交互,难以检测随时间展开的风险。
隐私安全处理功能做什么
据OpenAI介绍,隐私安全处理旨在通过关联跨相关交互的活动而非孤立分析每条提示词,来扩展现有安全系统。在该模式下,自动化系统分析交互并生成"一个定义狭窄的信号,指示所涉及的活动类型",而非暴露底层提示词或响应。
该公司表示,无论客户数据保留在企业控制的基础设施内,还是由OpenAI存储且加密密钥由客户控制,该系统均可运行。"在两种情况下,自动化系统都能识别潜在的滥用并返回有限的安全信号,而无需将底层提示词或响应暴露给OpenAI人员,"文章补充道。
现有安全控制为何不足
OpenAI表示,新功能旨在弥补AI风险检测中的空白。"最严重的AI安全风险并不总是能在单次交互中观察到,"该公司表示,并指出有害意图可能只有在多次交互被放在一起查看时才变得清晰。这类风险包括反复试探安全护栏、跨账户协调活动,以及在使用序列中逐渐显现的滥用行为。随着AI系统承担更长、更复杂的任务,孤立地评估单个提示词可能限制识别此类模式的能力。
AI安全方法的分歧
隐私安全处理的推出凸显了AI供应商之间在安全策略上的差异。OpenAI表示,该系统旨在跨交互检测滥用模式,同时保持零数据保留。相比之下,部分供应商会保留一段时间的客户交互数据以支持安全监控,反映了另一种识别跨请求风险的方法。
Greyhound Research首席分析师Sanchit Vir Gogia表示,差异在于如何处理证据,而非是否使用信号。"这是关于除了你保留的信号之外还需要多少原始内容的分歧,而非隐私对监控,"Gogia说。他补充说,两种方法都依赖衍生指标,但调查数据存放的位置不同。"Anthropic希望有足够的内容来调查案件。OpenAI希望客户持有案件,而供应商持有警报,"他说。
基于信号的检测与验证
分析师指出,该系统依赖信号而非直接数据访问,改变了企业验证和调查事件的方式。"架构完全可行。安全领域已基于衍生指标工作了一代人。困难在于验证,而非可行性,"Gogia说。他补充说,跨时间检测行为需要保留某种形式的表示。"一个系统除非在跨时间中记住某些东西,否则无法跨时间检测行为,"他说。
隐私安全处理"是保护隐私的滥用检测。它不是企业取证记录,OpenAI也没有声称如此,"他说。
对受监管行业的影响
Gartner高级首席分析师Apeksha Kaushik表示,该方法可能影响数据要求严格的行业的AI采用。"保护隐私的安全模型,如采用零数据保留(ZDR)的模型,代表了一种新兴方法,可能降低金融服务和医疗保健等受监管行业采用AI的门槛,"她说。这类模型"可能帮助组织满足某些隐私要求,并可能与GDPR和HIPAA等框架对齐,具体取决于实施细节和监管指导,"她指出。
Kaushik补充说,组织应根据自身合规要求评估此类方法,建议咨询其合规和法律团队以确定是否满足特定的监管和运营要求。
OpenAI表示,在此模式下企业保留对自身数据的控制权,可使用自身系统调查警报。客户也可选择与公司分享相关数据以支持调查或申诉。分析师表示,这将责任向企业转移。"零数据保留并未移除取证负担,它只是将其重新定位,"Gogia说。
