OpenAI推出了一项新的安全机制,试图在企业数据隐私与滥用防范之间寻找平衡。
据科技媒体TechCrunch当地时间8月19日报道,OpenAI已向部分客户预发布“Private Safety Processing”,测试在不留存客户数据的情况下识别潜在滥用行为的方案。
这项功能的核心,在于能够关联多个会话以识别风险模式。此前在“零数据保留”(Zero Data Retention,ZDR)政策下,OpenAI的API安全监测仅针对单次会话进行,虽然同样不留存客户数据,但识别范围也仅限于单个会话内的异常行为。
OpenAI表示,Private Safety Processing是在ZDR基础上的进一步扩展,将安全监测从单次会话延伸至跨会话场景。公司将其描述为一种更长时间跨度的安全监测机制,可综合分析多个会话中的输入和输出,以发现滥用迹象。OpenAI同时强调,当系统识别出特定模式后,会对跨会话交互进行分析,但不会对用户对话进行人工直接查看。
按照OpenAI的说法,这类机制更有助于识别分散在多个会话中的恶意使用行为。比如,攻击者在生成用于网络攻击的恶意代码时,可能会把请求拆分到多个会话中以规避检测,而Private Safety Processing则可对这些会话进行关联分析,从而识别滥用信号。
系统运行后,OpenAI实际接收到的仅是用于提示特定活动类型的、经过严格限定的风险信号,并据此判断是否需要采取处置措施。若OpenAI认定有必要进一步处理,将向客户请求更多上下文信息,或与客户共同处置,客户可自行决定是否共享相关数据。
此次发布也与Anthropic近期的数据留存政策形成对比。Anthropic在7月公布的新政策中,允许对适用模型保留用户会话及对话内容30天。适用范围包括所有“mythos”级模型,以及未来具备类似能力的模型。Anthropic称,此举出于安全考虑,旨在排查潜在不当行为,但也在部分大量处理敏感数据的企业客户中引发担忧。
Anthropic总体上仍采取零数据保留原则,但上述适用模型属于例外。Anthropic也承认,可能会对客户数据进行人工审阅,不过强调相关操作仅会通过受控访问路径,由少数经批准的审阅人员执行。公司表示,每次审阅都会记录在防篡改日志中,审阅人员无法任意抑制或修改相关记录。
从此次产品设计来看,OpenAI正试图在安全能力与企业隐私需求之间取得平衡。随着AI模型能力持续提升,滥用风险也在上升。对企业客户而言,更强的安全防护与更高的数据控制权正同时成为关键诉求。在这一背景下,OpenAI主打“无需人工直接查看对话,也能识别跨会话风险模式”,以回应企业市场需求。
与此同时,两家公司在企业市场的竞争加剧,也被视为此次发布的背景之一。近期公开报告显示,OpenAI今年第二季度增速慢于Anthropic。报道称,Anthropic年化营收约为650亿美元(约90.35万亿韩元),投资者也在讨论其估值达2万亿美元(约2800万亿韩元)的IPO可能性。OpenAI同样在筹备IPO,围绕企业客户安全与隐私政策的竞争或将进一步升温。