据报道,OpenAI正在通过一项内部项目,以人工方式审阅并评估真实用户与ChatGPT的对话内容,用于改进回答质量。尽管公司会先通过自动化工具过滤个人信息,但外界担忧,部分敏感内容未必能够被完全剔除。
据404 Media当地时间15日报道,OpenAI内部正在推进一项名为“Project Lily”的评估项目。该媒体获得的内部文件显示,数百名合同人员会阅读真实的ChatGPT对话,先判断用户意图,再评估模型回复的质量及存在的问题。
根据报道,审阅人员无法看到用户账号名称,但在部分场景下可以查看完整对话内容。某些任务还会附带“用户记忆摘要”,即对ChatGPT已记录的历史使用背景进行整理后的内容。报道指出,这类信息可能涉及用户的使用目的、兴趣偏好以及大致所在地区,并可能据此识别个人身份。
OpenAI表示,在人工审阅前,系统会通过隐私过滤器(Privacy Filter)识别并屏蔽姓名、住址、电子邮箱、电话号码、账号等个人识别信息。公司也在公开说明文件中承认,罕见姓名、带有地域特征的称谓,以及需要结合上下文判断的个人信息,仍有可能出现漏检。
对于ChatGPT个人用户而言,可在“设置-数据控制”中关闭“为所有人改进模型”,以避免之后的新对话被用于模型训练。相比之下,ChatGPT Business、Enterprise和Edu版本默认不会将用户输入和输出用于模型训练。
此外,“临时聊天”内容同样不会用于改进模型。不过,出于安全和防止滥用的考虑,这类内容最长仍可保留30天,并在必要情况下接受有限范围的人工审查。OpenAI也提醒用户,不要输入不希望被人工查看的敏感信息。
在人工评估仍被广泛用于提升AI服务质量的背景下,真实用户的私密对话究竟会在多大程度上进入模型训练和评估流程,再次引发外界对相关透明度的质疑。