​OpenAI内部Lily项目曝光,人工审核员正翻阅用户私密聊天记录?

近日,科技媒体404 Media发布深度报道,披露了OpenAI内部长期运行的“莉莉计划(Project Lily)”,首次揭开了ChatGPT用户聊天记录人工审核的全流程细节,引发外界对AI产品隐私合规性的广泛讨论。

​OpenAI内部Lily项目曝光,人工审核员正翻阅用户私密聊天记录?

莉莉计划审核流程全披露

据已曝光的项目操作指引文档、Slack工作群记录及对话样本显示,莉莉计划是OpenAI专门设置的ChatGPT回复质量评估项目,从事相关工作的人员被称为“提示词审核员”。审核员的核心工作是查看经过匿名化处理的真实用户聊天记录,对ChatGPT的回复进行评分,审核重点包含三个核心维度:一是评估回答是否贴合用户提问主题;二是检查回复是否存在过度“AI化”表达、居高临下的说教语气、多余表情符号或谄媚口吻;三是判定回复是否违反拟人化表述规则、是否存在编造“个人经历”的问题——即ChatGPT可以表述“我查询到了相关信息”,但不得使用“身为一名厨师,我喜欢这类内容”“我完全理解你的感受”这类拟人化、代入个人经历的表达。
多名参与该项目的审核员透露,工作内容机械重复,但时薪超过50美元(约合336元人民币),报酬远高于同类简单劳动。此外项目操作指引频繁更新,不同版本之间常出现规则矛盾,给审核工作带来不少困扰。需注意的是,莉莉计划仅会标记回复中显而易见的 factual 错误,并不核查内容的准确性,其流程也和排查用户自伤、伤人意图的安全审查流程完全独立,这意味着至少还存在其他独立团队开展模型效果评估工作。

用户隐私防护存在明显缺口

虽然OpenAI声称聊天记录会先经过匿名化处理,审核员无法看到对应用户的用户名,但OpenAI已向404 Media承认,匿名过滤环节存在漏过个人数据的可能,短篇幅会话出现数据泄露的概率更高。更值得关注的是,交给审核员的会话版本会附带一份“用户记忆摘要”,其中汇总了用户的历史提问、兴趣偏好、上下文信息,甚至可能包含用户的位置信息。
不少用户将ChatGPT当作临时倾诉、心理疏导的对象,向其吐露个人隐私、情绪秘密,甚至有用户在对话中明确要求ChatGPT对谈话内容保密。但绝大多数用户并不知晓自己的聊天内容会被第三方人工阅览,隐私暴露风险极高。

知情权披露长期缺位遭质疑

目前几乎所有面向普通用户的聊天产品都默认开启“允许使用你的对话记录改进产品”的开关,ChatGPT的普通用户版本同样默认开启该设置,仅企业版、商业版、教育版默认关闭。但该开关不具备回溯效力,已经存入ChatGPT数据库的历史聊天记录会继续留存,除非用户主动申请删除;即便用户执行删除操作,对应内容也可能早已被抓取、完成匿名处理并留存于数据集当中。有用户在社交平台提醒,关闭该改进设置、使用临时聊天模式可在一定程度上降低聊天记录被审阅的风险,但无法完全规避已留存数据的使用问题。
针对“用户是否被明确告知聊天记录会交由人工审阅”的问询,OpenAI最初并未回应,后续仅提供了一份至少已存在两年、但未明确提及人工审阅的常见问题页面链接。在这篇曝光报道发布后,OpenAI才修改了帮助页面,补充说明用户可选择退出数据收集,但修改后的文档依旧未提及会有工作人员人工读取会话内容,知情权披露的缺位问题仍未得到根本解决。

人工审核仍是大模型迭代刚需

莉莉计划的曝光也打破了AI公司塑造的“大模型迭代仅靠技术升级与优质数据集”的公众印象,证明当前大模型的优化依然需要大量人类劳动力的参与。审核员对回复语气、表达习惯的标注反馈,是修正AI回复“说教感强”“过度谄媚”“虚假拟人”等问题的核心依据,这也是当前技术路线下无法完全被自动化流程替代的环节。