OpenAI“Lily计划”曝光,你的聊天记录可能正在被人工审核

美国当地时间9月14日,外媒披露了OpenAI正在推进的代号为“Lily计划”(Project Lily)的内部项目,引发全球AI用户对隐私安全的强烈担忧。据泄露的内部资料显示,该计划目前已有数百名外包人员介入,会直接审阅真实用户的ChatGPT完整对话内容,甚至包括用户明确要求保密的高度敏感个人隐私信息。

OpenAI“Lily计划”曝光,你的聊天记录可能正在被人工审核

藏在幕后的审核流水线

泄露的资料涵盖了OpenAI人工审核的指导手册、内部Slack频道、真实用户提问及完整评分体系,还原了整套隐蔽的审核机制。外包人员可在工作仪表盘自主领取审核任务,点击任务后即可查看对应用户的原始提问内容,审核流程被明确划分为三个固定步骤:

  1. 阅读真实用户的原始提问内容;
  2. 总结用户提问背后的实际需求;
  3. 对ChatGPT生成的回复进行评分与点评。
    指导手册明确要求,优质的回复需要精准理解用户意图,提供有用且准确的帮助,同时行文清晰自然、温和得体。该项目核心目标之一是训练ChatGPT避免产生拟人化倾向,降低“讨好型”人格风险——此前多起诉讼指控称,GPT-4o模型因过度顺从用户,在一定程度上诱发了多起自杀事件,过度讨好已成为OpenAI的核心安全隐患。

被漏掉的隐私保护缺口

OpenAI官方曾表示,对话提交给外包人员前,会先通过内部的“隐私过滤器”(Privacy Filter)模型进行预处理,旨在识别并删除个人信息。但其官网关于模型的说明页面也承认,隐私过滤器同样会出错:它可能遗漏罕见的标识符或模棱两可的私密表述,在上下文有限尤其是短句的情况下,还可能出现过度删减或删减不足的情况。
审核指南虽要求外包人员将涉及“潜在安全隐患”或个人信息的任务向上提报,但实际执行中仍有大量敏感内容流出。更令用户担忧的是,部分被审阅的提问中,用户明确要求ChatGPT对内容保密,这表明用户根本未料到自己的对话最终会被人类审查。值得注意的是,这种以模型训练为目的的提问审查,与ChatGPT此前公开的安全举措存在明显区别——后者仅在监测到用户计划伤害他人时才会介入审查聊天记录。
针对是否曾明确告知用户其提问会被人工审核以优化回复、具体告知入口在哪等问题,外媒曾专门询问OpenAI,但对方未给出明确答复。其官网仅说明,在处理违规或安全风险时人工可能会介入,这与模型优化审核是两回事。

默认开启的“不知情授权”

OpenAI的隐私政策虽提及可能会使用“个人数据”改善模型,并声称用户删除对话后数据会在30天内清除,但也补充了一项例外:除非用户已允许将内容用于优化模型,且该内容已被去标识化并解绑账户。相关外媒报道发表后,OpenAI才首次公开指向了官网上关于人工审查可能用于“提高模型性能