你的ChatGPT对话可能被真人看过:OpenAI人工审核机制曝光
据国际科技媒体404Media最新调查披露,OpenAI雇佣了数百名合同工审核真实ChatGPT用户的对话内容,核心目标是改进模型回复质量。泄露的内部文件及知情人士消息显示,这些审核人员需要对ChatGPT生成的回复按照1至7分的标准进行评分,重点优化减少模型过度奉承、过度拟人化等问题。据披露,相关合同工由Crossing Hurdles负责招募,薪酬由AI培训公司Mercor支付,北美地区的审核员时薪可超过50美元。
404Media调查揭露OpenAI大规模人工审核用户聊天记录
这一消息曝光后引发广泛关注,不少用户表示完全不知情自己的聊天记录会被真人查阅。尽管OpenAI会对审核用的对话做匿名化处理,但处理后的内容仍可能残留敏感个人信息,OpenAI自身部署的隐私过滤器也存在误判可能。值得注意的是,OpenAI并非首次提及人工审核机制,其FAQ至少自2023年起就说明,授权人员及服务提供商可能查看用户数据以提升模型性能,还建议用户不要输入敏感信息,但404Media认为这一披露方式非常隐晦,普通用户很难直观理解人工审核的实际覆盖范围。此前2023年OpenAI曾出现过用户对话串到其他账号的重大bug,当时CEO奥尔特曼回应称是数据库错误导致,也进一步加剧了用户对数据安全的担忧。
隐晦披露引争议:用户对聊天记录被人工审核知情度极低
目前OpenAI默认开启“为所有人改进模型”设置,用户需手动关闭该选项,才能阻止新创建的聊天记录用于模型训练及相关人工审核,临时聊天模式下的输入数据也不会被用于训练模型。但多数用户并不会注意到这一默认设置,也从未被明确告知自己的对话可能被真人审核,知情权缺失的问题引发大量讨论。
人工审核成大模型优化标配:效率与隐私的天平如何倾斜
目前人工反馈已经成为大模型优化的重要环节,不止OpenAI采用类似机制:Anthropic确认会对开启相关隐私设置的Claude对话进行匿名化处理后的人工审核,谷歌也允许人工审核员检查部分Gemini聊天记录。此次事件再次将AI模型训练效率和用户数据隐私之间的平衡问题推到公众视野中。
用户可主动关闭审核权限:多重防护降低隐私泄露风险
OpenAI也设置了相应的安全防护机制:如果人工审核员认定对话内容存在严重安全风险(如用户有自杀倾向),只会向用户预设的可信联系人发送模糊通知,不会共享任何具体聊天内容,且OpenAI正在研发端到端加密等隐私保护功能,未来希望实现用户私人对话的绝对私密。此外建议用户不要向ChatGPT上传以下敏感内容,进一步降低数据泄露风险:
- 个人身份信息:包括身份证号、护照号、出生日期、地址、电话号码等,存在身份盗用风险
- 医疗健康报告:包括体检结果、病历等受法规保护的内容,在多数地区不受ChatGPT隐私政策保障
- 金融账户与投资信息:包括银行卡号、交易密码、投资持仓等
- 工作机密与未公开的商业信息
- 其他可能对个人造成重大影响的私人敏感内容
同时建议用户开启账号双重验证,定期删除不必要的聊天记录,避免账号被盗导致数据泄露。
行业监管与用户权益博弈持续 隐私保护成AI发展核心议题
此次事件也再次引发行业对AI监管的讨论。OpenAI CEO奥尔特曼此前曾表态支持人工智能“控速”发展,避免尖端模型能力超出人类可控范围,承认转向安全会付出一定代价,但有助于维持外界信心,证明企业在研发强大AI时能够恪守责任。而此前《纽约时报》要求OpenAI交出逾2000万段用户私人对话的事件,也让公众更加关注科技公司的数据使用边界,未来如何在技术迭代和用户隐私之间找到平衡,是整个AI行业需要共同面对的课题。