OpenAI内部Lily项目被曝:人工审核员查阅用户私密聊天记录?

# OpenAI内部“Lily”项目曝光:人工审核员可查阅用户私密聊天记录?

近日,据多家科技媒体披露,OpenAI内部名为“Lily”的数据标注与审查项目引发广泛争议。该项目旨在通过人工审核员对ChatGPT等产品的对话内容进行质量评估与安全筛选,但问题在于:审核员被曝能够直接访问用户与AI之间的完整聊天记录,包括涉及个人隐私、敏感话题或商业机密的对话。这一发现让公众对AI服务中的隐私保护机制产生严重质疑。

## 事件核心:数据访问权限与隐私边界

根据内部员工及离职人员的描述,“Lily”项目中的审核员需要定期抽样检查用户对话,以纠正模型输出中的错误、偏见或不当内容。然而,这些审核员通常只能看到经过脱敏处理的片段吗?现实并非如此。消息称,部分审核员拥有完整查看未脱敏对话的权限,甚至能看到用户上传的文件、名称、位置信息等。尽管OpenAI在用户协议中明确表示“可能审查对话内容以改进模型”,但多数用户并未预期到“人工直接阅读”这一层操作。

## 行业视角:数据标注的“灰色地带”

从AI行业惯例来看,大模型训练与优化高度依赖人工标注数据。无论是OpenAI、Google还是Anthropic,都需雇佣大量标注员对模型输出进行打分、修正或标记有害内容。问题在于,当这些标注员接触到原始用户数据时,企业与用户之间的“知情同意”往往流于表面。OpenAI的隐私政策虽提及“第三方服务商可处理数据”,但并未明确告知用户其对话可能被陌生人工审核员逐行查看,更未提供一键阻止此类访问的选项。

## 潜在风险与OpenAI的应对

这种模式带来多重风险:一是用户私密信息(如医疗、财务、情感倾诉)可能被泄露或滥用;二是审核员的心理负担——长期接触极端或暴力内容已成为标注行业的已知问题;三是法律合规压力,GDPR与CCPA等隐私法规要求企业对“个人数据处理”保持透明,但“人工查阅”可能落入监管盲区。

OpenAI方面回应称:“Lily项目遵循严格的数据访问控制与匿名化流程,审核员仅能查看随机抽样且经过技术脱敏的对话片段。”但匿名员工指出,实际执行中存在脱敏不彻底、权限管控松懈的情况。目前,暂无第三方审计报告证实其宣称的保护措施。

## 启示:用户需重新审视AI对话的“私密性”

此事再次警示:在享受AI便利时,用户应默认所有与模型的交互都可能被保留、分析甚至人工触及。建议用户避免输入高度敏感信息,同时关注服务商的隐私设置(如OpenAI已提供“不用于训练”选项)。对于行业而言,建立独立的隐私审计机制、引入联邦学习等技术减少数据暴露,才是长远解决之道。

相关文章