跳转到主要内容

OpenAI秘密的“Lily”项目:人类在阅读你的ChatGPT聊天记录吗?

OpenAI秘密的“Lily”项目:人类在阅读你的ChatGPT聊天记录吗?

当你向ChatGPT倾诉心声时,你可能以为只有你和算法在对话。但最近的一份泄露文件表明并非如此。根据404Media获得的内部文件,OpenAI一直在悄悄运行Lily项目——一个由人工审核员筛选真实用户对话以微调模型的计划。

Lily项目究竟是什么?

其核心是,Lily项目雇佣了提示审核员,他们检查匿名化的聊天样本。他们的工作是什么?判断ChatGPT的回复是否相关,并标记任何听起来太“AI化”的内容——比如居高临下的语气、过多的表情符号或讨好的语言。指导方针甚至禁止拟人化表达:你不会看到机器人说“作为一名厨师,我喜欢……”或“我理解那种感觉。”那种类似人类的同理心是不允许的。

这项工作重复性高,但报酬不错——较简单的任务每小时超过50美元,这解释了申请者源源不断的原因。

房间里的大象:隐私问题

这里事情变得令人不安。许多用户将ChatGPT视为数字知己,分享他们不会告诉任何人的秘密。OpenAI声称数据已匿名化,用户名已被删除,但该公司承认过滤并不完美——尤其是在简短对话中,上下文很容易识别出某人。更糟糕的是,审核员经常收到一份“用户记忆摘要”,其中包括用户的问题、兴趣,甚至位置详情。

删除聊天记录?这并不一定能抹掉它。如果你保留了默认的“允许使用你的对话记录来改进产品”设置,你过去的聊天可能已经被收集和存储。即使你点击删除,数据也可能在匿名化数据集中继续存在。企业和教育用户默认关闭此功能,但对于普通用户,开关是打开的——而关闭它并不会追溯删除任何内容。

OpenAI的沉默回应

当记者追问时,OpenAI最初回避了用户是否被明确告知人工审核的问题。他们指向一个FAQ页面,其中模糊地提到“用于模型优化的人工审核”。在404Media的报道发布后,OpenAI悄悄更新了其帮助页面,添加了退出方法——但仍然没有明确说明员工会阅读对话内容。

行业常态

OpenAI并非孤例。谷歌的Gemini隐私中心承认某些聊天可能会被人工审核。Anthropic有一个专门页面解释这种做法。然而,Perplexity保持沉默——其政策既不确认也不否认人工访问。结论是什么?即使在极端自动化的时代,人工参与仍然是AI改进的支柱。

所以下次你与ChatGPT聊天时,记住:可能不只是你和机器。这是一个值得讨论的话题。

关键点

  • Lily项目使用人工审核员阅读匿名化的ChatGPT聊天记录,并标记“AI化”的语气。
  • 审核员每小时赚取50美元以上,但隐私风险隐现——过滤可能遗漏个人数据。
  • 用户的聊天历史即使在删除后也可能被保留;退出并不会抹掉过去的数据。
  • OpenAI在泄露后更新了帮助页面,但避免明确说明人类会阅读聊天记录。
  • 谷歌和Anthropic等竞争对手也使用人工审核,凸显了全行业的做法。