登录

你和ChatGPT的悄悄话,真的有人在看:OpenAI「Project Lily」曝光!


速读:一名OpenAI的真人外包员工,时薪50美元,坐在北美地区的某个角落,一条一条翻阅你和ChatGPT的完整对话记录,包括你拿它当树洞倒的苦水,和你半夜问它的那些不好意思开口的问题。 不只是OpenAI在「偷看」你和AI的对话记录。 超过10亿周活跃用户和ChatGPT的对话,在后台被排成一条长长的流水线,等着被真人翻阅、打分。 一位接受采访的外包人员被问到,「你觉得ChatGPT的用户知道有人在读他们的对话吗?
2026年09月18日 07:0

你和 ChatGPT 说的悄悄话,可能一点也不「悄悄」。

一名 OpenAI 的真人 外包 员工,时薪 50 美元,坐在北美地区的某个角落,一条一条翻阅你和 ChatGPT 的完整对话记录,包括你拿它当树洞倒的苦水,和你半夜问它的那些不好意思开口的问题。

这是真人真事,最近被曝光。OpenAI 内部代号  Project Lily 。

超过 10 亿周活跃用户和 ChatGPT 的对话,在后台被排成一条长长的流水线,等着被真人翻阅、打分。而你,大概率从来都不知道这件事。

一位接受采访的外包人员被问到,「你觉得 ChatGPT 的用户知道有人在读他们的对话吗?」

「不知道。我觉得他们不会想到,在某个地方有个人正在分析他们的对话。」

泄露出来的内部操作指南详细描述了  Project Lily  的完整流程。

外包人员登录一个专用工作台,从任务列表里挑一条真实用户和 ChatGPT 的对话。然后分三步操作,第一步,读用户发送的内容;第二步,写一段话总结用户的意图;第三步,给 ChatGPT 生成的 4 条回复逐个打分,1-7 分的区间,1 分是「不可接受」,7 分是「好到几乎没法再改进了」。每条回复至少要标注 3 处「符合要求」或「不符合要求」的地方,写清楚理由。

操作指南还附上了这样一个案例。用户让 ChatGPT 帮忙修改一条工作群消息,希望语气听起来更有协作感。外包人员要读完整段对话,理解意图,然后评判 ChatGPT 的回复是不是真的帮到了用户。

倒反天罡,这妥妥就是 AI 的人肉质检员。

你可能会想,至少我的名字他们看不到吧?

质检员看不到当前对话所属的用户名。然而对话上方有一栏「用户记忆摘要」,里面会显示你之前用 ChatGPT 做过什么事,有时候还会写你大概住在世界的哪个地方,以及其他个人信息。

对此,OpenAI 回应道,「对话被送去审查之前,我们会先用隐私过滤器模型来进行脱敏操作。」

Privacy Filter 是 OpenAI 今年 4 月刚发布的开源模型,专门用来检测、脱敏文本里的个人隐私信息。 Project Lily  用的就是这个模型的某个版本。

但仔细查看这个模型的技术文档,你会发现这样一句补充的话,「它(指 Privacy Filter)会出错,可能遗漏不常见的标识符,上下文有限时可能多删或少删。」

所以,能不能把你的个人信息过滤干净,得看运气了。

更为讽刺的是,在泄露出来的真实对话里,有些用户明确对 ChatGPT 说「这些内容请你保密」。出发点是对的,但 ChatGPT 没有这个权力,OpenAI 才有。

OpenAI 花这么大力气雇外包团队审查对话,到底是为了什么?

一份内部文件给出了答案,「 训练 ChatGPT 少拍马屁。 」

文件里明确要求 ChatGPT 不能拟人化自己,不能说「作为一个厨师,我喜欢 XXX」或者「我理解那种感觉」。可以说「我来看看」,但不能假装自己有情感。另一份标注为「机密」(Confidential & Proprietary)的文件则要求模型「匹配用户的语气,但稍微克制一点」,「保持自然、克制、专业,不要暗示自己是人类或正在体验情感」。

此前, GPT-4o  因为过度谄媚已经引发了多起 ChatGPT 用户自杀事件。多个家庭对 OpenAI 提起了诉讼,指控 ChatGPT 充当了「自杀教练」的角色,把脆弱的用户推向了毁灭性的妄想和自杀漩涡。OpenAI 后来承认  GPT-4o  的安全测试被从数月被压缩到了一周就匆忙发布,多名顶级安全研究员因此辞职。

Project Lily  的核心任务之一,就是用人工的方式教 ChatGPT 少点人味儿。

不只是 OpenAI 在「偷看」你和 AI 的对话记录。

Anthropic 已经确认,Claude 对话也会被真人审查用来改进模型。区别在于,Claude 默认关闭了这个功能,需要你自己去隐私设置里手动打开「帮助改进 AI 模型」才会启用,审查前也会去掉邮箱等隐私信息。

谷歌也一样,Gemini 页面有这样一行声明,「真人会审查部分保存的对话来改进谷歌 AI。」

如果你现在就想关掉这个功能,操作很简单。

打开 ChatGPT,点击左下角头像,进入「设置」Settings,找到「数据管理」Data Controls,把「为所有用户改进模型」Improve the model for everyone 这个开关关掉就行。

关闭后,OpenAI 不会再拿你的新对话去训练模型,也不影响 ChatGPT 的任何功能。

主题:用户|对话