数百名合同工查看真实 ChatGPT 对话
The Decoder··作者 Matthias Bastian
关键信息
OpenAI 的隐私过滤器旨在删除可识别信息,但可能出现错误;用于停止模型改进的设置默认开启,并且只适用于新对话。OpenAI 表示,获授权人员和服务提供商可能查看用户数据,而临时聊天据称不会将输入用于模型训练。
资讯摘要
根据 404 Media 对泄露的内部文件和相关人士的采访,OpenAI 雇用了数百名合同工来阅读真实的 ChatGPT 对话。这些审查员以一到七分评价 ChatGPT 的回复,并负责发现过度奉承和过于拟人化等问题。一名审查员表示,他认为用户并不知道人类可能会阅读他们的聊天记录;被审查的提示中,还有用户明确要求 ChatGPT 对内容保密。OpenAI 会对提示进行匿名化处理并使用隐私过滤器,但公司承认过滤器可能出错,匿名后的对话仍可能包含敏感个人信息。
据报道,这些合同工由 Crossing Hurdles 招募,并通过 AI 训练公司 Mercor 获得报酬;一名北美审查员称其时薪超过 50 美元。用户可以关闭默认开启的“为所有人改进模型”设置,以阻止新的对话被用于模型训练并可能被人类审查;临时聊天则据称不会将输入用于训练。OpenAI 的常见问题页面至少从 2023 年起就说明获授权人员和服务提供商可能查看用户数据,但 404 Media 认为这项披露位置隐蔽,也没有清楚说明人工审查的规模。报道还指出,人工审查在行业内较为普遍,Anthropic 和 Google 也会在相应隐私设置或提示下使用人工审查员。

资讯正文
OpenAI 有数百名合同工在阅读你的 ChatGPT 对话
据 404 Media 的一项调查,OpenAI 聘用了数百名合同工,阅读真实的 ChatGPT 用户对话,以改进聊天机器人的回答。
该媒体获得了泄露的内部文件,并采访了其他消息人士。审阅人员会按照 1 到 7 分的等级为 ChatGPT 的回答评分,他们的任务是减少模型输出中过度奉承以及类似人类的行为。
一名审阅人员告诉 404 Media,他认为用户并不知道有人类正在阅读他们的聊天记录。经过审阅的提示词也印证了这一点:一些对话中,用户明确要求 ChatGPT 对内容保密。这些提示词经过了匿名化处理,但仍可能包含敏感的个人数据。OpenAI 使用隐私过滤器,不过该公司承认过滤器可能会出错。
据 404 Media 报道,这些合同工由 Crossing Hurdles(“将技术娴熟的专业人士与未来的 AI 工作连接起来”)招募,并通过 AI 培训公司 Mercor 获得报酬。一名常驻北美的审阅人员表示,他们的时薪超过 50 美元。
用户可以关闭默认启用的“为所有人改进模型”(Improve the model for everyone)设置,从而阻止自己的聊天被用于模型训练,也避免聊天内容可能被人类阅读。该设置只适用于新的对话。OpenAI 还提供临时聊天模式;据该公司称,这种模式不会使用用户输入的数据进行模型训练。
OpenAI 只在一个隐蔽的常见问题页面中提到人工审阅
当 404 Media 询问 OpenAI 在哪里明确告知用户存在人工审阅时,OpenAI 最初没有回应。在一个常见问题页面上,该公司确实解释说,获得授权的人员和服务提供商可能会查看用户数据,以改进模型性能,并建议用户不要输入敏感信息。至少从 2023 年起,这项通知就一直在线,而且多年来只发生过轻微改动。
404 Media 认为,这项披露隐藏得过深、表述也过于含糊,无法让用户了解实际进行的人工作业审阅规模。而“为所有人改进模型”听起来更像是一次友好的社区贡献,而不是同意让人类阅读你的对话。不过,这种模糊的表述很可能经过了周密考虑。如果 OpenAI 要求用户明确同意,选择退出的比例可能会很高。
然而,对于 AI 实验室而言,这类人类反馈是改进模型的关键环节。这种做法也十分普遍。Anthropic 向 404 Media 证实,该公司会使用人工审阅人员检查 Claude 的回答,并改进未来的模型。对于在隐私设置中开启“帮助改进我们的 AI 模型”(Help improve our AI models)的用户,这一做法同样适用。Anthropic 还会在人工审阅前将对话匿名化,移除电子邮件地址等账户信息。Google 也使用人工审阅人员,并在 Gemini 中注明,人类可能会审阅保存的聊天记录。
来源与参考
收录于 2026-09-15