数百名合同工查看真实 ChatGPT 对话

The Decoder··作者 Matthias Bastian

关键信息

OpenAI 的隐私过滤器旨在删除可识别信息,但可能出现错误;用于停止模型改进的设置默认开启,并且只适用于新对话。OpenAI 表示,获授权人员和服务提供商可能查看用户数据,而临时聊天据称不会将输入用于模型训练。

资讯摘要

根据 404 Media 对泄露的内部文件和相关人士的采访,OpenAI 雇用了数百名合同工来阅读真实的 ChatGPT 对话。这些审查员以一到七分评价 ChatGPT 的回复,并负责发现过度奉承和过于拟人化等问题。一名审查员表示,他认为用户并不知道人类可能会阅读他们的聊天记录;被审查的提示中,还有用户明确要求 ChatGPT 对内容保密。OpenAI 会对提示进行匿名化处理并使用隐私过滤器,但公司承认过滤器可能出错,匿名后的对话仍可能包含敏感个人信息。

据报道,这些合同工由 Crossing Hurdles 招募,并通过 AI 训练公司 Mercor 获得报酬;一名北美审查员称其时薪超过 50 美元。用户可以关闭默认开启的“为所有人改进模型”设置,以阻止新的对话被用于模型训练并可能被人类审查;临时聊天则据称不会将输入用于训练。OpenAI 的常见问题页面至少从 2023 年起就说明获授权人员和服务提供商可能查看用户数据,但 404 Media 认为这项披露位置隐蔽,也没有清楚说明人工审查的规模。报道还指出,人工审查在行业内较为普遍,Anthropic 和 Google 也会在相应隐私设置或提示下使用人工审查员。

数百名合同工查看真实 ChatGPT 对话

资讯正文

OpenAI 有数百名合同工在阅读你的 ChatGPT 对话

据 404 Media 的一项调查,OpenAI 聘用了数百名合同工,阅读真实的 ChatGPT 用户对话,以改进聊天机器人的回答。

该媒体获得了泄露的内部文件,并采访了其他消息人士。审阅人员会按照 1 到 7 分的等级为 ChatGPT 的回答评分,他们的任务是减少模型输出中过度奉承以及类似人类的行为。

一名审阅人员告诉 404 Media,他认为用户并不知道有人类正在阅读他们的聊天记录。经过审阅的提示词也印证了这一点:一些对话中,用户明确要求 ChatGPT 对内容保密。这些提示词经过了匿名化处理,但仍可能包含敏感的个人数据。OpenAI 使用隐私过滤器,不过该公司承认过滤器可能会出错。

据 404 Media 报道,这些合同工由 Crossing Hurdles(“将技术娴熟的专业人士与未来的 AI 工作连接起来”)招募,并通过 AI 培训公司 Mercor 获得报酬。一名常驻北美的审阅人员表示,他们的时薪超过 50 美元。

用户可以关闭默认启用的“为所有人改进模型”(Improve the model for everyone)设置,从而阻止自己的聊天被用于模型训练,也避免聊天内容可能被人类阅读。该设置只适用于新的对话。OpenAI 还提供临时聊天模式;据该公司称,这种模式不会使用用户输入的数据进行模型训练。

OpenAI 只在一个隐蔽的常见问题页面中提到人工审阅

当 404 Media 询问 OpenAI 在哪里明确告知用户存在人工审阅时,OpenAI 最初没有回应。在一个常见问题页面上,该公司确实解释说,获得授权的人员和服务提供商可能会查看用户数据,以改进模型性能,并建议用户不要输入敏感信息。至少从 2023 年起,这项通知就一直在线,而且多年来只发生过轻微改动。

404 Media 认为,这项披露隐藏得过深、表述也过于含糊,无法让用户了解实际进行的人工作业审阅规模。而“为所有人改进模型”听起来更像是一次友好的社区贡献,而不是同意让人类阅读你的对话。不过,这种模糊的表述很可能经过了周密考虑。如果 OpenAI 要求用户明确同意,选择退出的比例可能会很高。

然而,对于 AI 实验室而言,这类人类反馈是改进模型的关键环节。这种做法也十分普遍。Anthropic 向 404 Media 证实,该公司会使用人工审阅人员检查 Claude 的回答,并改进未来的模型。对于在隐私设置中开启“帮助改进我们的 AI 模型”(Help improve our AI models)的用户,这一做法同样适用。Anthropic 还会在人工审阅前将对话匿名化,移除电子邮件地址等账户信息。Google 也使用人工审阅人员,并在 Gemini 中注明,人类可能会审阅保存的聊天记录。

来源与参考

  1. 原始链接
  2. OpenAI has hundreds of contract workers reading your ChatGPT conversations

收录于 2026-09-15