OpenAI 有数百名合同工在阅读你的 ChatGPT 对话
2026-09-15
据 404 Media 的一项调查,OpenAI 雇用了数百名合同工,他们阅读真实的 ChatGPT 用户对话,以改进聊天机器人的回应。该媒体获得了泄露的内部文件,并采访了其他消息源。审核员按一到七分的标准对 ChatGPT 的回应进行评分,其任务是减少模型输出中过度的奉承和拟人化行为。一名审核员告诉 404 Media,他认为用户并不知道有人类在阅读他们的聊天记录。被审核的提示词也支持这一点:一些对话中包含用户明确要求 ChatGPT 对内容保密。这些提示词被匿名化处理,但仍可能包含敏感的个人数据。OpenAI 使用了一个隐私过滤器,但承认它可能会出错。
据 404 Media 报道,这些合同工通过 Crossing Hurdles(“为 AI 工作的未来连接熟练专业人士”)招募,并由 AI 训练公司 Mercor 支付报酬。一名驻北美的审核员表示,他们每小时收入超过 50 美元。用户可以关闭默认开启的“为所有人改进模型”设置,以阻止他们的聊天被用于模型训练并可能被人类阅读。该设置只适用于新的对话。OpenAI 还提供临时聊天模式,据该公司称,该模式不会将输入数据用于模型训练。当 404 Media 询问用户在何处被明确告知存在人工审核时,OpenAI 最初没有回应。在一个 FAQ 页面上,该公司确实解释了授权人员和服务提供商可能查看用户数据以改进模型性能,并建议不要输入敏感信息。该通知至少自 2023 年起就已在线,多年来只略有变化。
404 Media 认为,这一披露过于隐蔽、过于含糊,无法让用户意识到实际发生的人工审核有多少。而“为所有人改进模型”读起来更像是一种友好的社区贡献,而不是同意让人阅读你的对话。但这种含糊的表述很可能是经过深思熟虑的。如果 OpenAI 要求明确同意,退出率可能会很高。不过,对 AI 实验室来说,这类人类反馈是改进其模型的关键部分。这种做法也很普遍。Anthropic 向 404 Media 证实,它使用人工审核员来检查 Claude 的回应并改进未来的模型。这适用于在其隐私设置中开启“帮助改进我们的 AI 模型”的用户。Anthropic 还会在人工审核前对对话进行匿名化处理,删除电子邮件地址等账户细节。谷歌也使用人工审核员,并在 Gemini 中注明人类可能会查看已保存的聊天。
404 Media 调查显示,OpenAI 雇用了数百名合同工阅读真实 ChatGPT 用户对话,用来给模型回答打分(1-7 分),重点是抑制过度奉承和拟人化表达。这些提示词虽经匿名化,仍可能含敏感个人信息。用户可通过关闭默认开启的“为所有人改进模型”来阻止新对话被用于训练,但该设置不追溯历史对话。Anthropic 和谷歌同样使用人工审核。
- 404 Media 调查显示,OpenAI 雇用了数百名合同工阅读真实 ChatGPT 用户对话,用来给模型回答打分(1-7 分),重点是抑制过度奉承和拟人化表达。这些提示词虽经匿名化,仍可能含敏感个人信息。用户可通过关闭默认开启的“为所有人改进模型”来阻止新对话被用于训练,但该设置不追溯历史对话。Anthropic 和谷歌同样使用人工审核。
- 原贴提到:OpenAI employs hundreds of contract workers who read real ChatGPT user c
- 来源:the-decoder.com
这是什么信号
这不是一次安全事故,而是一次“默认设定被摊开”的信号。404 Media 通过泄露的内部文件和采访指出:ChatGPT 的真实用户对话会被数百名合同工逐条阅读、按 1 到 7 分打分,任务目标之一是压掉模型的过度奉承和拟人化表达。这些合同工通过 Crossing Hurdles 招募、由 AI 训练公司 Mercor 发放报酬,一名北美审核员称时薪超过 50 美元。对话经过匿名化,但仍可能残留敏感个人信息;OpenAI 承认其隐私过滤器会出错。更关键的是披露方式:相关说明只出现在 FAQ 里,默认开启的开关叫“为所有人改进模型”——它读起来像社区贡献,而不像“人类会读你的对话”。
为什么重要
第一,人类反馈是当前模型改进的核心工序,这意味着“有人读你的对话”不是临时安排,而是训练管线中的固定环节,短期内不会消失。第二,同意与披露之间存在落差:默认开启加含糊命名,实际上把选择成本转移给了用户,如果改成显式同意,退出率大概率会很高——这一点原文自己也点破了。第三,这不是 OpenAI 的独有做法。Anthropic 已向 404 Media 确认会人工审核 Claude 的回应,适用于开启“帮助改进我们的 AI 模型”的用户,并在审核前剥离邮箱等账户信息;谷歌也在 Gemini 中注明人类可能查看已保存的聊天。所以真正的问题不是“谁不干净”,而是整个行业把人工审核设成了默认项、把提示写成了脚注。
对谁有价值
普通用户需要知道:默认状态下,你输入的对话可能被真人阅读并用于训练。企业团队和法务需要重估“把什么内容贴进公共聊天窗口”的风险边界——客户名单、合同条款、未公开代码、身份信息都属于不该进去的东西。AI 产品经理和隐私合规从业者可以把这件事当成一份现成的案例:默认值怎么设、同意怎么问、匿名化做到哪一层,都会直接影响用户信任。此外,对想进入 AI 数据标注与模型评估行业的人,这条信号也说明了这个工种的招募渠道和报酬量级。
可以怎么行动
个人层面:去设置里检查“为所有人改进模型”开关,按需关闭,但要清楚它只对之后的新对话生效,历史数据不在其覆盖范围内;涉及敏感内容时改用临时聊天模式;把“不往公共模型里贴敏感信息”当成和自己“不点陌生链接”同级的习惯。企业层面:把公共 LLM 使用规范写进员工手册,明确禁止输入的红线数据,同时评估企业版或 API 的数据使用条款是否满足合规要求。产品层面:如果自己的产品也要采集用户数据做改进,把默认值和措辞当作伦理决策来做,显式同意、分级脱敏、可撤回,比事后解释便宜得多。
风险与限制
匿名化不等于脱敏:审核员看到的提示词仍可能包含可识别信息,而过滤器会失误。关闭开关只影响新对话,已发生的数据无法追回。本文的核心事实来自 404 Media 的调查,具体审核规模、覆盖比例并没有独立核验,OpenAI 在被问及“用户在哪里被明确告知人工审核”时最初也未回应。另需注意,时薪 50 美元以上是单个北美审核员的说法,不能代表该工种的普遍报酬水平。
这条内容的真正价值,不只是“有人发布了一个新功能”,而是它揭示了 the-decoder.com 背后的产品方向、工作流变化或竞争信号。对 OPC 来说,这种信息可以转化成持续追踪的栏目选题。
如果把《OpenAI 有数百名合同工在阅读你的 ChatGPT 对话》放到你的内容系统里,它最大的价值在于帮助读者更快看懂“为什么值得关注”,而不是只看到一条碎片化动态。