AI资讯 / 产业

产业 / 媒体

OpenAI雇数百名合同工审阅用户ChatGPT对话内容

The Decoder

据404 Media调查报道,OpenAI雇用了数百名合同工,专门阅读真实用户与ChatGPT的对话记录,并对模型回复进行评分,以改善聊天机器人的表现。这些审阅者通过招聘平台Crossing Hurdles招募,经由AI训练公司Mercor发放薪酬,北美地区审阅者时薪超过50美元。对话在审阅前会经过匿名化处理,但仍可能包含敏感个人信息,OpenAI承认其隐私过滤器并非万无一失。用户可通过关闭默认开启的「为所有人改进模型」设置来阻止对话被用于训练,但该选项仅对新对话生效。OpenAI仅在一个不显眼的FAQ页面中提及人工审阅,批评者认为这一披露方式过于隐蔽且措辞模糊,难以让用户真正了解人工审阅的实际规模。

根据404 Media获取的内部泄露文件及多名知情人士的证词,OpenAI目前雇用数百名合同工,负责阅读真实用户与ChatGPT之间的对话,并对模型回复质量进行评分。评分采用1至7分制,审阅重点在于识别并减少模型输出中的过度奉承倾向以及过于拟人化的表达方式。一名参与审阅的工作人员向404 Media表示,他认为大多数用户根本不知道有真人在阅读他们的聊天记录。

这些合同工通过招聘平台Crossing Hurdles招募,薪酬由AI训练公司Mercor发放。据悉,北美地区的审阅者时薪超过50美元。对话记录在进入审阅流程前会经过匿名化处理,但OpenAI承认其隐私过滤机制并不完美,仍有可能遗留用户的敏感个人信息。审阅到的部分对话甚至包含用户明确要求ChatGPT保密内容的请求,进一步凸显了信息披露不足的问题。

用户若不希望对话被用于模型训练或被人工审阅,可在设置中关闭默认开启的「为所有人改进模型」选项。但需注意,该设置仅对关闭后新建的对话生效,此前的历史记录不受影响。OpenAI还提供「临时聊天」模式,官方表示该模式下的输入数据不会用于模型训练。

在信息披露层面,OpenAI仅在一个不显眼的FAQ页面中说明,经授权的人员及服务提供商可能会查看用户数据以改善模型性能,并建议用户避免输入敏感信息。该说明自2023年起便已上线,多年来几乎未有实质性更新。404 Media批评这一披露方式过于隐蔽且措辞含糊,「为所有人改进模型」这一表述更像是在邀请用户参与社区贡献,而非明确告知其对话将被真人阅读。

人工审阅并非OpenAI独有的做法。Anthropic向404 Media确认,其同样使用人工审阅员检查Claude的回复,适用于开启了「帮助改进AI模型」隐私设置的用户,且在审阅前会去除账户邮箱等身份信息。Google也在Gemini的说明中注明,人工审阅员可能会查看已保存的对话记录。对于各大AI实验室而言,基于人类反馈的强化学习是提升模型能力的核心环节,这一做法在行业内已相当普遍。

分析人士指出,OpenAI选择模糊而非明确的披露方式,背后可能有其商业考量。若平台要求用户主动同意人工审阅,选择退出的比例预计将大幅上升,从而影响可用于训练的数据规模。这一事件再次引发外界对AI公司数据使用透明度的质疑,也提示用户在与AI聊天时应对隐私保护保持更高警惕。

要点

  • OpenAI雇用数百名合同工阅读真实ChatGPT对话并评分,旨在减少模型的过度奉承与拟人化行为
  • 对话经匿名处理但仍可能含敏感信息,OpenAI承认隐私过滤器存在出错可能
  • 用户可关闭默认开启的「为所有人改进模型」设置以退出训练,但仅对新对话生效
  • OpenAI仅在不显眼的FAQ页面提及人工审阅,批评者认为披露方式过于隐蔽
  • Anthropic与Google同样采用人工审阅机制,该做法在AI行业已属普遍
查看原始来源

原始标题:OpenAI has hundreds of contract workers reading your ChatGPT conversations

本文由 DataHub 基于公开来源整理,用于信息发现与摘要阅读;具体事实、数据和后续更新以原始来源为准。