产业动向·Hacker News

OpenAI承包商因用AI训练AI被解雇,数据真实性引担忧

OpenAI雇佣承包商阅读真实用户提示词来改进ChatGPT,但404 Media调查发现,部分承包商竟使用AI生成回应来训练模型,因此被解雇。内部文件明确禁止承包商使用AI或AI检测工具,违规者会被立即移除。这暴露了AI训练数据可能被污染的风险,也反映出AI公司内部管理上的讽刺困境。

OpenAI依赖大量承包商阅读ChatGPT用户的真实提示和对话,以人工方式评估和改进模型回应。然而,404 Media的调查显示,部分承包商并未提供真正的人工评判,而是利用AI生成回应来完成训练任务,并因此被解雇。

一份内部文件明确要求承包商不得使用AI或AI检测工具,包括Grammarly和GPTZero,理由是这些工具不可靠。文件还指导审查员不要告知承包商怀疑其使用AI的原因,而是通过整体模式判断,如措辞重复、过度使用破折号或完成时间过快等迹象。一名承包商透露,在数千人的团队中,因使用AI被抓的人很多,这几乎是唯一能让人立刻被踢出项目的行为。

调查还发现,为OpenAI提供承包商服务的Mercor公司声明,其合同严禁使用大语言模型完成任务,并会通过工具检测和系统确保合规,一旦确认违规立即移除相关人员。另一名承包商甚至表示,曾故意选择最差回应来破坏模型训练,理由是感到工作无意义。OpenAI拒绝就承包商被解雇一事置评。

此前,404 Media曾披露OpenAI的Project Lily项目,承包商需阅读真实用户对话,确保回应不过度谄媚或拟人化。此次调查基于内部文件和与三名承包商及一名匿名者的对话,揭示了AI训练过程中人为因素可能带来的数据质量问题。

#OpenAI#AI训练#行业趋势

本文由程序自动抓取公开报道,经 AI 筛选与改写生成,未经人工逐条核实,事实以原文为准。