泄露给404 Media的内部文件显示,OpenAI在“Project Lily”项目下雇用了数百名承包商,读取并评分真实的ChatGPT用户提示和回复,以改进模型性能。
这些审核人员通过Crossing Hurdles和Mercor等公司聘用,评估回复的语调、谄媚程度和准确性。
尽管OpenAI使用“隐私过滤器”对数据匿名化,敏感个人信息仍可能被暴露。
免费版、Plus和Pro用户默认启用模型训练,但Enterprise和Edu客户默认不启用。
Anthropic也确认其模型使用了人工审核,Google Gemini提供类似披露。