精华速览

404 Media披露OpenAI内部代号“莉莉计划”的人工审核项目,审核员被称作“提示词审核员”,负责查看经匿名化处理的真实用户聊天记录,评估ChatGPT回复质量,包括是否切题、是否过度使用AI式话术、说教语气、表情符号、谄媚口吻,以及禁止拟人化表述和编造个人经历。审核员时薪据称超过50美元,但工作机械重复,操作指引频繁改动且版本间常自相矛盾。OpenAI承认匿名化过滤可能漏掉个人数据,简短会话风险更高。审核版本还附带用户记忆摘要,可能包含位置信息。莉莉计划不核查事实准确性,仅标记明显错误,与安全审查分属独立流程。事件曝光后OpenAI修改帮助页面补充退出数据收集选项,但仍未提及人工读取会话内容。

要点透视

  • 404 Media获取了OpenAI内部“莉莉计划”的操作指引文档、Slack工作群组记录、真实ChatGPT对话样本及对话分级评分体系。
  • 审核员岗位名为“提示词审核员”,时薪据称超过50美元(约合336.3元人民币),工作内容为查看匿名化聊天记录并评判回复质量。
  • 审核标准包括:回复是否切题、是否过度出现AI式话术、居高临下说教语气、表情符号、谄媚口吻,禁止拟人化表述和编造个人经历。
  • OpenAI向404 Media承认,匿名化过滤环节仍可能漏掉部分个人数据,简短会话出现此类问题的概率更高。
  • 交给审核员的会话版本附带“用户记忆摘要”,汇总用户提问、兴趣偏好、上下文信息,甚至可能包含位置信息。
  • 莉莉计划不专门核查回答内容事实准确性,仅标记显而易见错误,与排查用户伤害意图的人工安全审查属于两套独立流程。
  • ChatGPT企业版、商业版及教育版客户的数据用于改进产品设置默认关闭,但普通用户版默认开启,且切换开关不具回溯效力。
  • 事件曝光后OpenAI修改帮助页面,补充说明用户如何选择退出数据收集,但修改后文档仍未提及工作人员会人工读取会话内容。

文章拆解

莉莉计划的曝光,将大模型迭代背后长期隐而不宣的人工环节推到台前。OpenAI等公司对外塑造的技术驱动形象,与实际上需要大量人类审核员介入的现实形成反差。审核员时薪超过50美元,说明这项工作对语言判断和细节敏感度有要求,但审核员自述“十分机械重复”,且操作指引频繁改动、版本间自相矛盾,反映出大模型优化标准本身仍在快速漂移,人工审核更像是填补技术评估空白的权宜手段。

从用户影响看,核心矛盾在于知情同意与数据实际用途之间的落差。多数聊天产品默认开启“允许使用对话记录改进产品”,付费订阅也不例外,但用户通常不会想到自己的私密倾诉可能被真人逐条阅读。OpenAI承认匿名化过滤可能漏掉个人数据,简短会话风险更高,而审核版本还附带用户记忆摘要,可能包含位置信息。这意味着即便用户名被隐去,对话内容本身仍可能暴露身份或敏感处境。更关键的是,删除对话无法追溯,内容可能早已被抓取、匿名化并留存于数据集。

行业层面,人工审阅聊天记录并非OpenAI独有。谷歌Gemini在隐私中心明确写明部分保存的聊天记录可能由人工审核,Anthropic也开设专门网页说明,Perplexity的隐私政策则既未确认也未否认。这种普遍性说明,当前大模型服务的数据治理仍处于灰色地带:企业倾向于用宽泛的“改进产品”条款覆盖多种数据用途,而用户对具体操作流程缺乏清晰认知。

值得关注的变量包括:OpenAI修改帮助页面后仍未提及人工读取会话内容,监管机构是否会就此介入;企业版默认关闭数据收集的做法是否会倒逼消费版调整;以及莉莉计划与独立事实核查、安全审查团队之间的协作边界尚待确认。潜在风险在于,若用户因隐私顾虑减少真实表达,可能反过来影响模型优化所需数据的多样性和质量,形成一种难以公开讨论的负向循环。

查看原文