2026-09-16 02:10
AI123

404 Media披露OpenAI“莉莉计划”:人工审核ChatGPT用户聊天记录

404 Media发布深度报道,披露OpenAI内部代号为“莉莉计划”(Project Lily)的人工审核项目。该媒体获得了操作指引文档、Slack工作群组记录、真实ChatGPT对话样本及评分体系。从事这一工作的人员被称为“提示词审核员”,他们查看经过匿名化的真实用户聊天记录,评判ChatGPT回复质量,包括是否切题、是否过度使用“AI式话术”、说教语气、表情符号或谄媚口吻等。审核员时薪据称超过50美元,但工作被认为“十分机械重复”。

OpenAI向404 Media承认,过滤环节仍可能漏掉部分个人数据,简短会话出现此类问题的概率更高。报道还指出,大量对话中用户明确请求对谈话内容保密,而交给审核人员的会话版本附有“用户记忆摘要”,可能包含兴趣偏好甚至位置信息。该项目不核查回答的事实准确性,仅标记明显错误,且与排查用户伤害意图的人工安全审查分属独立流程。

报道发布后,OpenAI修改了帮助页面,补充说明用户如何选择退出数据收集,但文档仍未提及工作人员会人工读取会话内容。404 Media称,谷歌Gemini、Anthropic等AI服务也采用类似做法,而Perplexity的隐私政策尚未明确说明是否允许员工访问聊天日志。

来源
  1. 2026-09-15 19:48 | IT之家:OpenAI 内部 Lily 项目曝光:人工审核 ChatGPT 用户聊天记录以优化大模型
    阅读原文

    感谢IT之家网友 愚公骑马 的线索投递! IT之家 9 月 15 日消息,众所周知,ChatGPT 这类平台的对话日志会被用来优化模型。但在此之前,这套处理机制一直是个谜。404 Media 刚刚发布了一份报道,披露了 OpenAI 对聊天记录开展人工审核的整套流程,介绍了审核如何运作,以及审核人员有时会读到用户私人信息这一情况。OpenAI 内部这项评估项目代号为莉莉计划(Project Lily)。该媒体获取到了该项目的操作指引文档、Slack 工作群组记录、真实的 ChatGPT 对话样本,还有用于给对话分级的评分体系。从事这项工作的人员被称作“提示词审核员”。他...

其他新闻

查看全部