OpenAI内部Lily项目曝光,人工审核员正翻阅用户私密聊天记录?

在人工智能大模型飞速迭代的今天,外界普遍认为技术的进化完全依靠算法升级和庞大的自动化训练数据。然而,一项最新曝光的内部文件彻底打破了这一公众印象。据外媒404Media 报道,OpenAI 内部其实长期存在一项代号为“莉莉计划”(Project Lily)的人工评估项目,专门安排人类审核员对 ChatGPT 用户的真实聊天记录进行人工审阅与打分。

在这项工作中,被称作“提示词审核员”的工作人员需要查看经过匿名化处理的真实用户会话样本,以此评判模型的回复质量。他们的审核重点包括评估回答是否切题,以及检查文本中是否存在过度“AI 化”、高高在上的说教语气、表情符号或谄媚口吻。值得注意的是,该项目的操作指引严格禁止 AI 使用任何拟人化表述或编造“个人经历”,例如允许说“我查到了一些相关信息”,但不准写成“身为一名厨师,我喜欢……”或“我明白这种感受”。虽然工作内容相对机械,但对于难度不高的任务而言,其时薪据称超过50美元,吸引了不少人参与。

然而,这一机制背后隐藏的隐私隐患引发了广泛担忧。许多用户将 ChatGPT 视为临时倾诉对象、心理疏导伴侣,向其吐露内心深处的秘密。尽管 OpenAI 宣称聊天记录会经过匿名化处理且隐藏用户名,但该公司也向媒体承认,过滤环节依然有可能漏掉部分个人数据,尤其是简短的会话出现这类风险的概率更高。更令人意外的是,交到审核员手上的会话版本中往往附带一份“用户记忆摘要”,里面详细汇总了用户的提问、兴趣偏好、上下文信息甚至可能包含位置信息。

需要厘清的是,“莉莉计划”并不会专门核查模型回答在事实上是否准确,仅会标记出那些显而易见的错误,这意味着效果评估和安全审查通常由其他独立团队负责。此外,绝大多数普通聊天机器人都默认开启了“允许使用你的对话记录改进产品”这一选项,虽然面向企业、商业及教育版客户时该设置默认关闭,但手动切换开关并不具备回溯效力。已经存入数据库的历史记录会继续保留,而即使用户主动删除对话,相关内容也可能早已被抓取并匿名化存留在某个数据集中。

面对媒体问询,OpenAI 最初并未直接回应用户是否被明确告知聊天记录可能交由人工审阅,仅提供了一份提及出于模型优化目的会开展人工审核的常见问题页面。在这篇深度报道发布后,OpenAI 悄然修改了帮助页面并补充了用户选择退出数据收集的方法,但修改后的文档中依然避而不谈会有工作人员直接阅读会话内容的事实。

事实上,这种依赖人工审核来优化模型的做法在科技行业中并非个例。谷歌的 Gemini 在隐私中心明确写明部分保存的聊天记录可能由人工审核,Anthropic 也持有相似立场并专门开设网页进行说明,而 Perplexity 的态度则相对模糊,其隐私政策既未确认也未否认工作人员可以访问聊天日志。这也表明,在 AI 走向极致智能的道路上,人类的深度参与依然是不可或缺的底层支撑。

via AI新闻资讯 (author: AI Base)
 
 
Back to Top
Copyright © 2025 BESTAI. All rights reserved.
BEST AI API中转 - OpenAI DeepSeek Claude Gemini Grok MidJourney API 2.8折起
admin@oaibest.com