亚洲财经

☰ 搜索

新诉讼声称:人类正在阅读你的ChatGPT聊天记录

OpenAI因用户隐私问题遭集体诉讼:ChatGPT对话究竟由谁审阅?

本月,一起拟议的集体诉讼在美国加利福尼亚州北区联邦地区法院提起,指控OpenAI在未明确告知用户的情况下,将真实用户的聊天记录发送给外部承包商。OpenAI于9月2日收到了相关传票。

该诉讼矛头直指OpenAI内部的一项名为“Lily计划”的项目。媒体404 Media于9月14日首次曝光了该项目。根据起诉书内容,通过第三方劳务公司雇佣的“AI数据审查员”和“聊天机器人评估员”等角色的人员,会阅读真实的ChatGPT提示词及完整对话记录。他们的工作包括总结用户的意图,并对四种不同的模型回答按照1至7分的评分标准进行打分和批评。

这一过程是像ChatGPT这样的聊天机器人变聪明的基本机制。简而言之,人类对AI的回答进行评分,这些评分被反馈到训练过程中,使模型学习哪些回答更受用户欢迎。业界将这种技术称为“基于人类反馈的强化学习”(RLHF)。起诉书的核心理由在于,用户从未被明确告知,阅读其聊天记录的可能是真人,而不仅仅是机器。

OpenAI表示,在任何人工查看之前,对话会通过自动化系统进行筛选。然而,起诉书指控称,该过滤器并非总能拦截所有内容,导致个人细节有时仍会泄露给承包商。404 Media发现,审查员使用的仪表板包含“用户记忆摘要”,即对个人过往聊天的回顾。尽管用户名已被移除,但这些摘要可能揭示用户的地理位置、职业或私人生活等细节。

OpenAI曾解释说,此类审查旨在减少两种特定行为:一是聊天机器人过于拟人化,二是聊天机器人过于顺从。研究人员将后者称为“阿谀奉承”(sycophancy),即AI告诉用户它认为用户想听的话,而非准确的信息。

ChatGPT拥有超过9亿周活跃用户,其中许多人将其视为日记、治疗师或仅供自己使用的搜索引擎。用户输入的内容涵盖健康症状、分手短信、税务问题和法律困境等敏感信息。起诉书指出,OpenAI的隐私政策虽然列出了某些有权访问用户数据的第三方类别,但并未特别指出数据标注或人工评估供应商属于此类。

该投诉包含了八项独立的法律主张,包括违反加州《不公平竞争法》、《消费者隐私法》,以及普通法下的“侵扰私生活”索赔——这是一种隐私侵权罪名,适用于以合理之人认为具有冒犯性的方式窥探他人私密事务的行为。原告方要求赔偿损失、返还财产及惩罚性赔偿。

在禁令救济方面,原告的诉求非常具体。他们要求OpenAI在将任何对话发送给外部审查员之前,必须获得用户的明确同意;将“为所有人改进模型”的设置默认关闭而非开启;在聊天窗口内添加清晰的警告提示;并可能在重新训练使用过这些数据的模型时,删除与已审查对话相关的工作成果。

OpenAI需在10月13日前作出回应。