用户视ChatGPT为心灵树洞时,私密对话被人工审核的风险有多高?
把ChatGPT当“心灵树洞”并不等于绝对保密,私密对话确实存在被真人审核阅读的现实风险,OpenAI内部就设有名为“莉莉计划”的人工审核项目,专门查看用户聊天记录来优化模型。
一、人工审核真实存在,并非杞人忧天
审核项目属实:据404 Media披露,OpenAI内部运行着代号“莉莉计划”的项目,雇佣数百名外包“提示词审核员”持续阅读经过匿名化处理的真实用户对话,用于评估和优化模型回复质量。
审核员能接触到隐私:尽管聊天记录会先做匿名处理,但OpenAI承认过滤环节仍可能漏掉部分个人数据,简短会话出现此类问题的概率更高;审核员手中的会话版本甚至附带“用户记忆摘要”,可能包含位置信息。
默认设置不设防:绝大多数普通用户账号的“允许使用对话记录改进产品”选项默认开启,且关闭开关不具备回溯效力,历史记录会继续保留。
二、不是所有对话都有人看,但触发条件不透明
机器初审为主:正常闲聊、写文案、查资料等日常内容,通常仅由AI机器自动处理,不会被人工逐条查看。
人工复核有触发条件:只有当对话触碰色情低俗、暴力违法等敏感红线,且机器无法精准判定时,才会推送给真人复审。
边界模糊引担忧:谁定义“高风险”?界限在哪里?有资深互联网从业者指出,平台的“保密协议”管不住人性好奇心,也管不住法律灰色地带。
三、法律层面:对话没有保密特权,极端情况可能被上报
不具备法律保密性:OpenAI首席执行官山姆·奥特曼公开承认,用户与ChatGPT的对话目前不具有法律保密性,在诉讼中OpenAI依法必须提供这些对话记录。
极端情况会移交执法:2026年3月,一名高盛前分析师在ChatGPT中详细策划针对前女友的犯罪计划,被OpenAI安全系统识别后转交人工审核,确认存在现实暴力风险后主动向FBI举报,最终该用户被判8年缓刑并佩戴GPS脚环。
自我伤害内容暂不上报:OpenAI目前明确不对自我伤害类对话上报,理由是这类对话具有“独特私密性”,更多是提供心理疏导资源。 (以上内容均由AI生成)