新浪新闻

OpenAI莉莉计划曝光用户聊天遭人工审核各方观点

BigNews 09.16 07:56
观点:

观点组1: 人工审核流程设计粗糙,暴露质量管控与伦理执行双重失范
观点作者:提示词审核员
观点内容:这份工作十分机械重复,操作指引频繁变动且自相矛盾,不同版本之间存在明显冲突;审核标准聚焦于语气、拟人化等表层问题,却不核查事实准确性,也未与安全审查流程协同,导致质量评估与风险防控割裂。


观点作者:OpenAI
观点内容:莉莉计划仅标记显而易见的错误,不验证回答事实性;评分体系与安全审查完全独立;匿名化流程存在已知漏洞却未升级,且未建立审核员伦理培训或数据接触最小化机制,反映出流程设计缺乏系统性治理。


观点作者:IT之家
观点内容:披露项目依赖大量低复杂度人力执行高敏感任务,时薪虽高但未匹配相应权责设计;审核员无权质疑指令矛盾,亦无反馈通道修正规则,暴露内部协作与流程韧性严重不足。


观点组2: 默认开启+无回溯的授权机制实质剥夺用户数据自主权
观点作者:提示词审核员
观点内容:用户对话开关默认开启,且切换后无法追溯已收集数据;即使删除对话,内容可能早已被抓取并存入训练集——这意味着用户永远无法真正撤回授权,所谓‘退出权’形同虚设。


观点作者:OpenAI
观点内容:面向普通用户默认启用数据收集,企业/教育版却默认关闭,暴露策略双标;帮助页面未说明‘退出开关无回溯效力’,也未提供历史数据批量清除选项,违反GDPR等框架下‘可携带性’与‘被遗忘权’基本要求。


观点作者:404 Media
观点内容:对比谷歌Gemini和Anthropic均明确公示人工审核范围及用户控制方式,而OpenAI既未清晰界定审核边界,也未赋予用户对已提交数据的实质性否决能力,使‘同意’沦为程序性摆设。


观点组3: OpenAI未充分告知用户其对话将被人工审阅,构成知情同意缺陷
观点作者:提示词审核员
观点内容:绝大多数用户并不知道自己的聊天内容会被其他人阅读。这件事尤其令人担忧:不少用户把 ChatGPT 当作临时倾诉对象、心理疏导对象,向 AI 吐露内心深处的秘密。虽然聊天记录经匿名处理,但过滤可能遗漏个人数据,简短会话风险更高,且用户明确请求保密的对话仍被送审。


观点作者:OpenAI
观点内容:向404 Media承认过滤环节可能遗漏个人数据,尤其在短会话中;在报道发布前未在帮助页面明确说明存在人工审阅环节,仅以模糊措辞提及‘出于模型优化目的开展人工审核’,修改后页面仍未披露‘工作人员会实际阅读会话内容’这一关键事实。


观点作者:404 Media
观点内容:发现OpenAI帮助页面至少两年未更新人工审阅的实质细节,报道发布后仅补充退出机制说明,却持续回避‘人类审核员将直接阅读用户对话’这一核心信息;同时指出用户记忆摘要中可能包含位置等敏感上下文,进一步加剧知情权缺位。


观点组4: 大模型优化高度依赖隐蔽人力劳动,挑战‘纯技术演进’叙事
观点作者:提示词审核员
观点内容:我们每天审阅成百上千条匿名对话,检查语气、拟人化、切题性等维度;这项工作虽不涉及代码开发,却是模型行为校准的关键环节——说明当前大模型进步远非仅靠算法和数据,而是建立在大量未被公众认知的人力基础设施之上。


观点作者:OpenAI
观点内容:莉莉计划作为核心评估机制持续运行多年,需雇佣数十名审核员并配套Slack协作、评分体系与操作文档;其存在本身即证明:即便在AGI宣传语境下,真实产品迭代仍深度绑定标准化人力干预,而非纯粹自动化闭环。


观点作者:IT之家
观点内容:该项目揭示AI公司普遍将‘人类参与’隐藏于后台,用‘数据优化’等术语淡化劳动实质;当用户倾诉创伤经历却被纳入训练素材时,这种隐蔽性已超出技术范畴,直指责任伦理与价值分配的根本矛盾。


加载中...