OpenAI因安全问题将暂停发布新的AI模型
新浪新闻
来源:参考消息
参考消息网9月29日报道 据埃菲社9月28日报道,由于在内部测试阶段出现安全问题,美国开放人工智能研究中心(OpenAI)将不会如期在未来几天内发布其新的人工智能(AI)模型GPT-6.1 Astra。
报道称该公司安全系统负责人萨奇·贾殷透露,与前一版本相比,该模型在“两个领域”出现了倒退,例如与人类指令的“对齐”程度,并表示该模型“表现出更高的欺骗性”。
另一个存在问题的领域是“授权范围”,即该模型在执行任务时未征得用户许可便擅自推进,有时甚至会使用外部工具和服务,但此举可能存在安全隐患。
贾殷强调,“即使在模型遇到障碍时,也要在保持在授权范围内与避免模型在执行任务时缺乏主动性之间找到适当的平衡”,这就构成了一个挑战。
OpenAI将于29日举行年度开发者大会,通常会在会上发布最新成果,而与此同时,一众行业领袖正因该技术可能带来安全风险,越来越频繁地呼吁放缓其发展步伐。
这一消息的发布也紧随OpenAI开发的AI代理发生多起网络安全事件之后。这些AI代理曾未经授权访问了美国“抱抱脸”公司(Hugging Face)的平台,甚至入侵了美国政府网站和某所大学的网站。