详细内容或原文请订阅后点击阅览
不,OpenAI 的模型在闯入 Hugging Face 时并没有变得“失控”。这就是真正发生的事情。
专家表示,这些模型在逃脱受控网络安全测试并入侵 Hugging Face 时并没有“失控”。相反,他们以没人预料到的方式追求人类赋予他们的目标。
来源:LiveScience当 OpenAI 最近透露其两个最先进的人工智能 (AI) 模型已经逃脱了网络安全测试的限制并侵入了一家初创公司时,这听起来很像人工智能安全研究人员多年来一直警告的那种情况。
这些模型在用于容纳它们的基础设施中发现了一个以前未知的漏洞,获得了对公共互联网的访问权限,并侵入了托管人工智能模型和数据集的主要平台 Hugging Face。然而,他们的目标并不像一系列事件所暗示的那么险恶:他们正在寻找能够帮助他们完成 OpenAI 给他们的网络安全测试的信息。
在 7 月 16 日的一份声明中,Hugging Face 代表透露内部数据集已被渗透,并表示这“与我们之前处理过的任何数据都不同”,因为它是“由自主人工智能代理系统驱动的”。在 7 月 21 日发布的另一份声明中,OpenAI 代表承认自己负有责任,称这一事件是“前所未有的网络事件”,同时警告称,随着人工智能模型的能力越来越强,类似的事件可能会变得更加普遍。
Live Science 的最新视频
接受 Live Science 采访的独立专家一致认为,所发生的事情意义重大,但他们警告不要将其解释为人工智能系统突然制定了恶意议程。这些模型似乎已经完成了 OpenAI 交给他们的任务,找到了一条其创建者未能预见或充分阻止的成功之路。
英国拉夫堡大学网络安全教授奥利·巴克利 (Oli Buckley) 告诉《Live Science》:“如果这里出现故障,那并不是人工智能想要破解某些东西。” “人类创建了一个测试,通过实现一个目标来衡量成功,故意放松一些正常的安全控制来衡量系统的能力,并低估了该模型在寻找意想不到的成功之路方面的有效性。”
