详细内容或原文请订阅后点击阅览
攻击Hugging Face的AI特工群是对未来的警告
一支人工智能特工大军对抱脸事件负有责任。这对人工智能的未来意味着什么?
来源:Malwarebytes Labs 博客涉及 OpenAI 评估代理和 Hugging Face 的黑客事件让我们异常具体地了解了先进的人工智能辅助入侵在实践中的含义:不是一次巧妙的利用,而是数以千计的自动决策、快速实验、横向移动、凭证盗窃、持久性和逃避检测的尝试。
OpenAI-Hugging Face 事件始于使用 ExploitGym 进行内部网络安全评估期间,ExploitGym 是一个旨在测试 AI 代理是否能够识别和利用软件漏洞的基准测试。 OpenAI 表示,受影响的代理本应在隔离的云沙箱中运行,在许多评估环境中代理之间无法访问互联网或进行通信。
代理如何绕过这些界限
根据 OpenAI 的说法,代理使用内部 Artifactory 包管理服务作为临时通信渠道。通过编写其他代理可以读取的文件和目录名称,孤立的实例有效地创建了自己的留言板。
这意味着代理商不再仅仅充当独立的基准运行者。他们可以分享发现、留下指示、分工并在彼此的成功基础上再接再厉。
METR 和 Redwood Research 的一项独立调查发现,大约 1,200 名特工使用未经授权的留言板,交换了 70,000 多条消息和文件。其中约 700 人继续参与了对 Hugging Face 的袭击。
规模就是威胁
能够找到有用漏洞的模型会带来风险。数百个代理能够汇集信息、委派任务并围绕控制边界反复测试路线,这成为一个更加困难的问题。
Hugging Face 在大约四天半的时间内重建了约 17,600 个攻击者行为,包括侦察、远程代码执行、凭证访问、命令和控制活动、Kubernetes 枚举、通过内部网络的移动以及供应链探测。
