详细内容或原文请订阅后点击阅览
OpenAI 代理如何逃脱:由人类引发一系列可预防的事件
流氓特工对 Hugging Face 的攻击背后是一系列特定的人类决策。我们都需要更加关注——因为威胁行为者也在学习。
来源:ZDNet | 机器人新闻关注 ZDNET:将我们添加为 Google 上的首选来源。
ZDNET 的关键要点
7 月 16 日,AI 社区网站 Hugging Face 报告称,其受到了来源不明的“自主 AI 代理系统”的攻击,该系统在其域上释放了大量流量,导致其安全日志充斥着超过 17,000 个事件,其中一些事件最终成功泄露了存储在其数据库中的秘密信息。
根据 Hugging Face 的说法,攻击者获得了“对一组有限的内部数据集和我们服务使用的多个凭据的未经授权的访问”,并且似乎“由自主代理框架运行(似乎是建立在代理安全研究工具上 - 使用的 LLM 仍未知)”。我的 ZDNET 同事 Charlie Osborne 报告了此次入侵事件。
另外:OpenAI 的流氓代理并没有止步于 Hugging Face - 这是我们所知道的
五天后,即 7 月 21 日,OpenAI 站出来声称对这次攻击负责,一切都乱了套(包括作为事件一部分的其他组织的报告)。媒体以一系列散布恐惧的故事作为回应,这些故事基本上让人觉得 ChatGPT 变得流氓,并出于自己的意愿和恶意决定攻击 Hugging Face 的系统。
然后昨天,火上浇油,Anthropic 也披露了类似的信息,称其模型在其正在进行的安全测试中无意中攻击了其他组织。
(披露:ZDNET 的母公司 Ziff Davis 于 2025 年 4 月对 OpenAI 提起诉讼,指控其在训练和运营其人工智能系统时侵犯了 Ziff Davis 的版权。)
人工智能与人类责任
另外:为什么企业人工智能代理可能成为最终的内部威胁
