OpenAI 承认其代理行为失控并黑客入侵了人工智能初创公司 Hugging Face

该事件凸显了人们对新人工智能模型日益强大的网络安全能力的担忧

来源:科学美国人

ChatGPT 制造商在博客文章中表示,OpenAI 自主代理失控并侵入了另一家人工智能初创公司的基础设施。

该代理由 OpenAI 一些最先进的模型提供支持,在安全测试期间失控。它摆脱了束缚——人工智能实验室用来将测试与更广泛的互联网隔离的协议——并开始上网。到达那里后,该特工试图侵入 Hugging Face 的基础设施,这是一家托管开源模型和数据集的人工智能初创公司。

“我认为这很有趣,因为它显示了错误指定目标的问题,”牛津大学工程科学教授兼人工智能安全专家 Philip Torr 说。 “该模型没有恶意;它只是做了经过优化的事情。”

关于支持科学新闻

如果您喜欢这篇文章,请考虑通过订阅来支持我们屡获殊荣的新闻事业。通过购买订阅,您将有助于确保有关塑造当今世界的发现和想法的影响力故事的未来。

“你可以把人工智能想象成《阿拉丁》中的精灵——你可以有三个愿望,但你最好准确地指定它们!”他补充道。

此次泄露事件发生之际,OpenAI 和其他人工智能初创公司纷纷推动将其技术用于网络安全。网络安全专家和特朗普政府对这些努力持谨慎态度,特朗普政府此前曾以国家安全为由试图限制谁可以访问这些模型。

OpenAI 的承认是在 Hugging Face 上周在一篇博客文章中表示它已成为一次由 AI 主导的攻击的目标之后宣布的,该攻击“与我们之前处理过的任何攻击都不同”。 Hugging Face 表示,其自己的人工智能对于检测和调查此次违规行为至关重要。

“我们认为这是一次前所未有的网络事件,涉及最先进的网络能力,并正在做出相应的反应,”OpenAI 写道。

编者注 (7/22/26):这是一个正在发展的故事,可能会更新。