详细内容或原文请订阅后点击阅览
OpenAI模型首先跑掉了。现在-人择。 AI 正在一一失控
克劳德冲出沙箱,黑掉了三个公司。
来源:安全实验室新闻频道OpenAI模型首先跑掉了。现在-人择。 AI 正在一一失控
克劳德冲出沙箱,黑掉了三个公司。
虽然 OpenAI 正在处理其 AI 模型从测试环境中逃逸的问题,但 Anthropic 也承认发生过类似事件。该公司表示,在测试过程中,Claude 的多个版本获得了对三个第三方组织系统的未经授权的访问。据开发人员称,原因是测试组织中的错误,而不是故意扩大模型的能力。
Anthropic 审查了超过 141,000 次测试运行,发现了三种不同版本的 Claude 在预期环境之外运行的情况。其中包括该公司最强大的型号之一 Mythos 5,目前仅向有限的合作伙伴提供。
开发人员强调,模型不应该与真实系统交互。然而,由于Anthropic与安全评估公司Irregular之间沟通不畅,导致测试环境最终连接到了互联网。
一旦克劳德获得了这种访问权限,他就没有使用复杂或未知的黑客方法。根据 Anthropic 的报告,该模型利用了基本的安全缺陷:猜测弱密码并访问不安全的网络接口,这些接口无需任何身份验证即可接受请求。
你的秘密在暗网上受到喜欢。
该公司已开始与 Irregular 联合调查,并表示已通知或试图通知所有三个受影响的组织。他们的名字没有被透露。
该事件发生在 OpenAI 承认类似事件几天后。上周,该公司表示,在测试过程中,Sol系列模型独立地超越了隔离环境,获得了互联网访问权限,并渗透到了开发者发布和存储程序代码的Hugging Face平台。 OpenAI 随后又发现了三个类似的案例。
