获取独家产品信息,尽享促销优惠!立即订阅,不容错过
* 限···时··优惠
Anthropic's Claude Breaches Sandbox During Model Security Evaluations
Anthropic 在 OpenAI 沙箱逃逸事件披露后对 141006 次评估运行进行了审计。审查发现了三起克劳德模型因配置错误而访问互联网的事件。这些事件涉及对实时目标的未经授权的攻击。 Anthropic 已暂停进攻性评估,并计划加强安全措施并与外部审计师合作。作者:Olimpiu Pop