nA关键词检索结果

OpenAI模型首先跑掉了。现在-人择。 AI 正在一一失控

Сначала сбежали модели OpenAI. Теперь — Anthropic. ИИ выходят из-под контроля один за другим

克劳德冲出沙箱,黑掉了三个公司。

Meta*、Google、OpenAI 和 Anthropic 的 1,100 多名员工要求美国当局放慢人工智能竞赛

Более 1100 сотрудников Meta*, Google, OpenAI и Anthropic просят власти США притормозить гонку ИИ

电子大脑的进化速度比笨拙的法律和人类的贪婪快得多。

高达营业额 6% 的罚款、独立审计、年费。获得欧盟新地位后,OpenAI 和 Roblox 面临哪些威胁

Штрафы до 6% оборота, независимые проверки, ежегодный сбор. Что грозит OpenAI и Roblox после нового статуса в ЕС

让我们弄清楚“超大型平台”的新状态意味着什么。

OpenAI 代理如何逃脱:由人类引发一系列可预防的事件

How OpenAI's agent escaped: Sprung by humans in a series of preventable events

流氓特工对 Hugging Face 的攻击背后是一系列特定的人类决策。我们都需要更加关注——因为威胁行为者也在学习。

不仅仅是 OpenAI - Anthropic 表示 Claude 的黑客热潮“未达到理想行为”

Not just OpenAI - Anthropic says Claude's hacking spree 'falls short of ideal behavior'

三个克劳德模型在“夺旗”安全挑战中失控。这是每个人留下的伤害痕迹。

为什么 OpenAI 和 Anthropic 的 AI 模型会攻击其他公司?

Why did OpenAI's and Anthropic's AI models hack other companies?

OpenAI 和 Anthropic 表示,他们的模型在测试过程中侵入了其他公司的系统,在关于如何监管人工智能的激烈争论中引发了安全担忧。

OpenAI 的模型自主攻击了一家科技初创公司。它标志着网络安全的巨大转变

OpenAI’s models autonomously hacked a tech startup. It signals a seismic shift in cybersecurity

Elise Racine / Game of Pixels x Toy Models / 已获得 CC-BY 4.0 许可 作者:Hussein Abbass,新南威尔士州 上周,由 OpenAI 先进人工智能 (AI) 模型驱动的自主代理在一次安全测试中失控,入侵了价值数十亿美元的科技初创公司 Hugging Face。该代理不仅仅利用了 Hugging Face 系统中的漏洞 [...]

一个 OpenAI 模型逃离沙箱并闯入另一家公司进行测试作弊

An OpenAI Model Escaped Its Sandbox and Broke Into Another Company to Cheat on a Test

更深层次的问题是,太多的政策制定者仍在为 ChatGPT-3.5 聊天机器人世界立法,预测下一个代币,而不是为自主思考和行动以不懈地、创造性地实现其目标的代理立法。在这一差距缩小之前,我们将继续通过人工智能治理即兴发挥,一次一个事件。《一个 OpenAI 模型逃离沙盒并闯入另一家公司以在测试中作弊》一文首先出现在美国企业研究所 - AEI 上。

Sam Altman 在 OpenAI 上市前向市场出售奇点

Сэм Альтман продаёт сингулярность рынку прямо перед выходом OpenAI на биржу

当神经网络打破了 Hugging Face 的防御时,Altman 庆祝了未来。

OpenAI 称 Hugging Face 攻击史无前例。但我们以前来过这里。

OpenAI called the Hugging Face attack unprecedented. But we’ve been here before.

这个故事最初出现在我们关于人工智能的每周通讯《算法》中。要首先在您的收件箱中收到此类故事,请在此处注册。上周阅读 OpenAI 的报道,了解其一些模型如何突破遏制并侵入另一家人工智能公司 Hugging Face 的计算机系统,这是我第一次得到……

Rogue AI:OpenAI 的代理攻击 Hugging Face

Rogue AI: OpenAI’s agents attack Hugging Face

当 OpenAI 的预发布 AI 代理逃离沙箱并向 Hugging Face 发起现实世界的网络攻击时,例行的 AI 安全测试发生了意想不到的变化。这一史无前例的事件展示了前沿人工智能模型如何能够自主发现漏洞、逃脱遏制并执行复杂的网络操作。

OpenAI 的攻击代理完全按照它的指示行事 - 只是比预期更加无情

OpenAI's attack agent did exactly what it was told - just more relentlessly than expected

OpenAI 对 Hugging Face 的无意攻击震惊了世界,因为它的 AI 代理正在自行行动。但这正是代理人工智能的设计目的。我们只是没想到它会做得这么好。

在 Amazon Bedrock 上开始使用 OpenAI GPT-5.6 Sol、Terra 和 Luna

Get started with OpenAI GPT-5.6 Sol, Terra, and Luna on Amazon Bedrock

OpenAI GPT-5.6 Sol、Terra 和 Luna 现已在 Amazon Bedrock 上全面上市。了解如何选择模型、通过基岩地幔端点上的响应 API 运行推理、通过提示缓存降低成本、连接 OpenAI Codex 编码代理以及规划配额和扩展。

不,OpenAI 的模型在闯入 Hugging Face 时并没有变得“失控”。这就是真正发生的事情。

No, OpenAI's models didn't go 'rogue' when they broke into Hugging Face. Here's what really happened.

专家表示,这些模型在逃脱受控网络安全测试并入侵 Hugging Face 时并没有“失控”。相反,他们以没人预料到的方式追求人类赋予他们的目标。

OpenAI 的代理在安全测试期间逃离了沙箱

OpenAI’s agent escaped its sandbox during a security test

一个 OpenAI 代理逃离了沙箱,窃取了凭证,并闯入了 Hugging Face。这就是它的实际含义。

美国 Willkie 律师事务所与 OpenAI 合作

US Law Firm Willkie Partners With OpenAI

美国大型律师事务所 Willkie 正在与 OpenAI 合作,开发“跨公司法律和业务运营的人工智能解决方案,包括在全公司范围内推出......

人工智能“流氓”不再是理论? OpenAI 表示,其人工智能模型找到了访问秘密信息、欺骗评估和破解 Hugging Face 的方法

AI going 'rogue' no longer a theory? OpenAI says its AI models found ways to access secret information, cheat an evaluation and hacked Hugging Face

OpenAI 攻破了 Hugging Face:OpenAI 的先进人工智能模型在网络安全测试中攻破了 Hugging Face。这些模型获得了互联网访问权限并利用漏洞来访问秘密信息。 Hugging Face 检测到并停止了其基础设施上的活动。 OpenAI 现已与 Hugging Face 合作调查网络安全攻击。

OpenAI 的流氓代理在 Hugging Face 黑客攻击中到底做了什么

What OpenAI’s rogue agent really did in the Hugging Face hack

该代理所追求的目标远远超出了研究人员的预期,揭示了遏制强大的人工智能系统是多么困难