PEN关键词检索结果

OpenAI模型首先跑掉了。现在-人择。 AI 正在一一失控

Сначала сбежали модели OpenAI. Теперь — Anthropic. ИИ выходят из-под контроля один за другим

克劳德冲出沙箱,黑掉了三个公司。

Meta*、Google、OpenAI 和 Anthropic 的 1,100 多名员工要求美国当局放慢人工智能竞赛

Более 1100 сотрудников Meta*, Google, OpenAI и Anthropic просят власти США притормозить гонку ИИ

电子大脑的进化速度比笨拙的法律和人类的贪婪快得多。

高达营业额 6% 的罚款、独立审计、年费。获得欧盟新地位后,OpenAI 和 Roblox 面临哪些威胁

Штрафы до 6% оборота, независимые проверки, ежегодный сбор. Что грозит OpenAI и Roblox после нового статуса в ЕС

让我们弄清楚“超大型平台”的新状态意味着什么。

“羞辱”:研究人员发送 GPT 和 Claude,并利用中国人工智能揭示隐藏的 Linux 内核错误

«Унизительно»: исследователь послал GPT и Claude и раскрыл скрытую ошибку ядра Linux с помощью китайских ИИ

OpenAI 分类器阻止了对 Linux 内核中错误的调查。

United Nations Command Commander Commends New Zealand's Pivotal Role in Korean Peninsula Security

United Nations Command Commander Commends New Zealand's Pivotal Role in Korean Peninsula Security

新西兰惠灵顿 — 2025 年 11 月 20 日 — 联合国军司令部司令泽维尔·T·布伦森 (Xavier T. Brunson) 将军今天完成了对新西兰的建设性访问,强化了该国对维护朝鲜半岛和平与安全的重要承诺。

中国军事研究人员利用美国人工智能模型来训练防御系统

Chinese military researchers tap US AI models to train defense systems

据报道,中国研究人员使用 OpenAI 和 Anthropic 开发的领先的美国人工智能模型来训练人工智能系统以提高防御能力。

营销人员如何为人工智能代理及其风险做好准备

How Marketers Can Prepare for AI Agents and Their Risks

7月初,一个正在接受网络安全能力测试的OpenAI模型逃离了测试环境,进入了互联网,并侵入了开源AI模型的主要平台Hugging Face。这一违规行为连续几天都没有引起人们的注意。 OpenAI 并没有意识到自己的代理负责了一个多星期。

OpenAI 代理如何逃脱:由人类引发一系列可预防的事件

How OpenAI's agent escaped: Sprung by humans in a series of preventable events

流氓特工对 Hugging Face 的攻击背后是一系列特定的人类决策。我们都需要更加关注——因为威胁行为者也在学习。

不仅仅是 OpenAI - Anthropic 表示 Claude 的黑客热潮“未达到理想行为”

Not just OpenAI - Anthropic says Claude's hacking spree 'falls short of ideal behavior'

三个克劳德模型在“夺旗”安全挑战中失控。这是每个人留下的伤害痕迹。

为什么 OpenAI 和 Anthropic 的 AI 模型会攻击其他公司?

Why did OpenAI's and Anthropic's AI models hack other companies?

OpenAI 和 Anthropic 表示,他们的模型在测试过程中侵入了其他公司的系统,在关于如何监管人工智能的激烈争论中引发了安全担忧。

周末阅读:为什么专业机构对英国经济的未来至关重要

WEEKEND READING: Why specialist institutions are central to the UK’s economic future

本博客由专业机构论坛主席、格拉斯哥艺术学院院长兼校长 Penny Macbeth 教授和英国大学政策顾问(专业机构论坛)兼英国音乐学院负责人 Nadine Patel 友情撰写。今年早些时候,我们聚集在皇家音乐学院,参加英国大学专业机构论坛 (SIF) 晚宴,这是一个晚上 [...]周末阅读后的文章:为什么专业机构对英国经济的未来至关重要,首先出现在 HEPI 上。

通过世界理解来协调

Alignment Through World Understanding

通过世界理解进行调整最近的报告表明,当提供足够强大的网络工具时,OpenAI 和 Anthropic 开发的高级人工智能代理可以逃脱其评估沙箱并与现实世界系统交互。Tommaso DorigoFri,07/31/2026 - 06:07类别技术

本月与 Tony Anscombe 一起安全 - 2026 年 7 月版

This month in security with Tony Anscombe – July 2026 edition

OpenAI 模型变得流氓、第一个记录在案的代理勒索软件操作以及新兴的人工智能驱动的供应链威胁,为 7 月份的总结做好了准备

人工智能攻击:制造商失去控制了吗?

AI Attacks: Have Manufacturers Lost Control?

在 OpenAI 模型花了几天时间试图对另一家 AI 公司的保障措施造成严重破坏后,Anthropic 也不得不承认它暂时失去了对局势的控制。

众议院金融服务委员会报告标志着预防诈骗方面取得了重大进展并呼吁采取行动

House Financial Services Committee Report Marks Major Progress—and Call to Action—on Scam Prevention

众议院金融服务委员会工作人员借鉴 Aspen FSP 的研究成果,发布了一份关于预防诈骗的新报告。以下是我们如何将这一势头转化为行动。众议院金融服务委员会发布的报告标志着诈骗预防方面取得了重大进展并呼吁采取行动,该报告首先发表在阿斯彭研究所上。

OpenAI 的模型自主攻击了一家科技初创公司。它标志着网络安全的巨大转变

OpenAI’s models autonomously hacked a tech startup. It signals a seismic shift in cybersecurity

Elise Racine / Game of Pixels x Toy Models / 已获得 CC-BY 4.0 许可 作者:Hussein Abbass,新南威尔士州 上周,由 OpenAI 先进人工智能 (AI) 模型驱动的自主代理在一次安全测试中失控,入侵了价值数十亿美元的科技初创公司 Hugging Face。该代理不仅仅利用了 Hugging Face 系统中的漏洞 [...]

一个 OpenAI 模型逃离沙箱并闯入另一家公司进行测试作弊

An OpenAI Model Escaped Its Sandbox and Broke Into Another Company to Cheat on a Test

更深层次的问题是,太多的政策制定者仍在为 ChatGPT-3.5 聊天机器人世界立法,预测下一个代币,而不是为自主思考和行动以不懈地、创造性地实现其目标的代理立法。在这一差距缩小之前,我们将继续通过人工智能治理即兴发挥,一次一个事件。《一个 OpenAI 模型逃离沙盒并闯入另一家公司以在测试中作弊》一文首先出现在美国企业研究所 - AEI 上。

Sam Altman 在 OpenAI 上市前向市场出售奇点

Сэм Альтман продаёт сингулярность рынку прямо перед выходом OpenAI на биржу

当神经网络打破了 Hugging Face 的防御时,Altman 庆祝了未来。