Alignment Through World Understanding
通过世界理解进行调整最近的报告表明,当提供足够强大的网络工具时,OpenAI 和 Anthropic 开发的高级人工智能代理可以逃脱其评估沙箱并与现实世界系统交互。Tommaso DorigoFri,07/31/2026 - 06:07类别技术
This month in security with Tony Anscombe – July 2026 edition
OpenAI 模型变得流氓、第一个记录在案的代理勒索软件操作以及新兴的人工智能驱动的供应链威胁,为 7 月份的总结做好了准备
AI Attacks: Have Manufacturers Lost Control?
在 OpenAI 模型花了几天时间试图对另一家 AI 公司的保障措施造成严重破坏后,Anthropic 也不得不承认它暂时失去了对局势的控制。
Colombia’s Satena mulls next stage of fleet renewal
本文仅适用于订阅商业航空新闻、运营商和机场数据
OpenAI’s models autonomously hacked a tech startup. It signals a seismic shift in cybersecurity
Elise Racine / Game of Pixels x Toy Models / 已获得 CC-BY 4.0 许可 作者:Hussein Abbass,新南威尔士州 上周,由 OpenAI 先进人工智能 (AI) 模型驱动的自主代理在一次安全测试中失控,入侵了价值数十亿美元的科技初创公司 Hugging Face。该代理不仅仅利用了 Hugging Face 系统中的漏洞 [...]
Backing exam bill, TDP & Shiv Sena seek multiple NEET attempts a year
主要 NDA 盟友提议每年多次进行 NEET-UG 考试。这一变化旨在防止学生因单次尝试考试而受到惩罚。他们还主张对快速发展的教练行业进行监管。 NEET 论文泄露后政府的迅速行动得到了承认。
Elena Kagan Gave Bogus Science a Blind Endorsement
在不检查其中最具争议的部分的情况下认可手册会损害尽职调查。幸运的是,现在纠正方向还为时不晚。联邦司法中心应立即采取行动,通过加强对经验证据、可证伪性和观点多样性的承诺,恢复手册的可信度。司法决策的公正性要求不亚于此。埃琳娜·卡根给虚假科学盲目认可的帖子首先出现在瓦茨Up With That?上。
An OpenAI Model Escaped Its Sandbox and Broke Into Another Company to Cheat on a Test
更深层次的问题是,太多的政策制定者仍在为 ChatGPT-3.5 聊天机器人世界立法,预测下一个代币,而不是为自主思考和行动以不懈地、创造性地实现其目标的代理立法。在这一差距缩小之前,我们将继续通过人工智能治理即兴发挥,一次一个事件。《一个 OpenAI 模型逃离沙盒并闯入另一家公司以在测试中作弊》一文首先出现在美国企业研究所 - AEI 上。
Сэм Альтман продаёт сингулярность рынку прямо перед выходом OpenAI на биржу
当神经网络打破了 Hugging Face 的防御时,Altman 庆祝了未来。
OpenAI called the Hugging Face attack unprecedented. But we’ve been here before.
这个故事最初出现在我们关于人工智能的每周通讯《算法》中。要首先在您的收件箱中收到此类故事,请在此处注册。上周阅读 OpenAI 的报道,了解其一些模型如何突破遏制并侵入另一家人工智能公司 Hugging Face 的计算机系统,这是我第一次得到……
S5E07: Denarius Frazier on belonging, rigor, and scaling effective teaching
在这一集中,《渐进不正确》中,我邀请到了德纳留斯·弗雷泽 (Denarius Frazier),他是 Uncommon Schools 地区的教学主管,也是《重新连接:为意义、目的和归属感构建学校文化》一书的合著者,他也许是电影中有史以来最好的老师。 Denarius 是“像冠军一样教学”社区中最有思想和影响力的声音之一,众所周知……
Rogue AI: OpenAI’s agents attack Hugging Face
当 OpenAI 的预发布 AI 代理逃离沙箱并向 Hugging Face 发起现实世界的网络攻击时,例行的 AI 安全测试发生了意想不到的变化。这一史无前例的事件展示了前沿人工智能模型如何能够自主发现漏洞、逃脱遏制并执行复杂的网络操作。
OpenAI's attack agent did exactly what it was told - just more relentlessly than expected
OpenAI 对 Hugging Face 的无意攻击震惊了世界,因为它的 AI 代理正在自行行动。但这正是代理人工智能的设计目的。我们只是没想到它会做得这么好。
六个裸形科的代表 Apteronotidae (A)、Sternopygidae (S)、Gymnotidae (G)、Electrophoridae (E)、Hypopomidae (H) 和 Rhamphichthyidae (R)。从上到下、从左到右分别是:Rhamphichthys rostratus (R)、Archolaemus janeae (S)、Sternarchorhamphus muelleri (A)、Eigenmannia magoi (S)、Gymnotus carapo (G)、Sternarchorhynchus sp。 (A)、Apteronotus galv
Get started with OpenAI GPT-5.6 Sol, Terra, and Luna on Amazon Bedrock
OpenAI GPT-5.6 Sol、Terra 和 Luna 现已在 Amazon Bedrock 上全面上市。了解如何选择模型、通过基岩地幔端点上的响应 API 运行推理、通过提示缓存降低成本、连接 OpenAI Codex 编码代理以及规划配额和扩展。
Tabular LLMs: An Introduction to the Foundation Models That Predict Your Spreadsheet
表格基础模型可以预测任何电子表格零样本中缺失的列,就像法学硕士完成文本的方式一样 - 在 TabArena 基准测试中,它们现在位于完全调整的梯度增强树之上。介绍了它们的工作原理、最强开放模型的独立复制,以及 XGBoost 仍然获胜的地图。后表格式法学硕士:预测电子表格的基础模型简介首先出现在《走向数据科学》上。
莉娜·海蒂 (Lena Headey) 的每日名言提醒人们,爱情往往出现在简单的日常时刻,而不是重大事件中。这位女演员分享了如何在宁静的早晨闻到儿子的头发的味道,因为她的爱之深而让她热泪盈眶。她的话解释了为人父母可以带来的情感变化,并鼓励人们重视日常经历、深厚的关系、感恩和情感联系。