解释性关键词检索结果

了解具有可解释性的注释器安全策略

Understanding Annotator Safety Policy with Interpretability

安全策略定义了安全和不安全的人工智能输出的构成,指导数据注释和模型开发。然而,注释分歧普遍存在,可能源于多种原因,例如操作失败(注释者误解或错误执行任务)、政策模糊性(政策措辞留有解释空间)或价值多元化(不同注释者对安全持有不同观点)。区分这些来源很重要。例如,运营失败需要质量控制,模糊需要政策澄清,多元化需要深思熟虑……

谄媚人工智能的社会校准——回应 |科学

Social calibration of sycophantic AI—Response | Science

我们感谢孟针对我们的研究结果阐明了重要的方法论和解释性问题。适当的人类基线取决于人工智能 (AI) 的预期社会角色。在现实世界中,人工智能模型被认为具有多种用途,例如顾问、中立的外部意见、编辑和助理 (1, 2)。这些角色对达成一致、验证或纠正反馈的频率有不同的期望。更复杂的是,用户通常认为单个 AI 系统可以履行多个角色 (3, 4)。由于人工智能社会角色的模糊性,任何单一的人类基线都是不完美的比较点。我们使用的基准——来自与当前冲突或场景没有个人利害关系的第三方人类的判断——探索了一个常见且具有社会意义的期望:人工智能系统——尽管经常被视为外部、中立和客观的信息提供者 (5-7)——是否会

社区项目资金/国会指导支出:预计 2022-2024 财年大部分资金将有义务

Community Project Funding/Congressionally Directed Spending: Most Fiscal Year 2022-2024 Funds Are Estimated to Be Obligated

GAO 的发现 GAO 估计,截至 2024 财年(GAO 开始审查时最近完成的财年)2022、2023 和 2024 财年(财年)指定用于社区项目资助/国会指导支出 (CPF/CDS) 项目的 390 亿美元拨款中,各机构记录了约 61% 的债务。 GAO 还估计,截至 2024 财年末,约 16% 的资金已支出。见下图。 GAO 估计,由于受助者拒绝提供资金或未提交所需文件等原因,约 1% 的 2022-2024 财年项目无法取得进展。截至 2024 年 9 月 30 日,2022-2024 财年社区项目资金/国会指导支出资金的预计承担和支出金额和百分比注:有关更多详细信息,包括估计的置信

MemoryLLM:用于 Transformer 的即插即用可解释前馈存储器

MemoryLLM: Plug-n-Play Interpretable Feed-Forward Memory for Transformers

了解变压器组件在法学硕士中的工作原理非常重要,因为它是人工智能最新技术进步的核心。在这项工作中,我们重新审视了与前馈模块(FFN)的可解释性相关的挑战,并提出了 MemoryLLM,其旨在将 FFN 与自注意力解耦,并使我们能够将解耦的 FFN 作为上下文无关的 token-wise 神经检索记忆来研究。详细地,我们研究了输入标记如何访问 FFN 参数内的内存位置以及 FFN 内存在不同下游任务中的重要性。 MemoryLLM 实现...

Inscribe 如何使用 Amazon Bedrock 在几秒钟内阻止文档欺诈

How Inscribe uses Amazon Bedrock to stop document fraud in seconds

在本文中,您将了解 Inscribe 如何使用 Amazon Bedrock 开发代理 AI 系统,以专业欺诈分析师的方式跨文档进行推理。借助这一新的代理 AI 系统,Inscribe 现在可以在 90 秒内检测到被篡改、伪造和 AI 生成的财务文档。这比传统的人工审核提高了 20 倍,同时保持了金融服务法规所要求的准确性和可解释性。

IEEE 人工智能汇刊,第 7 卷,第 7 期,2026 年 7 月

IEEE Transactions on Artificial Intelligence, Volume 7, Issue 7, July 2026

1) 因果关系和深度生成模型中的新兴协同作用:调查作者:G. Zhou,S. Xie,G. -Y。郝,陈,B.黄,X.徐,C.王,L.朱,L.姚,K.张页数:3634 - 36522)扩散模型可解释性的方法:系统综述作者:T. Lakhani,J. Wu,Y. -K。 Lai, Z. Ji页数:3653 - 36703) 人工智能和大脑连接如何为耐药性癫痫的结果预测提供信息作者:E. Paolini, G. Menegaz, E. Tamilia, S. F. Storti页数:3671 - 36874) 从奖励角度看 LLM 调整进展的调查设计作者:M. Ji, Y. Wu, Z. Wu,

美国参议院维持重要的 DDG(X) 下一代驱逐舰计划,以对抗日益崛起的中文统治地位

U.S. Senate Sustains Important DDG(X) Subsequent Era Destroyer Program to Counter Rising Chinese language Floor Dominance

美国参议院武装供应商委员会已指示海军继续发展 DDG(X) 后续技术驱逐舰计划,该委员会的 2027 财年 12 个月全国保护覆盖法案草案的解释性报告指出,随着阿利伯克级驱逐舰的旧型号开始逐步退役,这些舰艇可能希望在 2030 年代投入使用。将 DDG(X) 与新的 BBG(X) 计划进行对比,该计划旨在为海军提供数量大数倍的核动力战列舰,该报指出:“美国参议院维持重要的 DDG(X) 下一代驱逐舰计划,以对抗崛起的中国势力主导地位的初步单位首先出现在《特种部队新闻》上。