EFRAG 的使命是通过在企业报告领域发展和推广欧洲观点,服务于欧洲公众在财务和可持续性报告方面的利益。EFRAG 以企业报告为基础并为其进步做出贡献。在其可持续性报告活动中,EFRAG 以在严格正当程序下制定的欧洲可持续性报告标准 (ESRS) 草案的形式向欧盟委员会提供技术建议,并支持 ESRS 的有效实施。EFRAG 在整个标准制定过程中寻求所有利益相关者的意见并获得有关特定欧洲情况的证据。其合法性建立在卓越、透明、治理、正当程序、公共问责和思想领导力的基础上。这使 EFRAG 能够令人信服、清晰和一致地发言,并被公认为企业报告中的欧洲声音和企业报告全球进步的贡献者。
本文已由Efrag秘书处编写,在Efrag SRB的一次公开会议上进行讨论。本文构成了潜在EFRAG位置发展的早期阶段的一部分。因此,本文不代表Efrag的官方观点或Efrag SRB或Efrag SR TEG的任何个人。该论文可供使用,使公众能够遵循会议中的讨论。暂定决定是在公开场合做出的,并在EFRAG更新中进行了报告。eFrag职位作为评论信,讨论或职位论文或在这种情况下被认为适当的任何其他形式发表。已经起草了每个解释的内容,以提供特定技术问题的答案,并且不能通过类比直接扩展到其他事实模式。
算法追索性是一个利用反事实解释的过程,而不仅仅是理解系统产生给定的分类的原因,还可以为用户提供他们可以采取的行动来改变其预测结果。现有的计算此类干预措施的方法(称为追索权)确定了一组满足某些Desiderata的点 - e.g。对基本因果图的干预,最大程度地减少成本函数等。需要对基本模型结构的广泛了解,这在几个领域中通常是不切实际的信息。我们提出了一个数据驱动和模型不合时宜的框架来计算反事实解释。我们介绍了步骤,这是一种计算上有效的方法,它沿数据歧管沿着数据歧管递增步骤,该步骤将用户指导用户达到所需的结果。我们表明,该步骤独特地满足了一组理想的公理。此外,通过彻底的经验和理论调查,我们表明,在沿着重要指标沿着重要指标的流行方法胜过可证明的鲁棒性和隐私保证。
摘要。人们期待人工智能能改善人类在各个领域的决策能力,尤其是高风险、困难的任务。然而,人类对人工智能建议的依赖往往是不恰当的。解决这个问题的常用方法是向决策者提供有关人工智能输出的解释,但迄今为止结果好坏参半。人们往往不清楚何时可以适当地依赖人工智能,何时解释可以提供帮助。在这项工作中,我们进行了一项实验室实验(N = 34),以研究人类对(可解释的)人工智能的依赖程度如何取决于不同决策难度引起的心理负荷。我们使用脑电图(Emotiv Epoc Flex 头罩,32 个湿电极)来更直接地测量参与者的心理负荷,而不是自我评估。我们发现,决策的难度(由诱发的心理负荷表明)强烈影响参与者适当依赖人工智能的能力,这通过相对自力更生、相对人工智能依赖以及有无人工智能的决策准确性来评估。虽然依赖对于低脑力负荷决策是合适的,但参与者在高脑力负荷决策中容易过度依赖。在这两种情况下,解释都没有显著影响。我们的结果表明,应该探索常见的“推荐和解释”方法的替代方案,以帮助人类在具有挑战性的任务中做出决策。
本文已由Efrag秘书处编写,在Efrag SRB的一次公开会议上进行讨论。本文构成了潜在EFRAG位置发展的早期阶段的一部分。因此,本文不代表Efrag的官方观点或Efrag SRB或Efrag Sr Teg的任何个人。该论文可供使用,使公众能够遵循会议中的讨论。暂定决定是在公开场合做出的,并在EFRAG更新中进行了报告。eFrag职位作为评论信,讨论或职位论文或在这种情况下被认为适当的任何其他形式发表。已经起草了每个解释的内容,以提供特定技术问题的答案,并且不能通过类比直接扩展到其他事实模式。
背景:量子计算是一种快速发展的新编程范式,它为算法的设计和实现带来了重大变化。理解量子算法需要物理和数学知识,这对软件开发人员来说可能具有挑战性。目的:在这项工作中,我们首次分析了 LLM 如何支持开发人员理解量子代码。方法:我们使用两种不同的人工编写提示风格,对七种最先进的量子算法,通过实证分析和比较三种广泛采用的 LLM(Gpt3.5、Llama2 和 Tinyllama)提供的解释质量。我们还分析了 LLM 解释在多轮中的一致性以及 LLM 如何改进现有的量子算法描述。结果:Llama2 从头开始提供最高质量的解释,而 Gpt3.5 成为最适合改进现有解释的 LLM。此外,我们表明,在提示中添加少量上下文可以显着提高解释的质量。最后,我们观察了解释在多轮中在质量和句法上如何保持一致。结论:这项工作突出了有希望的结果,并为未来在量子代码解释的 LLM 领域的研究提出了挑战。未来的工作包括通过快速优化和解析量子代码解释来改进方法,以及对解释的质量进行系统评估。
摘要:背景:创建模型来区分自我报告的心理工作量感知具有挑战性,需要机器学习来识别脑电图信号中的特征。脑电图频带比率量化了人类活动,但对心理工作量评估的研究有限。本研究评估了使用 theta-to-alpha 和 alpha-to-theta 脑电图频带比率特征来区分人类自我报告的心理工作量感知。方法:在本研究中,分析了 48 名参与者在休息和任务密集型活动时的脑电图数据。使用不同的脑电图通道簇和频带比率开发了多个心理工作量指标。使用 ANOVA 的 F 分数和 PowerSHAP 提取统计特征。同时,使用逻辑回归、梯度提升和随机森林等技术建立和测试模型。然后用 Shapley 加法解释来解释这些模型。结果:根据结果,使用 PowerSHAP 选择特征可以提高模型性能,在三个心理工作量指数中表现出超过 90% 的准确率。相比之下,用于模型构建的统计技术表明所有心理工作量指数的结果都较差。此外,使用 Shapley 值来评估特征对模型输出的贡献,可以注意到,ANOVA F 分数和 PowerSHAP 测量中重要性较低的特征在确定模型输出方面发挥了最重要的作用。结论:使用具有 Shapley 值的模型可以降低数据复杂性并改进对感知人类心理工作量的更好判别模型的训练。但是,由于选择过程中特征的重要性及其对模型输出的实际影响有所不同,因此结果有时可能不明确。
本文已由Efrag秘书处准备在Efrag Sr Teg的一次公开会议上进行讨论。本文构成了潜在EFRAG位置发展的早期阶段的一部分。因此,本文不代表Efrag的官方观点或Efrag SRB或Efrag Sr Teg的任何个人。该论文可供使用,使公众能够遵循会议中的讨论。暂定决定是在公开场合做出的,并在EFRAG更新中进行了报告。eFrag职位作为评论信,讨论或职位论文或在这种情况下被认为适当的任何其他形式发表。已经起草了每个解释的内容,以提供特定技术问题的答案,并且不能通过类比直接扩展到其他事实模式。
摘要:许多机器人学习方法首先从一组人类示范中推断出奖励功能。要学习良好的奖励,有必要在确定应如何使用这些功能来计算奖励之前确定环境的哪些功能。联合特征和奖励学习的端到端方法(例如,使用深网或程序合成技术)通常会产生对虚假国家敏感的脆弱奖励功能。相比之下,人类通常可以通过将强大的先验纳入少量的示范中,从而可以从少量的示范中学习,以了解示威的特征可能对感兴趣的任务有意义。在从新演示中学习时,我们如何构建利用这种背景知识的机器人?本文介绍了一种名为藻类的方法(来自[对比]解释的自适应语言引导的处理),该方法在使用语言模型来迭代地识别所需的人类卑鄙的特征之间交替,然后识别出所需的人类卑鄙的特征,然后识别出标准的逆增强学习技术,将权重分配给这些特征。在各种模拟和现实世界机器人环境中进行的实验表明,藻类仅使用少量的示例来学习在可解释的特征上定义的可通用奖励功能。重要的是,藻类可以识别何时缺少功能,然后提取并定义这些功能而无需任何人类输入,从而可以快速有效地获得对用户行为的丰富表示形式。
摘要 机器学习 (ML) 越来越多地融入各个领域的决策制定,引发了人们对道德、合法性、可解释性和安全性的担忧,凸显了人类监督的必要性。作为回应,可解释人工智能 (XAI) 应运而生,它通过提供对 ML 模型决策的洞察,并让人类了解底层逻辑,从而成为一种增强透明度的手段。尽管现有的 XAI 模型具有潜力,但通常缺乏实用性,无法提高人机性能,因为它们可能会引入过度依赖等问题。这强调了以人为本的 XAI 需要进一步研究,以提高当前 XAI 方法的可用性。值得注意的是,目前的大部分研究都集中在 XAI 与个体决策者之间的一对一互动上,忽视了现实世界场景中人类群体使用 XAI 进行集体决策协作的多对一关系的动态。在这项最新工作中,我们借鉴了以人为中心的XAI研究的当前成果,并讨论了如何将XAI设计过渡到群体AI交互。我们讨论了XAI从人机交互过渡到群体AI交互的四个潜在挑战。本文有助于推动以人为中心的XAI领域的发展,促进群体XAI交互的讨论,呼吁在该领域进一步研究。关键词 可解释AI,群体AI交互,交互设计
