摘要 知识密集型任务对机器学习 (ML) 技术提出了重大挑战。常用的方法,例如大型语言模型 (LLM),在应用于此类任务时往往会表现出局限性。尽管如此,人们已经做出了显著的努力来缓解这些挑战,重点是通过知识图谱 (KG) 来增强 LLM。虽然 KG 在表示知识方面具有许多优势,但它们的开发成本可能会阻碍广泛的研究和应用。为了解决这一限制,我们引入了一个框架,用于使用完善的通用 KG 来丰富小规模领域特定知识图谱的嵌入。采用我们的方法,当链接到大量通用 KG 时,适度的领域特定 KG 可以从下游任务的性能提升中受益。实验评估表明性能显着增强,Hits @ 10 指标最高可提高 44%。这个相对未被探索的研究方向可以催化知识图谱更频繁地融入知识密集型任务中,从而产生更稳健、更可靠的机器学习实现,这比普遍存在的 LLM 解决方案更少产生幻觉。
对比语言图像预训练 (CLIP) 编码器已被证明对从分类和检测到字幕和图像处理等一系列视觉任务有益。我们研究了 CLIP 视觉主干对 Embodied AI 任务的有效性。我们构建了非常简单的基线,称为 EmbCLIP,没有任务特定的架构、归纳偏差(例如使用语义图)、训练期间的辅助任务或深度图——但我们发现我们改进的基线在一系列任务和模拟器中表现非常出色。EmbCLIP 在 RoboTHOR ObjectNav 排行榜上以 20 分(成功率)的巨大优势名列前茅。它在 iTHOR 1-Phase Rearrangement 排行榜上名列前茅,击败了采用主动神经映射的第二佳提交作品,并且 % Fixed Strict 指标增加了一倍多(0.08 到 0.17)。它还击败了 2021 年 Habitat ObjectNav 挑战赛的获胜者,该挑战赛采用了辅助任务、深度图和人工演示,以及 2019 年 Habitat PointNav 挑战赛的获胜者。我们评估了 CLIP 的视觉表示在捕获输入观察的语义信息方面的能力——这些原语对于导航繁重的具身任务很有用——并发现 CLIP 的表示比 ImageNet 预训练的主干更有效地编码了这些原语。最后,我们扩展了我们的一个基线,生成了一个能够进行零样本物体导航的代理,它可以导航到训练期间未用作目标的物体。我们的代码和模型可以在 https://github.com/allenai/embodied-clip 获得。
最新的表示学习研究表明,层次数据将自己带入双曲线空间中的低维和高度信息的表示。但是,即使双曲线嵌入在图像识别方面也收集了,它们的优化也容易出现数值障碍。此外,与传统的Eu-Clidean特征相比,尚不清楚哪种应用将受益于双曲线的隐性偏见最大。在本文中,我们专注于原型双曲神经网络。尤其是,双曲线嵌入的趋势会在高维度收敛到庞加尔e球的边界,并且对这对几乎没有的分类具有影响。我们表明,在常见的双曲半径上获得双曲线嵌入的最佳射击效果。与先前的基准结果相反,我们证明了配备有欧几里德指标的固定radius编码器可以实现更好的性能,而与嵌入式维度无关。
多个实例学习(MIL)是计算病理学中最广泛使用的框架,包括分型,诊断,预后等等。但是,iS-iSting MIL范式通常需要脱机实例提取器,例如预训练的重新网络或Foun-Dation模型。这种方法缺乏在特定下游任务中进行微调进行微调的能力,从而限制了其适应性和性能。为了解决此问题,我们提出了一个重新安装的区域变压器(R 2 T),用于在线重新安装实例功能,该功能可以限制精细元素的本地功能并在不同地区建立联系。与现有的作品不同,该作品专注于预训练强大的功能提取器或设计复杂的实例聚合器,r 2 t量身定制为在线重新设计实例功能。它是一种便携式模块,可以无缝集成到主流MIL模型中。对常见的综合病理学任务的广泛实验结果验证:1)功能重新嵌入基于Resnet-50特征的MIL模型的性能到基础模型模型的水平,并进一步增强了基础模型特征的性能; 2)r 2 t可以对各种MIL模型引入更大的性能改进; 3)R 2 T-MIL,作为R 2 T-增强的AB-MIL,以大幅度优于其他最新方法。该代码可在以下网址提供:https://github.com/dearcaat/rrt-mil。
在KHI于2024年5月14日举办的一次召集期间收集了有关指南的反馈,标题为“研究中的居中公平:制定实践策略和确定考虑因素”,以及通过事后调查。召集包括来自堪萨斯州各地的约50名利益相关者,他们审查了这些策略并提供了有价值的反馈,后来又将其纳入了指南。该活动的特色是演讲者EusebioDíaz,M.A。,卫生前进基金会策略,学习与沟通副总裁,来自亚利桑那州立大学的香农·波特略(Shannon Portillo)博士,以及密苏里州肯尼亚大学的M.S.C.R. Bridgette L. Jones,M.S.C.R.。演讲者讨论了研究中的当前公平状态,应对挑战并探索未来的机会。
分散的可再生能源系统(DRES)将可再生能源与能源有效的建筑技术整合在一起,并代表了可持续建筑环境的重要工具。鉴于其技术复杂性,DRE还包括全面的监测系统,可提供重要的机会来优化能源流量并提高能量效率。由于这些原因,研究开发了一系列自动化优化模型和算法,例如关联规则挖掘或故障检测诊断。迄今为止,在这些高级和自动化技术的哪些条件下仍不清楚,最好将其集成以优化DRE。本文提出了一个互补的行业观点,借鉴了瑞士最先进的DRE之一的优化活动的深入案例研究。在五年中,某些优化措施有助于将能源消耗降低55-60%。然而,其他措施的优化能力尚不清楚。案例研究表明,尽管技术方面引起了优化的潜力,但组织方面已经阻止了科学算法的应用,或者至少延迟了科学算法的应用,因此阻碍了这种优化潜力的实现。这些发现呼吁研究人员更好地将技术和运营方面更好地整合到能源系统的优化中,并为决策者,投资者和能源计划者提供重要建议。2021 Elsevier B.V.保留所有权利。
信息检索是一个不断发展且至关重要的搜索域。对高质量人类运动数据的大量需求,尤其是在在线获取中,导致人类运动研究工作的激增。先前的作品主要集中在双模式学习上,例如文本和运动任务,但是很少探索三模式学习。直觉上,额外的引入方式可以丰富模型的应用程序方案,更重要的是,对额外模式的适当选择也可以充当中介,并增强其他两个不同方式之间的对齐方式。在这项工作中,我们介绍了Lavimo(语言视频 - 动作对齐),这是一个三模式学习的新型框架,将以人为中心的视频整合为一种额外的方式,从而可以在文本和运动之间弥合差距。更重要的是,我们的方法利用了一种专门设计的注意机制来增强文本,视频和运动方式之间的一致性和协同作用。经验,我们对HumanML3D和Kit-ML数据集的结果表明,Lavimo在各种与运动相关的跨模式检索任务中实现了最先进的表现,包括文本到动作,动作到运动,视频,视频到视频,动作和动态。我们的项目网页可以在https://lavimo2023.github.io/lavimo/中找到。
本文通过利用大型预训练模型来探讨合成数据的潜力,尤其是在面对分布变化时。al-尽管生成模型的最新进展已经阐明了跨分布数据发生的几项先前的作品,但它们需要模型调整和复杂的设置。为了绕过这些缺点,我们介绍了主要的g a a a a a a a a embeddings(doge),这是一个跨分布的插件语义数据augpection框架,几乎没有射击设置。我们的方法以潜在形式提取源和所需数据分布之间的差异,然后引导生成过程,以补充无数多种合成样本的训练集。我们的评估是在几个射击范式下进行亚种群偏移和三个领域适应方案进行的,表明我们的多功能方法改善了各个任务的性能,需要进行动手干预或复杂的调整。Doge铺平了毫不费力地生成遵循测试分布的现实,可转让的合成数据集的道路,从而加强了下游任务模型的现实世界效率。
图2。使用BERT衍生特征与(a)预测和(b)材料属性分类的模型性能比较模型性能。SMA,Ti合金和HEA的10倍MAE图与广泛的平行测试中所选特征数量(1-8)的函数相同。蓝线使用传统的经验特征(例如电负性,原子半径)表示模型性能,而红线表示BERT衍生的材料特征。检查的特性包括相变温度(MP,AP),转化焓(ΔH),屈服强度(σs),终极拉伸强度(σb),Vickers硬度(VH)和伸长率(EL)。Classification tasks include binary classification of Solid Solution (SS) vs. Non-Solid Solution (NSS), ternary classification of phase forms (Face-Centered Cubic (FCC), Body-Centered Cubic (BCC), and FCC-BCC mixed), and quaternary classification of SMA phases (B19'-B2, B19'-B19-B2, B19'-R-B2, B19-B2, and R-B2)。bert衍生的特征始终在几乎所有属性和特征数量上产生较低的预测误差,从而突出了它们捕获合金组成和属性之间内在关系的卓越能力。阴影区域代表跨平行测试的标准偏差。
