协作感知允许在多个代理(例如车辆和基础)之间共享信息,以通过交流和融合来获得对环境的全面看法。当前对多机构协作感知系统的研究通常会构成理想的沟通和感知环境,并忽略了现实世界噪声的效果,例如姿势噪声,运动模糊和感知噪声。为了解决这一差距,在本文中,我们提出了一种新颖的运动感知robus-Busban通信网络(MRCNET),可减轻噪声干扰,并实现准确且强大的协作感知。MRCNET由两个主要组成部分组成:多尺度稳健融合(MRF)通过驱动跨语义的多尺度增强的聚集到不同尺度的融合特征,而运动增强机制(MEM)捕获运动上下文,以补偿动作对物体引起的信息,从而解决了姿势噪声。对流行的协作3D对象检测数据集的实验结果表明,在噪声方案中,MRCNET优于使用较少的带宽感知性能的噪声方案。我们的代码将在https://github.com/indigochildren/collaborative-ception-mrcnet上进行重新释放。
2021 年 12 月 31 日——全动态视频 (FMV) 中的人工智能用于各种运营环境中的决策支持和业务关键型工作流程的自动化。
版权所有 © 2023 知识、创新与企业会议 版权所有 © 2023 个人作者* 保留所有权利。未经出版商书面许可,不得以任何形式或任何方式(电子、机械、影印、录音或其他方式)复制、存储在检索系统中或传播本出版物的任何部分。首次出版于 2023 年 由 KIE Conference 在英国伦敦出版 由 Corporate Document Services(英国英格兰利兹)在英国印刷和装订 如需许可请求,请通过以下电子邮件地址写信给出版商: 电子邮件:Kieteam@kiecon.org https://kiecon.org/creativity-books/ ISBN 978-1-85924-261-2 创造力书籍卷中的其他标题 卷 IX:庆祝巨人和开拓者:创造力研究和相关领域名人录 A-Z(2021 年) 卷 VIII:70 年的创造力研究:JP Guildford 的角色和当今的焦点(2020 年) 卷 VII:纪念当代现代创造力之父 E. Paul Torrance 诞辰 105 周年(2019 年) 卷 VI:STEM 教育中的创造力和创新(2018 年) 卷 V:创造力、创新和幸福感 (2017) 第 IV 卷:艺术、科学和技术中的创造力 (2016) 第 III 卷:KIE 创造力手册 (2015) 第 II 卷:商业中的创造力 (2014) 第 I 卷:创造力:过程、产品、个性、环境和技术 (2013) 建议章节引用(示例):Kaufman, J. C. & Zheng, M. (2023)。创造力与未来:技术、全球化和善,Reisman, F.(编辑),(第321-325 页)伦敦:KIE 出版物。可在线获取:https://kiecon.org/creativity-books/ [或插入您的大学存储库网址] 创造力书籍卷 KIE 出版物
我们使用2D扩散模型引入了多视图祖传采样(MAS),这是一种3D运动生成的方法,这些方法是根据从野外视频中获得的动作进行训练的。因此,MAS为以前探索了3D数据而稀缺且难以收集的机会为令人兴奋和多样化的运动领域打开了机会。MAS通过同时降低多个2D运动序列来起作用,代表了同一3D运动的不同视图。它通过将单个世代组合到统一的3D序列中,并将其投影回原始视图,从而确保每个扩散步骤中所有视图的共识。我们在2D姿势数据上展示了MAS,从描述了演习篮球运动的视频中获取的数据,节奏的体操在带有球设备的节奏和赛马。在这些域中的每个域中,3D运动捕获都很艰难,但是,MAS生成了多样化和现实的3D序列。不喜欢分数蒸馏方法,该方法通过反复应用小固定来优化每个样品,我们的方法使用了为扩散框架构建的采样过程。正如我们所证明的那样,MAS避免了常见的措施,例如室外采样和模式折叠。https://guytevet.github.io/mas-page/
我们专注于一项非常具有挑战性的任务:在夜间动态场景时进行成像。大多数以前的方法都依赖于常规RGB摄像机的低光增强。,他们不可避免地会在夜间长时间的长时间和动作场景的动作模糊之间面临困境。事件摄像机对动态变化的反应,其时间分辨率较高(微秒)和较高的动态范围(120dB),提供了替代解决方案。在这项工作中,我们使用活动摄像头提出了一种新颖的夜间动态成像方法。具体来说,我们发现夜间的事件表现出时间段落的特征和空间非平稳分布。conse-我们提出了一个夜间活动重建网络(NER-NET),主要包括可学习的事件时间戳校准模块(LETC),以使临时尾随事件和非均匀照明式落后事件保持一致,以稳定事件的spatiotalmorporal分布。此外,我们通过同轴成像系统构建了配对的真实低光事件数据集(RLED),这包括空间和时间对齐的图像GTS和低光事件的64,200个。广泛的实验表明,在视觉质量和泛化能力方面,所提出的方法优于最先进的方法。
[1]可根据旋转不变性的最小值RNA结构基序的可扩展且可解释的识别,撰写的,Zhou,Malik,Tang,Mathews和Huang。重新梳理202 5。预印本:https://arxiv.org/abs/2402.17206。[2]通过竞争对手结构的产生和结构分解,Zhou,Tang,Mathews和Huang通过竞争结构的产生和结构分解识别。RECOMB 2024,LNCS 14758的RECOMB会议记录,Springer。https://arxiv.org/abs/2311.08339 [3] RNA设计通过structure-ware Multi-Frontier合奏优化,作者:Zhou,Dai,Li,Li,Ward,Mathews和Huang。ISMB 2023的会议记录;生物信息学,39(supp。 1)。 https://doi.org/10.1093/bioinformatics/btad252ISMB 2023的会议记录;生物信息学,39(supp。1)。https://doi.org/10.1093/bioinformatics/btad252
由于其广泛的应用范围,从文本描述中产生人类动作已引起了越来越多的研究兴趣。但是,只有少数作品将人类场景的互动与文本条件一起考虑,这对于视觉和物理现实主义至关重要。本文提出了在3D门场景中产生人类动作的任务,鉴于人类习惯的文本描述。由于文本,场景和运动的多种形式性质以及对空间推理的需求,此任务提出了挑战。为了应对这些挑战,我们提出了一种新方法,将复杂的概率分解为两个更可管理的子问题:(1)目标对象的语言接地和(2)以对象为中心的信息产生。对于目标对象的语言基础,我们利用大型语言模型的力量。对于运动生成,我们设计了一个以对象为中心的场景代表生成模型,以专注于目标对象,从而降低场景的复杂性并促进人类运动与对象之间关系的建模。实验证明了与基准相比,我们的方法的更好运动质量并验证了我们的设计选择。代码将在链接上可用。
时空卷积通常无法学习视频中的运动动态,因此需要一种有效的运动表示来理解自然界中的视频。在本文中,我们提出了一种基于时空自相似性(STSS)的丰富而鲁棒的运动表示。给定一系列帧,STSS 将每个局部区域表示为与空间和时间中邻居的相似性。通过将外观特征转换为关系值,它使学习者能够更好地识别空间和时间中的结构模式。我们利用整个 STSS,让我们的模型学习从中提取有效的运动表示。我们所提出的神经块称为 SELFY,可以轻松插入神经架构中并进行端到端训练,无需额外监督。通过在空间和时间上具有足够的邻域体积,它可以有效捕捉视频中的长期交互和快速运动,从而实现鲁棒的动作识别。我们的实验分析表明,该方法优于以前的运动建模方法,并且与直接卷积的时空特征互补。在标准动作识别基准 Something-Something-V1 & V2、Diving-48 和 FineGym 上,该方法取得了最佳效果。
摘要 - 金属制造过程的未来,例如激光切割,焊接和添加剂制造,应依赖于行业4.0支头的智能系统。这样的数字创新确实正在推动机械制造商进行深刻的转变。是根据针对特定过程设计和优化的定制机器,雄心勃勃是利用开放性和大量的工业机器人可用性,以提高多流程实现的灵活性和可重新配置。挑战在于,机械构建者将自己转变为高知名度专业的过程驱动的机器人集成器,能够用智能传感和认知方面的过程控制器杠杆优化机器人运动。这项工作描述了BLM集团和Politecnico di Milano的多年合作,在CNR的支持下,重点是部署完整的机器人工作站,其特征是机器人控制和运动计划与制造过程的完整整合。索引术语 - 指导的能量沉积,激光金属拆卸,添加剂制造的设计,CAD/CAM
该动议指示洛杉矶警察局、路灯局和洛杉矶交通部开始研究安装 ALPR 摄像头的位置和方法,以最好地协助洛杉矶警察局在整个第 12 区开展犯罪减少工作。自动车牌阅读器可以帮助缩小与犯罪有关的车辆的搜索范围,让执法机构能够看到特定街区或区域进出的交通行为模式。该动议将拨款 500,000.00 美元用于购买、安装和维护摄像头。
