我保证,据我所知,我的论文不侵犯任何人的版权,也不违反任何专有权利,并且我的论文中包含的任何想法、技术、引用或来自他人作品的任何其他材料(无论是否已发表)均已根据标准引用惯例完全承认。此外,如果我所包含的受版权保护的材料超出了《印度版权法》所规定的公平使用范围,我保证我已获得版权所有者的书面许可,可以将此类材料纳入我的论文中,并将此类版权许可的副本附在我们的附录中。
近年来,基于深度学习的目标检测取得了长足的进步。然而,由于域转移问题,将现成的检测器应用于看不见的域会导致性能大幅下降。为了解决这个问题,本文提出了一种新的由粗到细的特征自适应方法用于跨域目标检测。在粗粒度阶段,与文献中使用的粗糙的图像级或实例级特征对齐不同,采用注意机制提取前景区域,并通过在公共特征空间中多层对抗学习根据其边缘分布进行对齐。在细粒度阶段,我们通过最小化来自不同域但属于同一类别的全局原型的距离来进行前景的条件分布对齐。由于这种由粗到细的特征自适应,前景区域中的领域知识可以得到有效的迁移。在各种跨域检测场景中进行了大量的实验。结果是最先进的,证明了所提出方法的广泛适用性和有效性。
摘要 — 在癫痫监测中,由于脑电图伪影在幅度和频率上具有形态相似性,因此经常被误认为是癫痫发作,这使得癫痫发作检测系统容易受到更高的误报率的影响。在这项工作中,我们介绍了一种基于并行超低功耗 (PULP) 嵌入式平台上最少数量的脑电图通道的伪影检测算法的实现。分析基于 TUH 脑电图伪影语料库数据集,并重点关注颞电极。首先,我们使用自动机器学习框架在频域中提取最佳特征模型,在 4 个颞脑电图通道设置下实现了 93.95% 的准确率和 0.838 F1 得分。所实现的准确率水平比最先进的水平高出近 20%。然后,这些算法针对 PULP 平台进行并行化和优化,与最先进的低功耗伪影检测框架实现相比,能效提高了 5.21 倍。将此模型与低功耗癫痫发作检测算法相结合,可以在可穿戴外形尺寸和功率预算下使用 300 mAh 电池进行 300 小时的连续监测。这些结果为实现经济实惠、可穿戴、长期癫痫监测解决方案铺平了道路,该解决方案具有低假阳性率和高灵敏度,可满足患者和护理人员的要求。临床意义——所提出的 EEG 伪影检测框架可用于可穿戴 EEG 记录设备,结合基于 EEG 的癫痫发作检测算法,以提高癫痫发作检测场景的稳健性。索引词——医疗保健、时间序列分类、智能边缘计算、机器学习、深度学习
摘要:该项目旨在开发一个旨在在室内环境(例如购物中心,公交车站和电影院)操作的自主垃圾机器人。机器人的主要目标是在浏览空间并避免障碍的同时检测和收集垃圾项目。利用传感器和图像处理技术的组合,机器人可以识别垃圾对象,并调整其在不误认为障碍物的情况下将其捡起的路径。通过采用具有成本效益的硬件组件和简化算法,我们旨在创建一个实用的解决方案,以解决公共空间中的垃圾污染,这证明了机器人技术在环境可持续发展方面的潜力。关键字:Raspberry Pi,垃圾检测,对象识别,避免障碍物,节点MCU,机器人,Arduino IDE
在最近的研究中,已对开放式摄制对象检测任务进行了大量关注,旨在概括训练期间标记的类别的有限级别,并检测推理时任意类别名称所描述的对象。与常规对象检测相比,打开的词汇对象检测在很大程度上扩展了对象检测类别。但是,它依赖于计算图像区域与一组具有验证视觉和语言模型的任意类别名称之间的相似性。这意味着,尽管具有开放式的性质,但该任务仍然需要在推理阶段的预定义对象类别。这提出了一个问题:如果我们在推理中对对象类别没有确切的了解,该怎么办?在本文中,我们称之为新的设置为生成性开放式对象检测,这是一个更普遍和实际的问题。为了解决它,我们将对象检测形式为生成问题,并提出了一个名为generateu的简单框架,该框架可以检测密集的对象并以自由形式的方式生成其名称。尤其是,我们采用可变形的DETR作为区域促成生成器,其语言模型将视觉区域转换为对象名称。为了评估自由形式的对象划分任务,我们介绍了一种评估方法,旨在定量测量生成量的性能。广泛的实验表明我们的生成量强烈的零射击性能。代码可在以下网址获得:https://github.com/foundationvision/generateu。例如,在LVIS数据集上,我们的GenerateU在推理过程中属于类别名称,即类别名称无法看到类别名称,即使类别名称看不见类别名称,我们的GenerateU也可以与开放式唱机对象检测方法GLIP相当。
与基于卷积神经网络(CNN)相比,我们研究了基于变压器的行人检测模型较低性能的原因。CNN模型会产生密集的行人建议,单独完善每个建议,然后对其进行非最大抑制(NMS)的跟进,以产生稀疏的预测。在争论中,变压器模型每个地面真相(GT)行人盒选择一个建议,然后从中选择了正面的正态。所有其他建议,其中许多与选定的建议高度相似,都通过了负梯度。尽管这导致了稀疏的预测,从而消除了NM的需求,但在许多类似的建议中,任意选择,有效的训练和较低的行人检测准确性。为了减轻问题,我们建议基于Min-Cost-Flow的配方,而不是常用的Kuhn-Munkres匹配算法,并纳入了诸如每个地面真相盒的约束,并且与一个建议的提案相匹配,并且许多同样好的建议可以与单个地面真相盒相匹配。我们提出了基于匹配算法的第一个基于变压器的行人检测模型。广泛的实验表明,我们的方法达到了3个失误率(较低)3。7 /17。4 /21。8/8。3/2。0在Eurocity / tju-traffic / tju-校园 /城市专家 /加州理工学院数据集中,而4个。7/18。7/24。8/8。5/3。 1通过当前的sota。 代码可从https://ajayshastry08.github.io/flow_ matcher 获得。5/3。1通过当前的sota。代码可从https://ajayshastry08.github.io/flow_ matcher
这项研究介绍了一个先进的预测分析框架,用于早期发现糖尿病风险,旨在通过整合复杂的机器学习算法来增强主动的健康监测。该模型经过精心训练,以各种患者的健康指标,包括人口统计和临床变量,例如年龄,体重指数,血压和葡萄糖水平。通过确定数据中的微妙模式和相关性,该模型促进了对患有糖尿病高风险的个体的早期识别。这种早期检测能力可以及时进行临床干预,有可能减轻疾病的进展并优化患者管理策略。该研究强调了该模型的鲁棒性和可扩展性,突出了其在临床环境中部署的重要潜力,这是预防医疗基础设施的关键组成部分。
可穿戴机器人上肢矫形器 (ULO) 是辅助或增强用户上肢功能的有前途的工具。虽然这些设备的功能不断增加,但对用户控制可用自由度的意图的稳健和可靠检测仍然是一项重大挑战,也是接受的障碍。作为设备和用户之间的信息接口,意图检测策略 (IDS) 对整个设备的可用性具有至关重要的影响。然而,这方面及其对设备可用性的影响很少根据 ULO 的使用环境进行评估。进行了范围界定文献综述,以确定已通过人类参与者评估的应用于 ULO 的非侵入式 IDS,特别关注与功能和可用性相关的评估方法和发现及其在日常生活中特定使用环境的适用性。共确定了 93 项研究,描述了 29 种不同的 IDS,并根据四级分类方案进行了总结和分类。与所述 IDS 相关的主要用户输入信号是肌电图 (35.6%),其次是手动触发器,例如按钮、触摸屏或操纵杆 (16.7%),以及上肢节段的残余运动产生的等长力 (15.1%)。我们确定并讨论了 IDS 在特定使用环境中的优缺点,并强调了在选择最佳 IDS 时性能和复杂性之间的权衡。通过调查评估实践来研究 IDS 的可用性,纳入的研究表明,主要评估了与有效性或效率相关的客观和定量的可用性属性。此外,它强调了缺乏系统的方法来确定 IDS 的可用性是否足够高以适合用于日常生活应用。这项工作强调了针对用户和应用程序选择和评估用于 ULO 的非侵入式 IDS 的重要性。对于该领域的技术开发人员,它进一步提供了有关IDS的选择过程以及相应评估协议的设计的建议。
基于事件的传感是一种相对较新的成像模态,可实现低潜伏期,低功率,高时间分解和高动态范围采集。这些支持使其成为边缘应用和在高动态范围环境中的高度可取的传感器。截至今天,大多数基于事件的传感器都是单色的(灰度),在单个通道中捕获了Visi-ble上广泛光谱范围的光。在本文中,我们介绍了穆斯特朗事件并研究了它们的优势。尤其是我们在可见范围内和近红外范围内考虑多个频段,并探索与单色事件和用于面部检测任务的传统多光谱成像相比的潜力。我们进一步发布了第一个大型双峰面检测数据集,其中包含RGB视频及其模拟色彩事件,N-Mobiface和N-Youtubefaces,以及带有多光谱视频和事件的较小数据集,N-SpectralFace。与常规多频谱图像的早期融合相比,多阶段事件的早期融合可显着改善面部检测性能。此结果表明,相对于灰度等效物,多光谱事件比传统的多光谱图像具有相对有用的有关场景的信息。据我们所知,我们提出的方法是关于多光谱事件的首次探索性研究,特别是包括近红外数据。
我们对一项名为动力电池检测(PBD)的新任务进行了全面的研究,该任务旨在从 X 射线图像中定位密集的阴极和阳极板端点,以评估动力电池的质量。现有制造商通常依靠人眼观察来完成 PBD,这使得很难平衡检测的准确性和效率。为了解决这个问题并让更多人关注这个有意义的任务,我们首先精心收集了一个称为 X 射线 PBD 的数据集,该数据集包含从 5 家制造商的数千个动力电池中选择的 1,500 张不同的 X 射线图像,具有 7 种不同的视觉干扰。然后,我们提出了一种基于分割的新型 PBD 解决方案,称为多维协作网络(MDCNet)。借助线和计数预测器,可以在语义和细节方面改进点分割分支的表示。此外,我们设计了一种有效的距离自适应掩模生成策略,可以缓解由板分布密度不一致引起的视觉挑战,从而为 MDCNet 提供稳定的监督。无需任何花哨的修饰,我们基于分割的 MDCNet 始终优于其他各种角点检测、人群计数和基于一般/微小物体检测的解决方案,使其成为有助于促进 PBD 未来研究的强大基础。最后,我们分享了一些潜在的困难和未来研究的工作。源代码和数据集将在 X-ray PBD 上公开提供。
