在最近的研究中,已对开放式摄制对象检测任务进行了大量关注,旨在概括训练期间标记的类别的有限级别,并检测推理时任意类别名称所描述的对象。与常规对象检测相比,打开的词汇对象检测在很大程度上扩展了对象检测类别。但是,它依赖于计算图像区域与一组具有验证视觉和语言模型的任意类别名称之间的相似性。这意味着,尽管具有开放式的性质,但该任务仍然需要在推理阶段的预定义对象类别。这提出了一个问题:如果我们在推理中对对象类别没有确切的了解,该怎么办?在本文中,我们称之为新的设置为生成性开放式对象检测,这是一个更普遍和实际的问题。为了解决它,我们将对象检测形式为生成问题,并提出了一个名为generateu的简单框架,该框架可以检测密集的对象并以自由形式的方式生成其名称。尤其是,我们采用可变形的DETR作为区域促成生成器,其语言模型将视觉区域转换为对象名称。为了评估自由形式的对象划分任务,我们介绍了一种评估方法,旨在定量测量生成量的性能。广泛的实验表明我们的生成量强烈的零射击性能。代码可在以下网址获得:https://github.com/foundationvision/generateu。例如,在LVIS数据集上,我们的GenerateU在推理过程中属于类别名称,即类别名称无法看到类别名称,即使类别名称看不见类别名称,我们的GenerateU也可以与开放式唱机对象检测方法GLIP相当。
近年来,基于深度学习的目标检测取得了长足的进步。然而,由于域转移问题,将现成的检测器应用于看不见的域会导致性能大幅下降。为了解决这个问题,本文提出了一种新的由粗到细的特征自适应方法用于跨域目标检测。在粗粒度阶段,与文献中使用的粗糙的图像级或实例级特征对齐不同,采用注意机制提取前景区域,并通过在公共特征空间中多层对抗学习根据其边缘分布进行对齐。在细粒度阶段,我们通过最小化来自不同域但属于同一类别的全局原型的距离来进行前景的条件分布对齐。由于这种由粗到细的特征自适应,前景区域中的领域知识可以得到有效的迁移。在各种跨域检测场景中进行了大量的实验。结果是最先进的,证明了所提出方法的广泛适用性和有效性。
许多基于机器学习的轴突追踪方法依赖于带有分割标签的图像数据集。这需要领域专家的手动注释,这需要大量劳动力,并且不适用于以细胞或亚细胞分辨率对半球或整个脑组织进行大规模脑映射。此外,保留轴突结构拓扑对于理解神经连接和大脑功能至关重要。自监督学习 (SSL) 是一种机器学习框架,允许模型在未注释的数据上学习辅助任务,以帮助完成监督目标任务。在这项工作中,我们提出了一种新颖的 SSL 辅助任务,即为面向拓扑的轴突分割和中心线检测的目标任务重建边缘检测器。我们使用小鼠大脑数据集对三个不同的 SSL 任务进行了 3D U-Nets 预训练:我们提出的任务、预测排列切片的顺序和玩魔方。然后,我们在不同的小鼠大脑数据集上评估了这些 U-Nets 和基线模型。在所有实验中,针对我们提出的任务进行预训练的 U-Net 分别将基线的分割、拓扑保留和中心线检测提高了 5.03%、4.65% 和 5.41%。相比之下,切片排列和魔方预训练的 U-Net 并没有比基线有持续的改进。
我保证,据我所知,我的论文不侵犯任何人的版权,也不违反任何专有权利,并且我的论文中包含的任何想法、技术、引用或来自他人作品的任何其他材料(无论是否已发表)均已根据标准引用惯例完全承认。此外,如果我所包含的受版权保护的材料超出了《印度版权法》所规定的公平使用范围,我保证我已获得版权所有者的书面许可,可以将此类材料纳入我的论文中,并将此类版权许可的副本附在我们的附录中。
摘要 — 在癫痫监测中,由于脑电图伪影在幅度和频率上具有形态相似性,因此经常被误认为是癫痫发作,这使得癫痫发作检测系统容易受到更高的误报率的影响。在这项工作中,我们介绍了一种基于并行超低功耗 (PULP) 嵌入式平台上最少数量的脑电图通道的伪影检测算法的实现。分析基于 TUH 脑电图伪影语料库数据集,并重点关注颞电极。首先,我们使用自动机器学习框架在频域中提取最佳特征模型,在 4 个颞脑电图通道设置下实现了 93.95% 的准确率和 0.838 F1 得分。所实现的准确率水平比最先进的水平高出近 20%。然后,这些算法针对 PULP 平台进行并行化和优化,与最先进的低功耗伪影检测框架实现相比,能效提高了 5.21 倍。将此模型与低功耗癫痫发作检测算法相结合,可以在可穿戴外形尺寸和功率预算下使用 300 mAh 电池进行 300 小时的连续监测。这些结果为实现经济实惠、可穿戴、长期癫痫监测解决方案铺平了道路,该解决方案具有低假阳性率和高灵敏度,可满足患者和护理人员的要求。临床意义——所提出的 EEG 伪影检测框架可用于可穿戴 EEG 记录设备,结合基于 EEG 的癫痫发作检测算法,以提高癫痫发作检测场景的稳健性。索引词——医疗保健、时间序列分类、智能边缘计算、机器学习、深度学习
我们提出了一种新颖的视频异常检测方法:我们将从视频中提取的特征向量视为具有固定分布的随机变量的重新释放,并用神经网络对此分布进行建模。这使我们能够通过阈值估计估计测试视频的可能性并检测视频异常。我们使用DE-NONISE分数匹配的修改来训练视频异常检测器,该方法将训练数据注射噪声以促进建模其分布。为了消除液体高参数的选择,我们对噪声噪声级别的噪声特征的分布进行了建模,并引入了常规化器,该定期用器倾向于将模型与不同级别的噪声保持一致。在测试时,我们将多个噪声尺度的异常指示与高斯混合模型相结合。运行我们的视频异常检测器会引起最小的延迟,因为推理需要仅提取特征并通过浅神经网络和高斯混合模型将其前向传播。我们在五个流行的视频异常检测台上的典范表明了以对象为中心和以框架为中心的设置中的最先进的性能。
摘要:该项目旨在开发一个旨在在室内环境(例如购物中心,公交车站和电影院)操作的自主垃圾机器人。机器人的主要目标是在浏览空间并避免障碍的同时检测和收集垃圾项目。利用传感器和图像处理技术的组合,机器人可以识别垃圾对象,并调整其在不误认为障碍物的情况下将其捡起的路径。通过采用具有成本效益的硬件组件和简化算法,我们旨在创建一个实用的解决方案,以解决公共空间中的垃圾污染,这证明了机器人技术在环境可持续发展方面的潜力。关键字:Raspberry Pi,垃圾检测,对象识别,避免障碍物,节点MCU,机器人,Arduino IDE
随着人脸识别系统 (FRS) 的部署,人们开始担心这些系统容易受到各种攻击,包括变形攻击。变形人脸攻击涉及两张不同的人脸图像,以便通过变形过程获得一个与两个贡献数据主体足够相似的最终攻击图像。可以通过视觉(由人类专家)和商业 FRS 成功验证所获得的变形图像与两个主体的相似性。除非此类攻击能够被检测到并减轻,否则人脸变形攻击会对电子护照签发流程和边境管制等应用构成严重的安全风险。在这项工作中,我们提出了一种新方法,使用新设计的去噪框架来可靠地检测变形人脸攻击。为此,我们设计并引入了一种新的深度多尺度上下文聚合网络 (MS-CAN) 来获取去噪图像,然后将其用于确定图像是否变形。在三个不同的变形人脸图像数据集上进行了广泛的实验。还使用 ISO-IEC 30107-3 评估指标对所提出方法的变形攻击检测 (MAD) 性能进行了基准测试,并与 14 种不同的最新技术进行了比较。根据获得的定量结果,所提出的方法在所有三个数据集以及跨数据集实验中都表现出最佳性能。
雷达相机3D对象检测旨在与雷达信号与摄像机图像进行交互,以识别感兴趣的对象并定位其相应的3D绑定框。为了克服雷达信号的严重稀疏性和歧义性,我们提出了一个基于概率deno的扩散建模的稳健框架。我们设计了框架,可以在不同的多视图3D检测器上易于实现,而无需在训练或推理过程中使用LiDar Point Clouds。在特定的情况下,我们首先通过开发带有语义嵌入的轻质DENOIS扩散模型来设计框架编码器。其次,我们通过在变压器检测解码器的深度测量处引入重建训练,将查询降解训练开发为3D空间。我们的框架在Nuscenes 3D检测基准上实现了新的最新性能,但与基线检测器相比,计算成本的增加很少。
