摘要印度尼西亚道路上的移动车辆数量每年都在增加。因此,出于各种原因,必须验证这些车辆的身份,包括找到被盗的车辆,执行交通法,管理停车场和收集通行费。然而,手动检查这些大量车辆是一项具有挑战性的任务。机动车辆板板检测和识别在智能运输系统中起着至关重要的作用。通常,在机动车上的数字板的检测和识别需要三个主要阶段。基于机器学习的对象检测是一系列可以自动识别并在图像或视频中定位对象的算法的范围。这些模型利用多层处理单元从输入数据中提取复杂的特征,从而提高了对象检测目的的总体效率。Yolo算法是一种流行的对象检测算法,可以使用自定义数据集实时从图像或视频中检测对象。在这项研究中,我们直接比较了Yolov5和Yolov8模型,这些模型接受了平等的训练时期,达到了稳定性,并使用了具有图像大小为640、100时代,Val 200和批次16的超参数。
尽管有技术的进步,但现有的车辆检测和跟踪系统通常以高车辆密度和频繁闭塞为特征的复杂交通情况失败。例如,跟踪系统可能难以区分重叠的车辆或实时保持整个帧的一致性(Zhao等,2022)。传统方法在计算上也很昂贵,这使得它们不适合智能运输系统中的现实部署。这项研究通过提出一个混合框架来解决这些挑战,该框架利用Gabor过滤器进行功能提取,Yolov5进行高核能检测和深层排序,以在动态的交通环境中进行可靠的跟踪。1.3研究范围本研究的重点是开发适用于各种现实世界应用的强大车辆检测和跟踪框架。研究包括:实施Gabor滤波器以进行基于纹理的特征提取(Duong,2021)。利用Yolov5用于实时检测汽车,公共汽车和卡车(Zhang等,2022)。深入排序以跨顺序框架进行多对象跟踪(Liu,2021)。使用代表城市,郊区和公路交通状况的注释数据集对框架进行评估(Mou等,2022)。1.4目的和目标本研究的主要目的是开发一个混合框架,以进行高效和实时的多类车辆检测和跟踪。目标包括:设计和实施混合框架,该框架结合了Gabor过滤器,Yolov5和深层排序以进行车辆检测和跟踪(Zhao等,2022)。
摘要。本文以浮游生物为例,比较了两种在水环境中检测和识别微物体的方法的有效性,这些方法使用了神经网络和各种技术,并使用不同的编程语言开发。首先,研究并应用了传统的检测方法,该方法基于 Gabor 和多层感知器特征的提取,以 MATrixLABoratory (MATLAB) 语言实现。其次,使用 YOLOv5(“You only look once” 的缩写)作为单级神经网络,以 Python 语言实现。介绍了这些方法在浮游生物检测中的工作结果。计算准确度和完整性指标以确定两种方法中的最佳方法。使用检测方法后,获得了带有识别结果的图像,以编程方式计算的性能指标。研究了使用短视频图像进行实时识别的方法应用的有效性。最后,指出 YOLOv5 模型在检测海洋物体(尤其是浮游生物)的任务中表现出了明显优于传统方法的优势。其准确率高出 30%;物体检测的完整性提高了27%。
该项目介绍了专门针对视力障碍个人量身定制的创新的基于AI的交互式购物援助系统,旨在增强其购物体验并促进零售环境中的包容性。利用高级人工智能算法,该系统为面临视觉挑战的用户提供个性化的帮助,导航支持和无缝互动。通过直观的接口和自适应技术,残疾人有权以更大的独立性和信心来浏览零售空间。该系统利用Raspberry Pi 4上的相机模块和基于YOLO的深度学习算法进行实时对象分类,从而将处理的信息转换为可访问的音频输出。除了这些功能外,系统还使用了使用OCR和GTTS技术的语言自定义功能,从而使音频输出转换为基于用户偏好的多种语言。通过优先考虑视障人士的需求,这种开创性的系统旨在增强可访问性并促进所有人的包容性购物体验。
摘要:同时定位和映射(SLAM)对于移动机器人技术至关重要。大多数vi-sual SLAM系统都假定环境是静态的。但是,在现实生活中,有许多动态对象,会影响这些系统的准确性和鲁棒性。为了改善视觉大满贯系统的表现,这项研究提出了基于定向的快速和旋转简短(ORB)-Slam3框架的动态视觉大满贯(SEG-SLAM)系统,您只能看一次(YOLO)V5深学习方法。首先,基于ORB-SLAM3框架,Yolov5深学习方法用于构建用于目标检测和语义分割的融合模块。此模块可以有效地识别并提取明显和潜在动态对象的先验信息。第二,使用先前的信息,深度信息和表现几何方法为不同的动态对象开发了差异化的动态特征拒绝策略。因此,提高了SEG-SLAM系统的定位和映射准确性。最后,拒绝结果与深度信息融合在一起,并使用点云库构建了无动态对象的静态密集映射。使用公共TUM数据集和现实世界情景评估SEG-SLAM系统。所提出的方法比当前动态视觉大满贯算法更准确,更健壮。
摘要 近年来,异物闯入铁路和机场跑道事件频发,这些物体包括行人、车辆、动物和杂物等。本文介绍了一种改进的YOLOv5架构,结合FasterNet和注意力机制,增强对铁路和机场跑道上异物的检测。本研究提出了一个新的数据集AARFOD(航空和铁路异物检测),结合了两个用于检测航空和铁路系统中异物的公共数据集,旨在提高异物目标的识别能力。在这个大型数据集上的实验结果表明,与基线YOLOv5模型相比,所提出的模型性能有显著提升,降低了计算要求。改进后的YOLO模型的精度显著提高了1.2%,召回率提高了1.0%,mAP@.5提高了0.6%,而mAP@.5-.95保持不变。参数减少了约25.12%,GFLOP减少了约10.63%。在消融实验中发现,FasterNet模块可以显著减少模型的参数数量,同时注意力机制的引用可以减缓轻量化带来的性能损失。
摘要。行人检测对于自动驾驶,监视和行人安全至关重要。此摘要使用Yolov5算法引入了一种新颖的行人检测方法,该算法以其实时对象检测能力而闻名。该方法旨在提高各种照明条件下的行人检测准确性。从方法论上讲,该过程涉及数据准备,Yolov5模型培训以及随后的评估。使用锚箱和单次卷积神经网络的Yolov5的体系结构允许快速准确的行人识别。Yolov5的设计,包括锚箱和单次卷积神经网络,可以快速而准确的行人识别。研究测试证实了基于Yolov5的方法的功效。在第一种情况下,该模型以75%的精度检测到了日光的行人,但它也产生了11个假否定性或25%的失误。尽管方案2的准确性较高,为85%,但仍有11个假否定性,这表明存在持续的检测差距。尽管有这些结果,Yolov5模型仍证明了在现实世界中进行准确的行人检测的可能性。虽然它极大地改善了自动驾驶汽车和行人安全等应用,但降低假否定性仍然是提高整体准确性的主要目标。调查的发现表明,Yolov5可以在各种照明条件下起作用,但也强调了进行进一步工作以满足严格检测要求的必要性。
Taoufik Saidani 沙特阿拉伯北部边境大学计算机与信息技术学院计算机科学系 | 突尼斯莫纳斯提尔大学理学院电子与微电子实验室 (E μ E) taoufik.saidan@nbu.edu.sa(通讯作者)Refka Ghodhbani 沙特阿拉伯北部边境大学计算机与信息技术学院计算机科学系 |突尼斯莫纳斯提尔大学理学院电子与微电子实验室 (E μ E) refka.ghodhbani@nbu.edu.sa Ahmed Alhomoud 沙特阿拉伯北部边境大学计算机与信息技术学院计算机科学系 aalhomoud@nbu.edu.sa Ahmad Alshammari 沙特阿拉伯北部边境大学计算机与信息技术学院计算机科学系 ahmad.almkhaidsh@nbu.edu.sa Hafedh Zayani 沙特阿拉伯北部边境大学工程学院电气工程系 hafedh.zayani@nbu.edu.sa Mohammed Ben Ammar 沙特阿拉伯北部边境大学计算机与信息技术学院信息系统系 mohammed.ammar@nbu.edu.sa
