基于单阶段的目标检测

简介: 随着深度学习的不断发展,目标检测技术逐步从基于传统的手工检测方法向基于深度神经网络的检测方法转变。在众多基于深度学习的目标检测方法中,基于深度学习的单阶段目标检测方法因其网络结构较简单、运行速度较快以及具有更高的检测效率而被广泛运用。

    基于单阶段的经典目标检测算法主要有 YOLO 系列算法和 SSD(Single Shot  Multi Box Detector)系列算法,不需要 region proposal 阶段,可以直接产生目标物体的类别概率和位置坐标,没有滑动窗口和候选区域的流程,经过单次检测即可直接得到最终的检测结果,所以在检测速度上有大幅提升。

VS)170WQ%{NAH3ENBO0)GZD.png

    Liu 等人提出了 SSD算法,算法的主要网络结构是 VGG16,网络结构如上图所示,针对 YOLO 算法存在的检测精度不高的缺陷,SSD 在保持 YOLO 算法回归思想的同时,也采用了 Faster R-CNN 的 anchor 机制。普通的方法针对输入图片获取不同尺度的特征映射,但是在预测阶段仅仅使用了最后一层的特征映射,而SSD 不仅获得不用尺度的特征映射,同时在不同的特征映射上面进行预测,可以从结构图看到,每个卷积层后都有个预测模块,浅层卷积层可以得到目标物体边缘的信息,而深层网络可以得到更细节更抽象的特征,如果结合不同尺度的特征进行预测,通常会提高检测精度,这样既保持速度的同时又得到较高的检测精度。但是SSD 算法需要人工设置默认框的参数,比如 prior  box 的大小 min_size,max_size和 aspect_ratio(长宽比)值。网络中预选框的基础大小和形状需要手工设置。而网络中每一层 feature 使用的预选框大小和形状不一样,导致调试过程非常依赖经验。虽然采用了特征金字塔的思路,但对小目标的识别效果依然一般,可能是因为 SSD使用 Conv4_3 浅层 feature 去检测小目标,而浅层特征卷积层少,存在特征提取不充分的问题。

相关文章
|
机器学习/深度学习 编解码 文件存储
YOLOv8改进 | 2023Neck篇 | BiFPN双向特征金字塔网络(附yaml文件+代码)
YOLOv8改进 | 2023Neck篇 | BiFPN双向特征金字塔网络(附yaml文件+代码)
2232 0
|
编解码 异构计算
YOLOv11改进策略【Neck】| BiFPN:双向特征金字塔网络-跨尺度连接和加权特征融合
YOLOv11改进策略【Neck】| BiFPN:双向特征金字塔网络-跨尺度连接和加权特征融合
4783 7
YOLOv11改进策略【Neck】| BiFPN:双向特征金字塔网络-跨尺度连接和加权特征融合
|
机器学习/深度学习 算法 计算机视觉
5.2 单阶段目标检测模型YOLOv3
这篇文章详细介绍了单阶段目标检测模型YOLOv3的基本原理和网络结构,包括如何生成候选区域、锚框的设计、预测框的生成以及如何对这些候选区域进行标注,并通过卷积神经网络进行特征提取和预测。
|
监控 算法 自动驾驶
主流的目标检测算法是那种?
主流的目标检测算法是那种?
|
机器学习/深度学习 TensorFlow 算法框架/工具
RT-DETR改进策略【卷积层】| 利用MobileNetv4中的UIB、ExtraDW优化ResNetLayer
RT-DETR改进策略【卷积层】| 利用MobileNetv4中的UIB、ExtraDW优化ResNetLayer
588 12
RT-DETR改进策略【卷积层】| 利用MobileNetv4中的UIB、ExtraDW优化ResNetLayer
|
机器学习/深度学习 计算机视觉 异构计算
YOLOv8优改系列一:YOLOv8融合BiFPN网络,实现网络快速涨点
本文介绍了将BiFPN网络应用于YOLOv8以增强网络性能的方法。通过双向跨尺度连接和加权特征融合,BiFPN能有效捕获多尺度特征,提高目标检测效果。文章还提供了详细的代码修改步骤,包括修改配置文件、创建模块文件、修改训练代码等,以实现YOLOv8与BiFPN的融合。
3544 0
YOLOv8优改系列一:YOLOv8融合BiFPN网络,实现网络快速涨点
|
机器学习/深度学习 TensorFlow 算法框架/工具
RT-DETR改进策略【注意力机制篇】| 引入MobileNetv4中的Mobile MQA,轻量化注意力模块 提高模型效率
RT-DETR改进策略【注意力机制篇】| 引入MobileNetv4中的Mobile MQA,轻量化注意力模块 提高模型效率
554 2
|
机器学习/深度学习 数据可视化 算法
图特征工程实践指南:从节点中心性到全局拓扑的多尺度特征提取
本文详细介绍了如何利用NetworkX库从图结构中提取重要特征。首先,通过定义辅助函数设置了图的可视化选项,并以Zachary网络数据集为例进行了可视化展示。接着,文章深入探讨了三类图特征:基于节点的特征(如节点度、中心性等)、基于边的特征(如最短路径、邻域重叠等)以及基于图的特征(如Graphlets、Weisfeiler-Leman特征等)。通过这些特征的提取与分析,可以全面理解网络结构,识别关键节点,分析信息流动模式,并发现潜在的隐藏模式。本文不仅展示了如何应用这些特征来揭示社交网络中的角色和联系,还强调了其在交通网络分析和生物系统研究等领域的广泛应用潜力。
1129 12
图特征工程实践指南:从节点中心性到全局拓扑的多尺度特征提取
|
机器学习/深度学习 计算机视觉 Python
【YOLOv11改进 - 注意力机制】SimAM:轻量级注意力机制,解锁卷积神经网络新潜力
【YOLOv11改进 - 注意力机制】SimAM:轻量级注意力机制,解锁卷积神经网络新潜力本文提出了一种简单且高效的卷积神经网络(ConvNets)注意力模块——SimAM。与现有模块不同,SimAM通过优化能量函数推断特征图的3D注意力权重,无需添加额外参数。SimAM基于空间抑制理论设计,通过简单的解决方案实现高效计算,提升卷积神经网络的表征能力。代码已在Pytorch-SimAM开源。
【YOLOv11改进 - 注意力机制】SimAM:轻量级注意力机制,解锁卷积神经网络新潜力
|
算法 计算机视觉
图像分割的两种算法
图像分割的两种算法
1443 0