DL之DSSD:DSSD算法的简介(论文介绍)、架构详解、案例应用等配图集合之详细攻略

简介: DL之DSSD:DSSD算法的简介(论文介绍)、架构详解、案例应用等配图集合之详细攻略

DSSD算法的简介(论文介绍)


       DSSD,是在SSD上做的改进,即Deconvolutional Single Shot Detector,反卷积单步骤探测器。


Abstract  

     The main contribution of this paper is an approach for  introducing additional context into state-of-the-art general  object detection. To achieve this we first combine a state-ofthe-art  classifier (Residual-101 [14]) with a fast detection  framework (SSD [18]). We then augment SSD+Residual101  with deconvolution layers to introduce additional largescale  context in object detection and improve accuracy,  especially for small objects, calling our resulting system  DSSD for deconvolutional single shot detector. While these  two contributions are easily described at a high-level, a  naive implementation does not succeed. Instead we show  that carefully adding additional stages of learned transformations,  specifically a module for feed-forward connections  in deconvolution and a new output module, enables this new  approach and forms a potential way forward for further detection  research. Results are shown on both PASCAL VOC  and COCO detection. Our DSSD with 513 × 513 input  achieves 81.5% mAP on VOC2007 test, 80.0% mAP on  VOC2012 test, and 33.2% mAP on COCO, outperforming  a state-of-the-art method R-FCN [3] on each dataset.

     本文的主要贡献是将附加上下文引入到最先进的一般对象检测中。为了实现这一点,我们首先结合了一个最先进的分类器(Residual-101[14])和一个快速检测框架(SSD[18])。然后,我们使用反褶积层来增加SSD+Residual101,以在目标检测中引入额外的大范围上下文,并提高精度,特别是对于小对象,调用我们得到的系统DSSD来实现反卷积单镜头检测器。虽然这两个贡献很容易在高层进行描述,但是一个简单的实现是不会成功的。相反,我们展示了详细添加额外的学习转换阶段,特别是反褶积中的前馈连接模块和一个新的输出模块,使这种新方法成为可能,并为进一步的检测研究形成了一个潜在的前进方向。结果表明,PASCAL VOC和COCO 检测。我们的513×513输入的DSSD在VOC2007测试中实现了81.5%的mAP,在VOC2012测试中实现了80.0%的mAP,在COCO上实现了33.2%的mAP,在每个数据集上都优于目前最先进的R-FCN[3]方法。

Conclusion  

     We propose an approach for adding context to a stateof-the-art  object detection framework, and demonstrate its  effectiveness on benchmark datasets. While we expect  many improvements in finding more efficient and effective  ways to combine the features from the encoder and decoder,  our model still achieves state-of-the-art detection results on  PASCAL VOC and COCO. Our new DSSD model is able  to outperform the previous SSD framework, especially on  small object or context specific objects, while still preserving  comparable speed to other detectors. While we only apply  our encoder-decoder hourglass model to the SSD framework,  this approach can be applied to other detection methods,  such as the R-CNN series methods [12, 11, 24], as well.

     我们提出了一种将上下文添加到最先进的对象检测框架的方法,并在基准数据集上证明了它的有效性。虽然我们期望在寻找更有效和更有效的方法来结合编码器和解码器的特性方面有许多改进,但我们的模型仍然在PASCAL VOC和COCO上实现了最先进的检测结果。我们的新DSSD模型能够超越以前的SSD框架,特别是在小对象或特定上下文对象上,同时仍然保持与其他检测器相当的速度。虽然我们只将我们的编解码器沙漏模型应用于SSD框架,但是这种方法也可以应用于其他检测方法,比如R-CNN系列方法[12,11,24]。


论文

Cheng-Yang Fu , Wei Liu , Ananth Ranga, AmbrishTyagi , Alexander C. Berg .

DSSD : Deconvolutional Single Shot Detector,CVPR 2017

https://arxiv.org/abs/1701.06659



1、DSSD框架结构


      残差网络上的SSD和DSSD网络:蓝色模块是SSD框架中添加的层,称之为SSD层。在下图中,红色图层是DSSD层。

image.png




2、DSSD模型的特点、贡献


SSD算法对小目标不够鲁棒(会出现误检和漏检);最主要的原因是浅层特征图的表示能力不够强。DSSD算法的核心思想就是提高浅层的表示能力。

DSSD在原来的SSD模型上主要作了两大改进:

一是替换掉VGG,而改用了Resnet-101作为特征提取网络并在对不同尺度的特征图进行默认框检测时使用了更新的检测单元;

二则在网络的后端使用了多个反卷积层(deconvolution layers)以有效地扩展低维度信息的上下文信息(contextual information) ,从而有效地改善了小尺度目标的检测。





DSSD算法的架构详解


更新……






DSSD算法的案例应用


更新……




 


相关文章
|
26天前
|
机器学习/深度学习 人工智能 自然语言处理
【自然语言处理】TF-IDF算法在人工智能方面的应用,附带代码
TF-IDF算法在人工智能领域,特别是自然语言处理(NLP)和信息检索中,被广泛用于特征提取和文本表示。以下是一个使用Python的scikit-learn库实现TF-IDF算法的简单示例,并展示如何将其应用于文本数据。
182 65
|
27天前
|
存储 人工智能 自然语言处理
算法、系统和应用,三个视角全面读懂混合专家(MoE)
【8月更文挑战第17天】在AI领域,混合专家(MoE)模型以其独特结构成为推动大型语言模型发展的关键技术。MoE通过动态选择专家网络处理输入,实现条件计算。稀疏型MoE仅激活部分专家以减少计算负担;软MoE则加权合并专家输出提升模型稳定性。系统层面,MoE优化计算、通信与存储,利用并行化策略提高效率。在NLP、CV、推荐系统等领域展现强大应用潜力,但仍面临训练稳定性、可解释性等挑战。[论文链接: https://arxiv.org/pdf/2407.06204]
176 63
|
28天前
|
缓存 算法 Java
刷算法,你应该知道的队列经典应用
文章介绍了队列的基本特性和经典应用,包括如何用队列实现栈、使用优先级队列解决Top K问题,并通过LeetCode题目示例展示了队列在算法实现中的应用。
刷算法,你应该知道的队列经典应用
|
29天前
|
算法 Java 测试技术
算法分析(蛮力法与减治算法应用实验报告)
这篇文章是关于算法分析的实验报告,介绍了如何使用蛮力法解决背包问题,并通过伪代码和Java代码实现,同时分析了其时间效率;还介绍了基于减治法思想实现的二叉查找树的插入与查找,同样提供了伪代码、Java源代码实现和时间效率分析,最后展示了测试结果截图。
算法分析(蛮力法与减治算法应用实验报告)
|
11天前
|
机器学习/深度学习 算法 数据挖掘
R语言中的支持向量机(SVM)与K最近邻(KNN)算法实现与应用
【9月更文挑战第2天】无论是支持向量机还是K最近邻算法,都是机器学习中非常重要的分类算法。它们在R语言中的实现相对简单,但各有其优缺点和适用场景。在实际应用中,应根据数据的特性、任务的需求以及计算资源的限制来选择合适的算法。通过不断地实践和探索,我们可以更好地掌握这些算法并应用到实际的数据分析和机器学习任务中。
|
16天前
|
算法 C++
A : DS串应用–KMP算法
这篇文章提供了KMP算法的C++实现,包括计算模式串的next数组和在主串中查找模式串位置的函数,用于演示KMP算法的基本应用。
|
19天前
|
缓存 算法 前端开发
深入理解缓存淘汰策略:LRU和LFU算法的解析与应用
【8月更文挑战第25天】在计算机科学领域,高效管理资源对于提升系统性能至关重要。内存缓存作为一种加速数据读取的有效方法,其管理策略直接影响整体性能。本文重点介绍两种常用的缓存淘汰算法:LRU(最近最少使用)和LFU(最不经常使用)。LRU算法依据数据最近是否被访问来进行淘汰决策;而LFU算法则根据数据的访问频率做出判断。这两种算法各有特点,适用于不同的应用场景。通过深入分析这两种算法的原理、实现方式及适用场景,本文旨在帮助开发者更好地理解缓存管理机制,从而在实际应用中作出更合理的选择,有效提升系统性能和用户体验。
44 1
|
27天前
|
机器学习/深度学习 人工智能 自然语言处理
【深度学习】探讨最新的深度学习算法、模型创新以及在图像识别、自然语言处理等领域的应用进展
深度学习作为人工智能领域的重要分支,近年来在算法、模型以及应用领域都取得了显著的进展。以下将探讨最新的深度学习算法与模型创新,以及它们在图像识别、自然语言处理(NLP)等领域的应用进展。
61 6
|
25天前
|
机器学习/深度学习 自然语言处理 负载均衡
揭秘混合专家(MoE)模型的神秘面纱:算法、系统和应用三大视角全面解析,带你领略深度学习领域的前沿技术!
【8月更文挑战第19天】在深度学习领域,混合专家(Mixture of Experts, MoE)模型通过整合多个小型专家网络的输出以实现高性能。从算法视角,MoE利用门控网络分配输入至专家网络,并通过组合机制集成输出。系统视角下,MoE需考虑并行化、通信开销及负载均衡等优化策略。在应用层面,MoE已成功应用于Google的BERT模型、Facebook的推荐系统及Microsoft的语音识别系统等多个场景。这是一种强有力的工具,能够解决复杂问题并提升效率。
40 2
|
4天前
|
机器学习/深度学习 算法 Python
群智能算法:深入解读人工水母算法:原理、实现与应用
近年来,受自然界生物行为启发的优化算法备受关注。人工水母算法(AJSA)模拟水母在海洋中寻找食物的行为,是一种新颖的优化技术。本文详细解读其原理及实现步骤,并提供代码示例,帮助读者理解这一算法。在多模态、非线性优化问题中,AJSA表现出色,具有广泛应用前景。