基于深度学习的计算机视觉应用之目标检测_传统目标检测算法首先是通过滑动窗口的方法生成目标建议框,接着提取每个建议框中-CSDN博客

本文链接：https://blog.csdn.net/fendouaini/article/details/79789140

本文介绍了基于深度学习的计算机视觉目标检测，包括YOLO、Faster R-CNN和SSD等算法，阐述了它们的工作原理和优势，展示了深度学习如何提升目标检测的效率和精度。

摘要由CSDN通过智能技术生成

欢迎大家关注我们的网站和系列教程：http://www.tensorflownews.com/，学习更多的机器学习、深度学习的知识！

目标检测作为图像处理和计算机视觉领域中的经典课题,在交通监控、图像检索、人机交互等方面有着广泛的应用。它旨在一个静态图像(或动态视频)中检测出人们感兴趣的目标对象。传统的目标检测算法中特征提取和分类决策分开进行，对特征选取的要求就更加严格，在面对复杂场景的时候很难得到理想效果。自Hinton教授提出深度学习理论，越来越多的研究人员发现在目标检测领域应用深度学习，可以有效提高检测效果和性能，于是深度学习在实时视频的目标检测开始获得大规模的应用。时至今日，其检测效率和精度已经有了极大提高。

一、传统检测算法

传统的目标检测一般使用滑动窗口的框架，主要包括三个步骤：先利用不同尺寸的滑动窗口框住图中的某一部分作为候选区域；然后提取候选区域相关的视觉特征——比如人脸检测常用的Harr-like特征，行人检测和普通目标检测常用的HOG（Histogram of Oriented Gradient）、SIFT（Scale Invariant Feature Transform）特征等；最后利用分类器进行识别，比如常用的SVM模型。

经典传统检测算法之DPM：

传统的目标检测中，多尺度形变部件模型DPM（Deformable Part Model）是出类拔萃的，连续获得VOC（Visual Object Class）2007到2009的检测冠军，2010年其作者Felzenszwalb Pedro被VOC授予“终身成就奖”。DPM把物体看成了多个组成的部件（比如人脸的鼻子、嘴巴等），用部件间的关系来描述物体，这个特性非常符合自然界很多物体的非刚体特征。DPM可以看做是HOG+SVM的扩展，很好的继承了两者的优点，在人脸检测、行人检测等任务上取得了不错的效果，但是DPM相对复杂，检测速度也较慢，从而也出现了很多改进的方法。