FCN与U-Net语义分割算法

最新推荐文章于 2024-07-12 15:12:25 发布

wujianming_110117

最新推荐文章于 2024-07-12 15:12:25 发布

阅读量1.1k

点赞数

分类专栏：深度学习语义分割&实例分割&全景分割车道线检测

吴建明

本文链接：https://blog.csdn.net/wujianing_110117/article/details/106164120

版权

本文介绍了FCN和U-Net两种深度学习语义分割算法，探讨了它们如何解决CNN在图像分割中的问题。FCN通过全卷积网络实现像素级别的分类，U-Net则采用收缩和扩展路径进行特征融合，适用于小样本训练。这两种方法在自动驾驶、医疗影像等领域有广泛应用。

摘要由CSDN通过智能技术生成

FCN与U-Net语义分割算法

图像语义分割(Semantic Segmentation)是图像处理和是机器视觉技术中关于图像理解的重要一环，也是 AI 领域中一个重要的分支。语义分割即是对图像中每一个像素点进行分类，确定每个点的类别（如属于背景、人或车等），从而进行区域划分。目前，语义分割已经被广泛应用于自动驾驶、无人机落点判定等场景中。

在这里插入图片描述

图1 自动驾驶中的图像语义分割

而截止目前，CNN已经在图像分类分方面取得了巨大的成就，涌现出如VGG和Resnet等网络结构，并在ImageNet中取得了好成绩。CNN的强大之处在于它的多层结构能自动学习特征，并且可以学习到多个层次的特征：

较浅的卷积层感知域较小，学习到一些局部区域的特征；
较深的卷积层具有较大的感知域，能够学习到更加抽象一些的特征。

这些抽象特征对物体的大小、位置和方向等敏感性更低，从而有助于分类性能的提高。这些抽象的特征对分类很有帮助，可以很好地判断出一幅图像中包含什么类别的物体。图像分类是图像级别的！

在这里插入图片描述

与分类不同的是，语义分割需要判断图像每个像素点的类别，进行精确分割。图像语义分割是像素级别的！但是由于CNN在进行convolution和pooling过程中丢失了图像细节，即feature map size逐渐变小，所以不能很好地指出物体的具体轮廓、指出每个像素具体属于哪个物体，无法做到精确的分割。

针对这个问题，Jonathan Long等人提出了Fully
Convolutional Networks（FCN）用于图像语义分割。自从提出后，FCN已经成为语义分割的基本框架，后续算法其实都是在这个框架中改进而来。