卷积神经网络(CNN)

1.1 卷积神经网络基础

卷积神经网络(CNN)@TOC


前言

卷积神经网络主要用于图像处理


一、卷积神经网络是什么?

卷积神经网络:包含卷积层的神经网络都叫做卷积神经网络

全卷积神经网络:不包含全连接层,只包含卷积层以及池化层的神经网络

Convolutions:卷积层

Subsampling:下采样层(池化层)

Full connection:全连接层在这里插入图片描述

二、卷积神经网络可以干什么

1.图片分类

根据图片内容将图片分成不同的类别。
在这里插入图片描述

2.图片检索

基于内容的图像检索分为三个层次:

(1)依据提取图像本身的颜色、形状、纹理等低层特征进行检索;

(2)基于图像的低层特征,通过识别图像中的对象类别以及对象之间的空间拓扑关系进行检索;

(3)基于图像抽象属性(场景语义、行为语义、情感语义等)的推理学习进行检索;
在这里插入图片描述

3.目标检测

目标检测(Object Detection)的任务是找出图像中所有感兴趣的目标(物体),确定它们的类别和位置,是计算机视觉领域的核心问题之一。由于各类物体有不同的外观、形状和姿态,加上成像时光照、遮挡等因素的干扰,目标检测一直是计算机视觉领域最具有挑战性的问题。

计算机视觉中关于图像识别有四大类任务:

(1)分类-Classification:解决“是什么?”的问题,即给定一张图片或一段视频判断里面包含什么类别的目标。

(2)定位-Location:解决“在哪里?”的问题,即定位出这个目标的的位置。

(3)检测-Detection:解决“在哪里?是什么?”的问题,即定位出这个目标的位置并且知道目标物是什么。

(4)分割-Segmentation:分为实例的分割(Instance-level)和场景分割(Scene-level),解决“每一个像素属于哪个目标物或场景”的问题。
将图片中要检测的目标全部框选出来,标上相应的标签,并且显示出预测正确的可能性。

4.图像分割

按分割目的划分
(1)普通分割
将不同分属不同物体的像素区域分开。
如前景与后景分割开,狗的区域与猫的区域与背景分割开。

(2)语义分割
在普通分割的基础上,分类出每一块区域的语义(即这块区域是什么物体)。
如下图画面中的所有物体都指出它们各自的类别。

(3)实例分割
在语义分割的基础上,给每个物体编号。

将图片分为不同的区域。

5.图像描述

Image Caption即图像描述,目的是从图片中自动生成一段描述性文字,即看图说话。难点是不仅要能检测出图像中的物体,而且要理解物体之间的相互关系,最后还要用合理的语言表达出来。需要将图像中检测到的目标得到相应的向量,再将这些向量映射到文字。
简单描述图片内容。

三、全连接层

1.全连接层结构

在这里插入图片描述

2.BP神经网络运行机制

在这里插入图片描述

3.实例:利用BP神经网络做车牌数字识别

在这里插入图片描述

(1).如何将图片数据输入到神经网络

在这里插入图片描述
第一张图片:读入一张彩色的RGB图像,每个像素都包含三个RGB分量,首先进行灰度化,得到第二张图。
第二张图片:灰度图片,每一个像素值只有一个分量。再进行二值化处理,得到第三张黑白图像。
在这里插入图片描述
用一个5乘3的滑动窗口进行滑动,计算出白色的像素点所占的比例。
第一行第五个滑动窗口已经越界,处理方法一:在右边补上一列0,或者事先进行预测,调整滑动窗口的大小。遍历完成后得到一个5乘5的矩阵。
在这里插入图片描述
将5乘5的矩阵转化成1行25列的行向量。 此时已经完成了数字图片到计算机可以识别的行向量的转化,转化成功以后就可以输入到计算机中。

(2).如何输出神经网络识别的结果
在这里插入图片描述

(3).神经网络的训练
在这里插入图片描述

四、卷积层

1.卷积简介

在这里插入图片描述
步距:滑动窗口一次移动的距离。
卷积核与图片中滑动窗口对应位置数字乘积之和,即11+10+11+00+11+10+01+00+1*1=4,然后将4放在特征矩阵的第一行第一列。

2.卷积层权值共享优点

在这里插入图片描述

3.彩色图片卷积过程

在这里插入图片描述
在这里插入图片描述在这里插入图片描述
在这里插入图片描述
channel:深度
灰度图片channel=1,RGB图片channel=3,RGBA图片channel=4.
思考
(1)加上偏移量bias该如何计算
直接在得到的特征矩阵的对应位置加上偏移量即可。

4.激活函数

在这里插入图片描述

5.如何处理卷积过程中的越界情况

在这里插入图片描述
w=4, Filter滤波器大小=卷积核大小=3乘3 , N=2
计算卷积矩阵大小 = (4-3+1)/2+1=2
故卷积矩阵大小为2乘2

步长为2,滑动窗口第二次滑动出现越界情况。
在这里插入图片描述
解决方法:使用Padding补0进行处理。

五、池化层

1.最大池化下采样

在这里插入图片描述

2.平均池化下采样

在这里插入图片描述
Stride:步距

评论 1
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值