CNN 卷积神经网络

最新推荐文章于 2023-01-05 15:47:17 发布

代码artist

最新推荐文章于 2023-01-05 15:47:17 发布

阅读量360

点赞数

分类专栏： NLP AI-基础文章标签：人工智能 CNN 卷积神经网络

版权声明：本文为博主原创文章，遵循 CC 4.0 BY-SA 版权协议，转载请附上原文出处链接和本声明。

本文链接：https://blog.csdn.net/gs344937933/article/details/108166430

版权

AI-基础同时被 2 个专栏收录

8 篇文章 0 订阅

订阅专栏

6 篇文章 2 订阅

订阅专栏

出现的原因，解决的问题，（优点）

（1）减少数据量

（2）能够体现出，纵向的数据的关联性

思想来源：人脑识别物体的过程：

深度学习的许多研究成果，离不开对大脑认知原理的研究，尤其是视觉原理的研究。

1981 年的诺贝尔医学奖，颁发给了 David Hubel（出生于加拿大的美国神经生物学家）和TorstenWiesel，以及 Roger Sperry。前两位的主要贡献，是“发现了视觉系统的信息处理”，可视皮层是分级的。

人类的视觉原理如下：从原始信号摄入开始（瞳孔摄入像素 Pixels），接着做初步处理（大脑皮层某些细胞发现边缘和方向），然后抽象（大脑判定，眼前的物体的形状，是圆形的），然后进一步抽象（大脑进一步判定该物体是只气球）。下面是人脑进行人脸识别的一个示例：

对于不同的物体，人类视觉也是通过这样逐层分级，来进行认知的：

我们可以看到，在最底层特征基本上是类似的，就是各种边缘，越往上，越能提取出此类物体的一些特征（轮子、眼睛、躯干等），到最上层，不同的高级特征最终组合成相应的图像，从而能够让人类准确的区分不同的物体。

那么我们可以很自然的想到：可以不可以模仿人类大脑的这个特点，构造多层的神经网络，较低层的识别初级的图像特征，若干底层特征组成更上一层特征，最终通过多个层级的组合，最终在顶层做出分类呢？答案是肯定的，这也是许多深度学习算法（包括CNN）的灵感来源。

例子：LeNet

原始图像进来以后，先进入一个卷积层C1，由6个5x5的卷积核组成，卷积出28x28的图像，然后下采样到14x14（S2）；

接下来，再进一个卷积层C3，由16个5x5的卷积核组成，之后再下采样到5x5（S4）。

注意，这里S2与C3的连接方式并不是全连接，而是部分连接，如下图所示：

其中行代表S2层的某个节点，列代表C3层的某个节点。

我们可以看出，C3-0跟S2-0,1,2连接，C3-1跟S2-1,2,3连接，后面依次类推，仔细观察可以发现，其实就是排列组合：

0 0 0 1 1 1

0 0 1 1 1 0

0 1 1 1 0 0

...

1 1 1 1 1 1

我们可以领悟作者的意图，即用不同特征的底层组合，可以得到进一步的高级特征，例如：/ + \ = ^ （比较抽象O(∩_∩)O~），再比如好多个斜线段连成一个圆等等。

最后，通过全连接层C5、F6得到10个输出，对应10个数字的概率。

这里C1的卷积核为什么是6个5x5的卷积核？？？

因为0~9其实能用以下6个边缘来代表：

参考

深度学习简介(一)——卷积神经网络

经典CNN之：LeNet介绍

B站视频：计算机如何模仿大脑识别图像（博客解读）

偏科普的文章：卷积神经网络 – CNN

关注

0
点赞
踩
0

收藏

觉得还不错? 一键收藏
0
评论
CNN 卷积神经网络

出现的原因，解决的问题，（优点）（1）减少数据量（2）能够体现出，纵向的数据的关联性思想来源：人脑识别物体的过程：深度学习的许多研究成果，离不开对大脑认知原理的研究，尤其是视觉原理的研究。1981 年的诺贝尔医学奖，颁发给了 David Hubel（出生于加拿大的美国神经生物学家）和TorstenWiesel，以及 Roger Sperry。前两位的主要贡献，是“发现了视觉系统的信息处理”，可视皮层是分级的。人类的视觉原理如下：从原始信号摄入开始（瞳孔摄入像素 Pixels）.
复制链接

扫一扫

专栏目录

评论

被折叠的条评论为什么被折叠?

到【灌水乐园】发言

查看更多评论

添加红包

成就一亿技术人!

hope_wisdom

发出的红包

实付元

使用余额支付

点击重新获取

扫码支付

钱包余额 0

抵扣说明：

1.余额是钱包充值的虚拟货币，按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载，可以购买VIP、付费专栏及课程。