关于深度学习中卷积核操作

最新推荐文章于 2024-08-08 16:38:06 发布

afmp42539

最新推荐文章于 2024-08-08 16:38:06 发布

阅读量609

点赞数 1

文章标签：人工智能

原文链接：http://www.cnblogs.com/Yu-FeiFei/p/6800519.html

版权

直接举例进行说明输出图片的长和宽。

输入照片为：32*32*3，

这是用一个Filter得到的结果，即使一个activation map。(filter 总会自动扩充到和输入照片一样的depth)。

当我们用6个5*5的Filter时，我们将会得到6个分开的activation maps，如图所示：

得到的“新照片”的大小为：28*28*6.

其实，每个卷积层之后都会跟一个相应的激活函数（activation functions）：

微观上，假设现在input为7*7，Filter尺寸为3*3，output过程如下所示：

最终得到一个5*5的output。

假设，input为7*7，Filter尺寸为3*3，stride(步长)为2，则output过程如下所示：

最终得到一个3*3的output。

注：在这个例子中stride不能为3，因为那样就越界了。

总的来说

Output size=(N-F)/stride +1

当有填充(pad)时，例如对一个input为7*7进行pad=1填充，Filter为3*3，stride=1，会得到一个7*7的output。

Output size=(N-F+2*pad)/stride +1

注：0填充(pad)的主要目的是因为我们在前面的图中所示的那样，一直用5*5的Filter进行卷积，会导致体积收缩的太快，不利于特征的提取。

举例说明：

在这里要注意一下1*1的卷积核，为什么呢？

举例：一个56*56*64的input，用32个1*1的卷积核进行卷积(每一个卷积核的尺寸为1*1*64，执行64维的点乘操作)，将得到一个56*56*32的output，看到输出的depth减少了，也就是降维，那么parameters也会相应的减少。

下面介绍一下Pooling(池化)操作：

将represention变小，易于操作和控制，对每一个activation map单独进行操作。

用的最多的是最大池化(MAX POOLING)：

Output size=(N-F)/S +1

转载于:https://www.cnblogs.com/Yu-FeiFei/p/6800519.html

关注

1
点赞
踩
1

收藏

觉得还不错? 一键收藏
0
评论
复制链接

分享到 QQ

分享到新浪微博

扫一扫

评论

被折叠的条评论为什么被折叠?

到【灌水乐园】发言

查看更多评论

添加红包

成就一亿技术人!

hope_wisdom

发出的红包

实付元

使用余额支付

点击重新获取

扫码支付

钱包余额 0

抵扣说明：

1.余额是钱包充值的虚拟货币，按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载，可以购买VIP、付费专栏及课程。