卷积相关知识

最新推荐文章于 2024-07-08 01:47:11 发布

爱抖腿的小松鼠

最新推荐文章于 2024-07-08 01:47:11 发布

阅读量1k

点赞数

文章标签：深度学习 cnn 人工智能

本文链接：https://blog.csdn.net/u011514176/article/details/123547539

版权

二维图片卷积

二维卷积可以处理二维数据
nn.Conv2d(self, in_channels, out_channels, kernel_size, stride=1, padding=0, dilation=1, groups=1, bias=True))
参数：
in_channel:　输入数据的通道数，例RGB图片通道数为3；
out_channel: 输出数据的通道数，这个根据模型调整；
kennel_size: 卷积核大小，可以是int，或tuple；kennel_size=2,意味着卷积大小(2,2)， kennel_size=（2,3），意味着卷积大小（2，3）即非正方形卷积
stride：步长，默认为1，与kennel_size类似，stride=2,意味着步长上下左右扫描皆为2， stride=（2,3），左右扫描步长为2，上下为3；
padding：　零填充
例子
输入数据X[10,16,30,32],其分别代表：10组数据，通道数为16，高度为30，宽为32
import torch
import torch.nn as nn

x = torch.randn(10, 16, 30, 32) # batch, channel , height , width
print(x.shape)
m = nn.Conv2d(16, 33, (3, 2), (2,1)) # in_channel, out_channel ,kennel_size,stride
print(m)
y = m(x)
print(y.shape)

结果：
torch.Size([10, 16, 30, 32])
Conv2d(16, 33, kernel_size=(3, 2), stride=(2, 1))
torch.Size([10, 33, 14, 31])

3.卷积计算过程：
h/w = (h/w - kennel_size + 2padding) / stride + 1
x = ([10,16,30,32]),其中h=30,w=32,对于卷积核长分别是 h:3，w:2 ；对于步长分别是h：2，w:1；padding默认0；
h = (30 - 3 + 20)/ 2 +1 = 27/2 +1 = 13+1 =14
w =(32 - 2 + 2*0)/ 1 +1 = 30/1 +1 = 30+1 =31
batch = 10, out_channel = 33
故： y= ([10, 33, 14, 31])
总结一下：kernnel size是控制特征图大小的，输出通道数量可以随便自己定的

1*1 卷积核的作用是什么？？

1x1的卷积核可以进行降维或者升维，也就是通过控制卷积核（通道数）实现，这个可以帮助减少模型参数，也可以对不同特征进行尺寸的归一化；同时也可以用于不同channel上特征的融合。一个trick就是在降维的时候考虑结合传统的降维方式，如PCA的特征向量实现，这样效果也可以得到保证。
11卷积的主要作用有以下几点：
1、降维。比如，一张500 * 500且厚度depth为100 的图片在20个filter上做11的卷积，那么结果的大小为50050020。
2、加入非线性。卷积层之后经过激励层，1*1的卷积在前一层的学习表示上添加了非线性激励，提升网络的表达能力；
3、增加模型深度。可以减少网络模型参数，增加网络层深度，一定程度上提升模型的表征能力。

爱抖腿的小松鼠

关注

0
点赞
踩
1

收藏

觉得还不错? 一键收藏
0
评论
卷积相关知识

二维图片卷积二维卷积可以处理二维数据nn.Conv2d(self, in_channels, out_channels, kernel_size, stride=1, padding=0, dilation=1, groups=1, bias=True))参数： in_channel:　输入数据的通道数，例RGB图片通道数为3； out_channel: 输出数据的通道数，这个根据模型调整； kennel_size: 卷积核大小，可以是int，或tuple；kennel_size=2,意
复制链接

扫一扫