(Torch)SpatialConv and SpatialFullConv

Torch nn模块中包含了常用的卷积层(convolutional layers),本文简单介绍其中两个名字很相似,作用却不同的卷积操作:

  • Spatial Modules: 
    • SpatialConvolution: 在输入图像上进行2D卷积操作(2D convolution)
    • SpatialFullConvolution: 在输入图像上进行2D全卷积操作(2D full convolution)

逐一来看两个卷积操作的定义:

1.SpatialConvolution

module = nn.SpatialConvolution(nInputPlane, nOutputPlane, kW, kH, [dW], [dH], [padW], [padH])

对于多通道的图像进行2D卷积操作,输入的对象(称为tensor)为3D tensor(nInputPlane x height x width), 其中nInputPlane也就是常说的通道数。

函数中各参数的含义为:

  • nInputPlane: 输入图像的通道数
  • nOutputPlane: 卷积层输出数据的通道数(Caffe中的num_output
  • kW: 卷积核窗口宽度
  • kH: 卷积核窗口长度
  • dW: 卷积窗口沿宽边方向上的移动步距,默认值为1
  • dH: 卷积窗口沿长边方向上的移动步距,默认值为1
  • padWpadH: 输入补零,默认值是0,比较好的设置是(kW-1)/2,可以保证卷积后feature map的plane size与输入的plane size一致。

对于一个3D tensor(nInputPlane x height x width),卷积层输出的feature map的plane size为nOutputPlane x oheight x owidth ,其中:

owidth  = floor((width  + 2*padW - kW) / dW + 1)
oheight = floor((height + 2*padH - kH) / dH + 1)

由卷积核对应的权重self.weight(一个nOutputPlane x nInputPlane x kH x kW大小的tensor) 和 偏置 self.bias(一个nOutputPlane大小的tensor),可以计算卷积层输出值:

output[i][j][k] = bias[k]
 + sum_l sum_{s=1}^kW sum_{t=1}^kH weight[s][t][l][k]  * input[dW*(i-1)+s)][dH*(j-1)+t][l]

2.SpatialFullConvolution

module = nn.SpatialFullConvolution(nInputPlane, nOutputPlane, kW, kH, [dW], [dH], [padW], [padH], [adjW], [adjH])

咋一看与SpatialConvolution基本一致,只是多了两个参数而已。在其他框架下,这一操作相当于: “In-network Upsampling”, “Fractionally-strided convolution”, “Backwards Convolution,” “Deconvolution”, or “Upconvolution.”

简单说,就是一个去卷积或者上采样的操作,函数的大部分参数与SpatialConvolution一样:

  • nOutputPlane: 卷积层输出数据的通道数(Caffe中的num_output
  • kW: 卷积核窗口宽度
  • kH: 卷积核窗口长度
  • dW: 卷积窗口沿宽边方向上的移动步距,默认值为1
  • dH: 卷积窗口沿长边方向上的移动步距,默认值为1
  • padWpadH: 输入补零,默认值是0,比较好的设置是(kW-1)/2,可以保证卷积后feature map的plane size与输入的plane size一致
  • adjW: 额外加上一定的宽度或者高度到输出图像中,默认值是0,但是不能超过dW-1/dH-1。

SpatialConvolution不同的是,对于同样的3D tensor(nInputPlane x height x width)输入,输出结果(nOutputPlane x oheight x owidth)的计算方式却不相同:

owidth  = (width  - 1) * dW - 2*padW + kW + adjW oheight = (height - 1) * dH - 2*padH + kH + adjH

更多关于Full Convolution的内容,可以阅读FCN的论文: Fully Convolutional Networks for Semantic Segmentation.


References

  1. https://github.com/torch/nn/blob/master/doc/convolution.md

转载于:https://www.cnblogs.com/ChenKe-cheng/p/11203910.html

  • 0
    点赞
  • 1
    收藏
    觉得还不错? 一键收藏
  • 0
    评论
评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值