图像数据的表示与预处理

   

图像数据可以表示为像素点的集合,每个像素点有一个,三个或者四个通道:

  • 一通道:即灰度
  • 三通道:(RGB)
  • 四通道:(RGBA),A即为透明度

       一般来说,在神经网络的神经元之间互项传递的数据是以浮点数的形式来表示的,而图像,文本,语言都不是按照浮点数的形式存储。因此需要数据预处理。

       单个像素点的通道的取值范围为0~255这256个整数,由于0~255之间的整数在计算机上可以用一字节来表示,所以一个像素的一个通道大小是一字节(8比特),一般称为byte或者unit8类型。

       最近邻插值(Nearest Neighbor Interpolation),双线性插值(Bilinear Interpolation)的目的:因为一些图像大小不同,在神经网络的训练过程中需要同时处理很多图片,我们需要这些图片的大小相同,所以采用插值算法把图像调整为目标大小。

       为了扩增数据集,提高网络的泛化能力,还可以对图进行轻微的色彩变化,把图片从RGB变换为HSV(H色相,S饱和度,B明度),然后在这三个值上做5%~10%的随机增减,再变换回RGB。

       调整好大小后,就可以把图片的所有像素的所有通道除以255,转化为0~1之间的浮点数,因为在神经网络的神经元之间互项传递的数据是以浮点数的形式来表示的。

       在转化为张量后,还需要一些其它操作,比如归一化(Normalition),因为图像像素的分布多种多样,为了让数据分布规整,有利于网络的训练。让这批图像张量减去所有图像的平均值再除以所有图像的方差。

  • 1
    点赞
  • 0
    收藏
    觉得还不错? 一键收藏
  • 1
    评论

“相关推荐”对你有帮助么?

  • 非常没帮助
  • 没帮助
  • 一般
  • 有帮助
  • 非常有帮助
提交
评论 1
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值