机器学习/深度学习小问题

最新推荐文章于 2022-06-03 16:31:15 发布

gaochang21

最新推荐文章于 2022-06-03 16:31:15 发布

阅读量401

点赞数

分类专栏：机器学习数据预处理文章标签：数据预处理机器学习

机器学习同时被 2 个专栏收录

5 篇文章 0 订阅

订阅专栏

数据预处理

1 篇文章 0 订阅

订阅专栏

数据预处理

1、为什么数据进行零中心化处理？
以sigmoid激活函数为例。Sigmoid函数的输出不是零中心的。这个性质并不是我们想要的，因为在神经网络后面层中的神经元得到的数据将不是零中心的。这一情况将影响梯度下降的运作，因为如果输入神经元的数据总是正数（比如在f=w^Tx+b中每个元素都x>0），那么关于w的梯度在反向传播的过程中，将会要么全部是正数，要么全部是负数（具体依整个表达式f而定），这是因为W的梯度是X，如果X为正则W的梯度为正。这将会导致梯度下降权重更新时出现z字型的下降。然而，可以看到整个批量的数据的梯度被加起来后，对于权重的最终更新将会有不同的正负，这样就从一定程度上减轻了这个问题。因此，该问题相对于上面的神经元饱和问题来说只是个小麻烦，没有那么严重。

2、为什么数据进行归一化处理？
答：在一些实际问题中，我们得到的样本数据都是多个维度的，即一个样本是用多个特征来表征的。比如在预测房价的问题中，影响房价 Y 的因素有房子面积X1、卧室X2数量等，我们得到的样本数据就是这样一些样本点，这里的(X1,X2)又被称为特征。很显然，这些特征的量纲和数值得量级都是不一样的，在预测房价时，如果直接使用原始的数据值，那么他们对房价的影响程度将是不一样的，而通过标准化处理，可以使得不同的特征具有相同的尺度（Scale）。这样，在使用梯度下降法学习参数的时候，不同特征对参数的影响程度就一样了。
简言之，当原始数据不同维度上的特征的尺度（单位）不一致时，需要标准化步骤对数据进行预处理。
其实，在不同的问题中，中心化和标准化有着不同的意义:
比如在训练神经网络的过程中，通过将数据标准化，能够加速权重参数的收敛。
另外，对于主成分分析（PCA）问题，也需要对数据进行中心化和标准化等预处理步骤。

这里写图片描述