常用数据归一化方法

原创 2017年08月08日 15:06:43

    数据归一化是为了缩小数量之间的相对关系以及消除指标之间的量纲影响,解决数据指标之间的可比性。数据经过归一化处理之后,各指标处于同一数量级,方便进一步处理数据。
    机器学习中数据处理时常用的数据归一化方法有以下三种:
    
1. 最值归一化(Feature scaling)
    这是一种线性归一化方法,对原始数据进行线性变换,使原始数据映射到[0,1]或者某个自定义的区间内。
    映射到[0,1]区间:


[0-1]区间

    映射到[a, b]区间:


[a, b]区间

    
2. 标准方差归一化(Standard score)
    这种方法是基于原始数据的均值和方差的归一化方法。标准化后的数据均值为0,方差为1,服从标准正态分布。


这里写图片描述

    其中,μ为原始数据均值,σ为原始数据标准方差。
    
3. 中值归一化
    此方法多用于数据中没有错误样本,只是单纯将数据等比例扩大或者缩小的情况。


这里写图片描述

更多内容

版权声明:本文为博主原创文章,未经博主允许不得转载。

机器学习中数据归一化和两种常用的归一化方法

机器学习、数据挖掘工作中,数据前期准备、数据预处理过程、特征提取等几个步骤几乎要花费数据工程师一半的工作时间。同时,数据预处理的效果也直接影响了后续模型能否有效的工作。然而,目前的大部分学术研究主要集...
  • suibianshen2012
  • suibianshen2012
  • 2016年05月09日 14:07
  • 7306

数据归一化和两种常用的归一化方法

转载自:http://www.cnblogs.com/chaosimple/p/3227271.html
  • AiTODD1
  • AiTODD1
  • 2014年09月25日 12:49
  • 1041

数据归一化和两种常用的归一化方法

数据标准化(归一化)处理是数据挖掘的一项基础工作,不同评价指标往往具有不同的量纲和量纲单位,这样的情况会影响到数据分析的结果,为了消除指标之间的量纲影响,需要进行数据标准化处理,以解决数据指标之间的可...
  • caiandyong
  • caiandyong
  • 2015年07月06日 20:44
  • 638

数据归一化和两种常用的归一化方法

数据标准化(归一化)处理是数据挖掘的一项基础工作,不同评价指标往往具有不同的量纲和量纲单位,这样的情况会影响到数据分析的结果,为了消除指标之间的量纲影响,需要进行数据标准化处理,以解决数据指标之间的可...
  • GSH_Hello_World
  • GSH_Hello_World
  • 2017年04月22日 09:51
  • 223

数据归一化和两种常用的归一化方法

数据标准化(归一化)处理是数据挖掘的一项基础工作,不同评价指标往往具有不同的量纲和量纲单位,这样的情况会影响到数据分析的结果,为了消除指标之间的量纲影响,需要进行数据标准化处理,以解决数据指标之间的可...
  • qq_33228039
  • qq_33228039
  • 2017年11月19日 21:01
  • 27

数据归一化处理

在机器学习中领域中的数据分析之前,通常需要将数据标准化,利用标准化后得数据进行数据分析。不同评价指标往 往具有不同的量纲和量纲单位,这样的情况会影响到数据分析的结果,为了消除指标之间的量纲影响,需要...
  • ACdreamers
  • ACdreamers
  • 2015年03月27日 01:22
  • 7708

数据归一化和两种常用的归一化方法

数据标准化(归一化)处理是数据挖掘的一项基础工作,不同评价指标往往具有不同的量纲和量纲单位,这样的情况会影响到数据分析的结果,为了消除指标之间的量纲影响,需要进行数据标准化处理,以解决数据指标之间的可...
  • u011630575
  • u011630575
  • 2018年01月03日 16:28
  • 52

机器学习的数据归一化方法

作用:对于不同的特征向量,比如年龄、购买量、购买额,在数值的量纲上相差十倍或者百千倍。如果不归一化处理,就不容易进行比较、求距离,模型参数和正确度精确度就会受影响,甚至得不出正确的结果。 举个例子:...
  • qq_23617681
  • qq_23617681
  • 2016年05月21日 12:09
  • 2496

数据归一化和两种常用的归一化方法

 数据标准化(归一化)处理是数据挖掘的一项基础工作,不同评价指标往往具有不同的量纲和量纲单位,这样的情况会影响到数据分析的结果,为了消除指标之间的量纲影响,需要进行数据标准化处理,以解决...
  • lxw907304340
  • lxw907304340
  • 2015年06月11日 10:14
  • 299

数据归一化和两种常用的归一化方法

数据标准化(归一化)处理是数据挖掘的一项基础工作,不同评价指标往往具有不同的量纲和量纲单位,这样的情况会影响到数据分析的结果,为了消除指标之间的量纲影响,需要进行数据标准化处理,以解决数据指标之间的可...
  • oucpowerman
  • oucpowerman
  • 2015年11月09日 17:50
  • 306
内容举报
返回顶部
收藏助手
不良信息举报
您举报文章:常用数据归一化方法
举报原因:
原因补充:

(最多只允许输入30个字)