数据归一化

数据归一化是将数据按比例缩放,使其落入特定区间,如[-1, 1]或[0, 1],在神经网络、分类算法和聚类中尤为关键。它能赋予所有属性相等权重,防止大范围属性对结果产生过大影响。常用方法包括最小-最大值归一化、z-score归一化、小数定标归一化、对数归一化和反正切函数转换。z-score归一化使用标准差或均值绝对偏差,对离群点更鲁棒。" 111625718,10296153,Python数据清洗:分析药品销售数据,"['Python', '数据清洗', '数据分析']
摘要由CSDN通过智能技术生成

数据归一化,又叫数据规范化或数据标准化,即把属性数据按比例缩放,使之落入一个特定的小区间,如[-1.0, 1.0]或[0.0, 1.0]。

规范化数据试图赋予所有属性相等的权重。对于涉及神经网络的分类算法或基于距离度量的分类(如最近邻分类)和聚类,规范化特别有用。如果使用神经网络后向传播算法进行分类挖掘,对训练元组中每个属性的输入值规范化有助于加快学习速度。对于基于距离的方法,规范化可以帮助防止具有较大初始值域的属性(如income)与具有较小初始值域的属性(如二元属性)相比权重过大。在没有数据的先验知识时,规范化也是有用的。

常用的数据规范化方法有以下几种:

1. 最小-最大值归一化

    

     一般情况下new_maxA取1,new_minA取0,此时公式1.1可简化为:

    

评论 1
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值