数据挖掘之数据归一化处理

数据归一化是数据挖掘的重要步骤,确保不同尺度的指标可比。本文介绍了min-max标准化和Z-score标准化两种方法。min-max标准化将数据变换至[0,1]区间,但易受新数据影响;Z-score标准化则使数据符合标准正态分布,均值为0,标准差为1。" 77133539,5608023,Hadoop集群安装与配置实战,"['Hadoop', '大数据开发', '分布式系统', '集群配置', 'MapReduce']
摘要由CSDN通过智能技术生成

数据归一化和两种常用的归一化方法

 

数据标准化(归一化)处理是数据挖掘的一项基础工作,不同评价指标往往具有不同的量纲和量纲单位,这样的情况会影响到数据分析的结果,为了消除指标之间的量纲影响,需要进行数据标准化处理,以解决数据指标之间的可比性。原始数据经过数据标准化处理后,各指标处于同一数量级,适合进行综合对比评价。以下是两种常用的归一化方法:

一、min-max标准化(Min-Max Normalization)

也称为离差标准化,是对原始数据的线性变换,使结果值映射到[0 - 1]之间。转换函数如下:

评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值