机器学习-归一化与标准化对比

归一化

1.定义

通过对原始数据进行变换把数据映射到(默认为[0,1]之间)

2.公式

具体理解

对于特征1来说,min=60,max=90。右表格只显示了第一步,还需要第二步乘以(1-0)再加上0

 3.代码

import pandas as pd
from sklearn.preprocessing import MinMaxScaler,StandardScaler

data=pd.read_csv('E:\学习\iris.csv')
#获取前三列
data=data.iloc[:,:3]
#实例化一个转换器类
#归一化处理
transfer=MinMaxScaler()#默认范围为[0,1] 可自定义
# transfer=MinMaxScaler(feature_range=(1,3))#默认范围为[0,1] 可自定义
#调用fit_transform
data_new=transfer.fit_transform(data)
print(data)
print(data_new)

 若数据存在异常值,一旦最大值或者最小值是异常值的话,结果会有较大的误差,故鲁棒性较差,只适用于传统精确小数据场景。采用标准化进行改进

标准化

1.定义

通过对原始数据进行变换,把数据变换到均值为0,标准差为1的范围内

2.公式

3.代码

import pandas as pd
from sklearn.preprocessing import MinMaxScaler,StandardScaler

data=pd.read_csv('E:\学习\iris.csv')
#获取前三列
data=data.iloc[:,:3]
#实例化一个转换器类
# #标准化处理
transfer=StandardScaler()#默认范围为[0,1] 可自定义
#调用fit_transform
data_new=transfer.fit_transform(data)
print(data)
print(data_new)

&对于归一化来说:如果出现了异常点,影响了最大最小值,那么结果显然会发生改变

&对于标准化来说:如果出现了异常,由于具有一定数据量,少量的异常点对于平均值的影响并不大,从而方差改变较小

  • 0
    点赞
  • 2
    收藏
    觉得还不错? 一键收藏
  • 打赏
    打赏
  • 0
    评论

“相关推荐”对你有帮助么?

  • 非常没帮助
  • 没帮助
  • 一般
  • 有帮助
  • 非常有帮助
提交
评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包

打赏作者

橘子小小甘

你的鼓励将是我创作的最大动力

¥1 ¥2 ¥4 ¥6 ¥10 ¥20
扫码支付:¥1
获取中
扫码支付

您的余额不足,请更换扫码支付或充值

打赏作者

实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值