数据归一化

最新推荐文章于 2024-07-16 10:23:12 发布

大米GoGoGo

最新推荐文章于 2024-07-16 10:23:12 发布

阅读量3.1k

点赞数

分类专栏：数据挖掘

版权声明：本文为博主原创文章，遵循 CC 4.0 BY-SA 版权协议，转载请附上原文出处链接和本声明。

本文链接：https://blog.csdn.net/wrm_nancy/article/details/51542210

版权

数据归一化是将数据按比例缩放，使其落入特定区间，如[-1, 1]或[0, 1]，在神经网络、分类算法和聚类中尤为关键。它能赋予所有属性相等权重，防止大范围属性对结果产生过大影响。常用方法包括最小-最大值归一化、z-score归一化、小数定标归一化、对数归一化和反正切函数转换。z-score归一化使用标准差或均值绝对偏差，对离群点更鲁棒。" 111625718,10296153,Python数据清洗：分析药品销售数据,"['Python', '数据清洗', '数据分析']

摘要由CSDN通过智能技术生成

数据归一化，又叫数据规范化或数据标准化，即把属性数据按比例缩放，使之落入一个特定的小区间，如[-1.0, 1.0]或[0.0, 1.0]。

规范化数据试图赋予所有属性相等的权重。对于涉及神经网络的分类算法或基于距离度量的分类（如最近邻分类）和聚类，规范化特别有用。如果使用神经网络后向传播算法进行分类挖掘，对训练元组中每个属性的输入值规范化有助于加快学习速度。对于基于距离的方法，规范化可以帮助防止具有较大初始值域的属性（如income）与具有较小初始值域的属性（如二元属性）相比权重过大。在没有数据的先验知识时，规范化也是有用的。

常用的数据规范化方法有以下几种：

1. 最小-最大值归一化

一般情况下new_maxA取1，new_minA取0，此时公式1.1可简化为：

最低0.47元/天解锁文章

关注

0
点赞
踩
4

收藏

觉得还不错? 一键收藏
1
评论
复制链接

分享到 QQ

分享到新浪微博

扫一扫

专栏目录

评论 1

被折叠的条评论为什么被折叠?

到【灌水乐园】发言

查看更多评论

添加红包

成就一亿技术人!

hope_wisdom

发出的红包

实付元

使用余额支付

点击重新获取

扫码支付

钱包余额 0

抵扣说明：

1.余额是钱包充值的虚拟货币，按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载，可以购买VIP、付费专栏及课程。