机器学习部分：数据的标准化（归一化）

最新推荐文章于 2023-12-15 14:36:54 发布

道法—自然

最新推荐文章于 2023-12-15 14:36:54 发布

阅读量1.2k

点赞数

本文链接：https://blog.csdn.net/wyqwilliam/article/details/81697662

版权

数据标准化是数据挖掘中的重要步骤，旨在消除量纲影响，提升数据比较和分析的准确性。本文介绍了几种常见的数据标准化方法，包括最小-最大标准化、z-score标准化、小数定标标准化、对数Logistic模式和模糊量化模式。每种方法都有其适用场景和计算公式，如z-score标准化基于数据的均值和标准差，确保数据符合标准正态分布。标准化处理后的数据可进行有效的综合对比评价。

摘要由CSDN通过智能技术生成

数据归一化方法

数据标准化（normalization）数据标准化处理主要包括数据同趋化处理和无量纲化处理两个方面。

数据同趋化处理主要解决不同性质数据问题，对不同性质指标直接加总不能正确反映不同作用力的综合结果，须先考虑改变逆指标数据性质，使所有指标对测评方案的作用力同趋化，再加总才能得出正确结果。

数据无量纲化处理主要解决数据的可比性。数据标准化的方法有很多种，常用的有“最小—最大标准化”、“Z-score标准化”和“按小数定标标准化”等。经过上述标准化处理，原始数据均转换为无量纲化指标测评值，即各指标值都处于同一个数量级别上，可以进行综合测评分析。

数据标准化（归一化）处理是数据挖掘的一项基础工作，不同评价指标往往具有不同的量纲和量纲单位，这样的情况会影响到数据分析的结果，为了消除指标之间的量纲影响，需要进行数据标准化处理，以解决数据指标之间的可比性。原始数据经过数据标准化处理后，各指标处于同一数量级，适合进行综合对比评价。归一化化就是要把你需要处理的数据经过处理后（通过某种算法）限制在你需要的一定范围内。首先归一化是为了后面数据处理的方便，其次是保正程序运行时收敛加快。

一、标准化
标准化方法是对原始数据进行线性变换。设minA和maxA分别为属性A的最小值和最大值，将A的一个原始值x通过标准化映射成在区间[0,1]中的值，其公式为：
新数据=（原数据