机器学习和数据挖掘04-PowerTransformer与 MinMaxScaler

最新推荐文章于 2024-03-09 15:10:01 发布

丰。。

最新推荐文章于 2024-03-09 15:10:01 发布

阅读量1.2k

点赞数

分类专栏：机器学习与数据挖掘文章标签：大数据数据分析人机交互笔记学习

本文链接：https://blog.csdn.net/CSDNXXCQ/article/details/132610459

版权

机器学习与数据挖掘专栏收录该内容

4 篇文章

订阅专栏

本文介绍了Python中的PowerTransformer（幂变换器）和MinMaxScaler（最小-最大缩放器），它们在数据预处理中用于标准化数据以提升机器学习算法性能，特别是对非正态分布数据的处理。

摘要生成于 C知道，由 DeepSeek-R1 满血版支持，前往体验 >

概念 PowerTransformer（幂变换器）

PowerTransformer 是用于对数据进行幂变换（也称为Box-Cox变换）的预处理工具。幂变换可以使数据更接近正态分布，这有助于某些机器学习算法的性能提升。它支持两种常用的幂变换：Yeo-Johnson变换和Box-Cox变换。

代码实现

from sklearn.preprocessing import PowerTransformer
import numpy as np

data = np.array([[1.0], [2.0], [3.0], [4.0], [5.0]])

transformer = PowerTransformer(method='yeo-johnson')
transformed_data = transformer.fit_transform(data)

print("Original Data:\n", data)
print("Transformed Data:\n", transformed_data)

概念MinMaxScaler（最小-最大缩放器）

MinMaxScaler 是用于将数据进行最小-最大缩放的预处理工具。它将数据缩放到指定的范围，通常是
0,到。这对于那些受到特征尺度影响的算法（如K近邻和支持向量机）非常有用。

代码实现

from sklearn.preprocessing import MinMaxScaler
import numpy as np

data = np.array([[1.0], [2.0], [3.0], [4.0], [5.0]])

scaler = MinMaxScaler()
scaled_data = scaler.fit_transform(data)

print("Original Data:\n", data)
print("Scaled Data:\n", scaled_data)