pca java weka_维度规约（降维）算法在WEKA中应用

嗨了伐得了

于 2021-02-26 23:54:03 发布

阅读量907

点赞数

文章标签： pca java weka

本文链接：https://blog.csdn.net/weixin_35832025/article/details/114764641

版权

本文探讨了维度规约的重要性，重点介绍了PCA（主成分分析）和SOM（自组织映射）两种特征提取技术。PCA通过线性重组变量减少数据集的维度，而SOM则保持数据的拓扑结构。PCA在Weka中得到应用，通过选取主成分降低数据冗余。SOM则用于数据的可视化和聚类。

摘要由CSDN通过智能技术生成

维度的诅咒是一种现象，即数据集维度的增加导致产生该数据集的代表性样本所需的指数级更多的数据。为了对抗维度的诅咒，已经开发了许多线性和非线性降维技术。这些技术旨在通过特征选择或特征提取来减少数据集中维度(变量)的数量，而不会显着丢失信息。特征提取是将原始数据集转换为维数较少的数据集的过程。两个众所周知的，密切相关的特征提取技术是主成分分析(PCA)和自组织映射(SOM)。人们可以把降维作为一个渡槽系统来理解数据的河流。 1190000022158373

主成分分析(PCA)

主成分分析(PCA)是一种统计算法，用于将一组可能相关的变量转换为一组称为主成分的变量的不相关线性重组。简而言之，主要组成部分，ÿ，是我们数据集中变量的线性组合， X，那里的权重， ËĴŤ是从我们的数据集的协方差或相关矩阵的特征向量导出的。

第一个主要成分是使数据点距离的平方和最小的直线。它是单行数据集的最小二乘逼近。因此，第一个主要组成部分解释了数据集的最高变异量。然后从数据集中提取残差并计算下一个主成分。如此，每个连续的部件解释较少的方差，从而从中减少了变量的个数 X，米，主要组件的数量， ķ。在使用PCA时存在一些挑战。从而从中减少了变量的个数 X，米，主要组件的数量， ķ。在使用PCA时存在一些挑战。首先&

最低0.47元/天解锁文章

嗨了伐得了

关注

0
点赞
踩
1

收藏

觉得还不错? 一键收藏
0
评论
pca java weka_维度规约（降维）算法在WEKA中应用

维度的诅咒是一种现象，即数据集维度的增加导致产生该数据集的代表性样本所需的指数级更多的数据。为了对抗维度的诅咒，已经开发了许多线性和非线性降维技术。这些技术旨在通过特征选择或特征提取来减少数据集中维度(变量)的数量，而不会显着丢失信息。特征提取是将原始数据集转换为维数较少的数据集的过程。两个众所周知的，密切相关的特征提取技术是主成分分析(PCA)和自组织映射(SOM)。人们可以把降维作为一个渡...
复制链接

扫一扫