B站:啥都会一点的研究生
公众号试读:啥都会一点的研究生
目录
说说怎样避免维数灾难?
1.主成分分析法PCA,线性判别法LDA
2.奇异值分解简化数据、拉普拉斯特征映射
3.Lassio缩减系数法、小波分析法
说说降维的必要性?
1.多重共线性和预测变量之间相互关联。多重共线性会导致解空间的不稳定,从而可能导致结果不连贯。
2.高维空间本身具有稀疏性。一维正态分布有68%的值落于正负标准差之间,而在十维空间上只有2%。
3.过多的变量对查找规律造成冗余麻烦。
4.仅在变量层面上分析可能会忽略变量之间的潜在联系。例如几个预测变量可能落入仅反映数据某一方面特征的一个组内。