PCA和LDA简介

PCA:

PCA(Principal Component Analysis),即主成分分析方法,是一种使用最广泛的数据降维算法,可用于提取数据的主要特征分量。

目的:

在高维数据中找方差最大的方向, 将n维特征映射到k维上(k < n),k维特征是全新的正交特征,也叫主成分。

步骤:

1)将原始数据按列组成n行m列矩阵X;
2)将X的每一行(代表一个属性字段)进行零均值化,即减去这一行的均值;
3)求出协方差矩阵;
4)求出协方差矩阵的特征值及对应的特征向量;
5)按对应特征值从大到小顺序排序,将对应特征向量按行排列成矩阵,取前k行组成矩阵U;
6)Y=UX即为降维到k维后的数据;

LDA:

LDA(Linear Discriminate Analysis)把线性分类看成是数据降维的一种应用。

特点:

可以作为一种特征抽取的技术;
需要监督信息;
对于不适用于正则化的模型,可以降低因为纬度灾难带来的过拟合;

目的:

通过最小化类内距离,最大化类间距来找到最优化分类的特征子空间。

步骤:

1)计算类内散度矩阵 S w S_{w} Sw;
2)计算类间散度矩阵 S b S_{b} Sb;
3)计算矩阵 S w − 1 S b S_{w}^{-1} S_{b} Sw1Sb;
4) 计算矩阵 S w − 1 S b S_{w}^{-1} S_{b} Sw1Sb; 的特征值以及对应的特征向量;
5) 选择前k个特征向量构造一个 d∗k 维的转换矩阵 W, 其中特征向量以列的形式排列;
6)对样本集中的每一个样本特征 x i x_{i} xi,转化为新的样本 Y i = W T x i Y_{i} = W^{T}x_{i} Yi=WTxi;

相同与不同:

PCALDA
目的降维降维
数据分布假设数据符合高斯分布假设数据符合高斯分布
思想矩阵特征分解思想矩阵特征分解思想
是否有监督无监督有监督
降维方式去掉原始数据冗余的维度选择一个最佳投影方向,使类内距离更紧凑,类间距离更远
降维维度降低的维度与类别无关最多降到K-1维,K为类别
拟合情况可能会过拟合
  • 1
    点赞
  • 5
    收藏
    觉得还不错? 一键收藏
  • 1
    评论

“相关推荐”对你有帮助么?

  • 非常没帮助
  • 没帮助
  • 一般
  • 有帮助
  • 非常有帮助
提交
评论 1
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值