ML之01-核密度估计Kernel Density Estimation(KDE)

核密度估计(KDE)是概率统计中的一种非参数估计方法,用于估计未知密度函数。它不需要事先假设数据分布,适用于各种场景,如风险预测、建筑密度测量和热力图绘制。在机器学习中,KDE在SVM中选择合适的核函数也至关重要,带宽的选择直接影响结果。sklearn库提供了多种核函数实现。
摘要由CSDN通过智能技术生成

ML之01-核密度估计Kernel Density Estimation(KDE)


由给定样本集合求解随机变量的分布密度函数问题是概率统计学的基本问题之一。解决这一问题的方法包括参数估计和非参数估计。

参数估计

  • 参数回归分析
    需要假定数据分布符合某种特定的性态,如线性、可化线性或指数性态等,然后在目标函数族中寻找特定的解,即确定回归模型中的未知参数。
  • 参数判别分析
    需要假定作为判别依据的、随机取值的数据样本在各个可能的类别中都服从特定的分布。

经验和理论说明,参数模型的这种基本假定与实际的物理模型之间常常存在较大的差距,这些方法并非总能取得令人满意的结果。

非参数估计

由于上述缺陷,Rosenblatt和Parzen提出了非参数估计方法,即核密度估计方法。核密度估计Kernel Density Estimation(KDE)是在概率论中用来估计未知的密度函数,属于非参数检验方法之一。

由于核密度估计方法不利用有关数据分布的先验知识,对数据分布不附加任何假定,是一种从数据样本本身出发研究数据分布特征的方法,因而,在统计学理论和应用领域均受到高度的重视。

核密度估计,就是采用平滑的峰值函数(“核”)来拟合观察到的数据点,从而对真实的概率分布曲线进行模拟。

sklearn中实现的核函数

核密度估计有多种内核,如下图:
image

评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值