随机森林

决策树

随机森林算法是机器学习、计算机视觉等领域内应用极为广泛的一个算法,它不仅可以用来做分类,也可用来做回归即预测,随机森林机由多个决策树构成,相比于单个决策树算法,它分类、预测效果更好,不容易出现过度拟合的情况。


图1 具体例子

决策树的含义:

决策树是数据挖掘与机器学习领域中一种非常重要的分类器,算法通过训练数据来构建一棵用于分类的树,从而对未知数剧进行高校分类。

决策树的构建步骤:

  1. 将所有记录看作是一个节点
  2. 遍历每个记录的分割方式,找到最好的分割点
  3. 利用分割点将记录分割成两个子节点C1和C2
  4. 对子结点C1和C2重复执行步骤2. 3. 直到满足特定条件为止。
分割点:

寻找好的分割点是通过量化分割后类的纯度来确定的,目前有三种纯度计算方式,分别是Gini不纯度、熵(Entropy)及错误率,它们的公式定义为:(1)、

  • 0
    点赞
  • 1
    收藏
    觉得还不错? 一键收藏
  • 0
    评论
评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值