机器学习 --- Adaboost

最新推荐文章于 2024-07-30 01:28:06 发布

川师_King

最新推荐文章于 2024-07-30 01:28:06 发布

阅读量8.3k

点赞数 15

分类专栏： Educoder机器学习编程题解析

本文链接：https://blog.csdn.net/weixin_44196785/article/details/110502486

版权

简介
Adaboost 是属于机器学习里面的监督学习，是一个二分类模型。它是一种迭代算法，其核心思想是针对同一个训练集训练不同的分类器(弱分类器)，然后把这些弱分类器集合起来，构成一个更强的最终分类器(强分类器)。
其算法本身是通过改变数据分布来实现的，它根据每次训练集之中每个样本的分类是否正确，以及上次的总体分类的准确率，来确定每个样本的权值。将修改过权值的新数据集送给下层分类器进行训练，最后将每次训练得到的分类器最后融合起来，作为最后的决策分类器。使用 adaboost 分类器可以排除一些不必要的训练数据特征，并放在关键的训练数据上面。
本实训项目的主要内容是基于 Python 语言搭建出 Adaboost 模型，并训练出一个能够正确对鸢尾花进行分类的模型。

Boosting

在这里插入图片描述

Adaboost算法

# encoding=utf8
import numpy as np
from sklearn.tree import DecisionTreeClassifier
from sklearn.ensemble import AdaBoostClassifier


# adaboost算法
class AdaBoost:
    '''
    input:n_estimators(int):迭代轮数
          learning_rate(float):弱分类器权重缩减系数
    '''

    def __init__(self, n_estimators=50, learning_rate=1.0):
        self.clf_num = n_estimators
        self.learning_rate = learning_rate

    def init_args(self, datasets, labels):
        self.X = datasets
        self.Y = labels
        self.M, self.N = datasets.shape
        # 弱分类器数目和集合
        self.clf_sets = []
        # 初始化weights