机器学习入门之决策树完成鸢尾花分类
决策树是机器学习中一种简单而又经典的算法,学习使用 scikit-learn 来构建一个决策树分类模型,最后使用此模型预测鸢尾花的种类
决策树基本原理
决策树简介
决策树是一种特殊的树形结构,一般由节点和有向边组成。其中,节点表示特征、属性或者一个类。而有向边包含有判断条件。
如图所示,决策树从根节点开始延伸,经过不同的判断条件后,到达不同的子节点。而上层子节点又可以作为父节点被进一步划分为下层子节点。一般情况下,我们从根节点输入数据,经过多次判断后,这些数据就会被分为不同的类别。这就构成了一颗简单的分类决策树。
举一个小例子,假设在蓝桥云课工作多年仍然单身的小楼和他母亲在给他介绍对象时的一段对话:
母亲:小楼,你都 28 了还是单身,明天亲戚家要来个姑娘要不要去见见。
小楼:多大年纪?
母亲:26。
小楼:有多高?
母亲:165厘米。
小楼:长的好看不。
母亲:还行,比较朴素。
小楼:温柔不?
母亲:看起来挺温柔的,很有礼貌。
小楼:好,去见见。
作为程序员的小楼的思考逻辑就是典型的决策树分类逻辑,将年龄,身高,长相&#