【机器学习】决策树-理解与使用

一只infp码农

于 2024-08-10 03:29:35 发布

阅读量3

点赞数

文章标签：机器学习决策树人工智能算法数据挖掘

前言

1：决策树原理理解

决策树（decision tree）是一个树结构（可以是二叉树或非二叉树）。

其每个非叶节点表示一个特征属性上的测试，每个分支代表这个特征属性在某个值域上的输出，而每个叶节点存放一个类别。

使用决策树进行决策的过程就是从根节点开始，测试待分类项中相应的特征属性，并按照其值选择输出分支，直到到达叶子节点，将叶子节点存放的类别作为决策结果。

总结来说：

决策树模型核心是下面几部分：

结点和有向边组成
结点有内部结点和叶结点俩种类型
内部结点表示一个特征，叶节点表示一个类

2：决策实例

假如我现在告诉你，我买了一个西瓜，它的特点是纹理是清晰，根蒂是硬挺的瓜，你来给我判断一下是好瓜还是坏瓜，恰好，你构建了一颗决策树，告诉他，没问题，我马上告诉你是好瓜，还是坏瓜？

判断步骤如下：

根据纹理特征，已知是清晰，那么走下面这条路，红色标记：

【机器学习】决策树-理解与使用_决策树

好的，现在咋们到了第二层了，这个时候，由决策树图，我们看到，我们需要知道根蒂的特征是什么了？很好，他也告诉我了，是硬挺，于是，我们继续走，如下面蓝色所示：

【机器学习】决策树-理解与使用_决策树_02

此时，我们到达叶子结点了，根据上面总结的点，可知，叶子结点代表一种类别，我们从如上决策树中，可以知道，这是一个坏瓜！

1：决策时代码使用

import numpy as np

from sklearn.tree import DecisionTreeClassifier 

import sklearn.datasets as datasets

iris = datasets.load\_iris() # 鸟分类数据集
X \= iris\['data'\]
y \= iris\['target'\]

from sklearn.model\_selection import train\_test\_split
X\_train,X\_test,y\_train,y\_test \= train\_test\_split(X,y,test\_size = 0.2)
print("训练集:",X\_train.shape,y\_train.shape)
print("测试集:",X\_test.shape,y\_test.shape)
![](https://img2020.cnblogs.com/blog/1781001/202008/1781001-20200808154800013-1559718335.png)

import sklearn.tree as sk\_tree

model \= sk\_tree.DecisionTreeClassifier(criterion='entropy',max\_depth=None,min\_samples\_split=2,min\_samples\_leaf=1,max\_features=None,max\_leaf\_nodes=None,min\_impurity\_decrease=0)

model.fit(X\_train,y\_train) # 构建决策树
acc\=model.score(X\_test,y\_test) #根据给定数据与标签返回正确率的均值

print('决策树模型评价:',acc)

【机器学习】决策树-理解与使用_ai_03

【机器学习】决策树-理解与使用_人工智能_04

总结：将给的训练集特征分层特征后，进行训练后构建决策树，输入需要预测的特征数据，得出觉得分类

原创作者: u_16163480 转载于: https://blog.51cto.com/u_16163480/11697472

一只infp码农

关注

0
点赞
踩
0

收藏

觉得还不错? 一键收藏
0
评论
【机器学习】决策树-理解与使用

前言1：决策树原理理解决策树（decision tree）是一个树结构（可以是二叉树或非二叉树）。其每个非叶节点表示一个特征属性上的测试，每个分支代表这个特征属性在某个值域上的输出，而每个叶节点存放一个类别。使用决策树进行决策的过程就是从根节点开始，测试待分类项中相应的特征属性，并按照其值选择输出分支，直到到达叶子节点，将...
复制链接

扫一扫