数仓实验三:分类规则挖掘实验(利用Python实现)
文章目录
一、实验目的
通过本实验,进一步理解决策树算法、朴素贝叶斯算法进行分类的原理,并掌握利用SQL Server等工具平台进行分类规则挖掘的方法,掌握挖掘结构、挖掘模型的基本概念,能够使用数据挖掘向导创建数据挖掘结构和模型,掌握数据挖掘设计器的使用方法,掌握模型查看器方法,理解分类规则挖掘常用的参数含义和设置方法。
二、实验内容和要求
针对实际需求,构建格式规范的数据集,并能够借助于SQL Server、Weka、SPSS等工具平台,利用决策树(Decision tree)算法、朴素贝叶斯(Naïve Bayes)算法进行分类和预测,正确分析实验结果,完成实验报告。
三、实验步骤
以下实验我以Python作为工具,利用鸢尾花数据集完成分类规则的挖掘(利用决策树算法、SVM算法、KNN算法实现)。
1、加载数据集
import pandas as pd
import matplotlib.pyplot as plt