数仓实验二:关联规则挖掘实验(利用Python实现)
文章目录
一、实验目的
通过本实验,对利用Apriori和FP-growth算法发现频繁项集、构建关联规则的方法有准确的理解。并掌握利用Sql Server等工具平台进行关联规则挖掘的方法,掌握挖掘结构、挖掘模型的基本概念,能够使用数据挖掘向导创建数据挖掘结构和模型,掌握数据挖掘设计器的使用方法,掌握模型查看器方法 ,理解关联规则挖掘常用的参数含义和设置方法。
二、实验内容和要求
针对实际需求,构建格式规范的数据集,并能够借助于SQL Server、Weka、SPSS等工具平台,利用Apriori/FP-growth 算法,进行关联规则挖掘,正确分析实验结果,发现知识,完成实验报告。
三、实验步骤
下面是以Python作为工具,完成数据集的构建和关联规则的挖掘。我们所使用的数据集是自生成的,我所选择的实验内容是分析挖掘学生洗澡时间段与学生学习时间和成绩的关联
。
1、生成数据集
import random
import csv
# 生成数据集
data = [