Python零基础入门数据分析实战之小费数据集应用

最新推荐文章于 2024-02-14 00:02:08 发布

搬砖的苦行僧

最新推荐文章于 2024-02-14 00:02:08 发布

阅读量1.9k

点赞数 1

分类专栏：数据分析文章标签：数据挖掘数据分析 csv logback bmp

本文链接：https://blog.csdn.net/WhyLW/article/details/108088035

版权

本文介绍了一位Python初学者使用seaborn自带的小费数据集进行数据分析的过程，包括数据来源、问题探索、数据清洗和数据探索。研究了小费金额与消费总金额的关系，以及性别、吸烟状况、星期和聚餐人数对小费的影响。结果显示小费与消费总金额正相关，女性小费较低，周末小费较高，且小费比例大致服从正态分布。

摘要由CSDN通过智能技术生成

在这里插入图片描述

一、数据来源

本节选用的是Python的第三方库seaborn自带的数据集，该小费数据集为餐饮行业收集的数据，其中total_bill为消费总金额、tip为小费金额、sex为顾客性别、smoker为顾客是否吸烟、day为消费的星期、time为聚餐的时间段、size为聚餐人数。

import numpy as np 
from pandas import Series,DataFrame 
import pandas as pd 
import seaborn as sns    #导入seaborn库 
tips=sns.load_dataset('tips')  #seaborn库自带的数据集 
tips.head()

在这里插入图片描述

二、问题探索

小费金额与消费总金额是否存在相关性?
性别、是否吸烟、星期几、聚餐人数和小费金额是否有一定的关联?
小费金额占小费总金额的百分比是否服从正态分布?

三、数据清洗

tips.shape #数据集的维度

(244，7)

共有244条数据，7列。

tips.describe() #描述统计

在这里插入图片描述
描述统计结果如上所示。

tips.info() #查看缺失值信息 
<

最低0.47元/天解锁文章

搬砖的苦行僧

关注

1
点赞
踩
11

收藏

觉得还不错? 一键收藏
0
评论
Python零基础入门数据分析实战之小费数据集应用

一、数据来源本节选用的是Python的第三方库seaborn自带的数据集，该小费数据集为餐饮行业收集的数据，其中total_bill为消费总金额、tip为小费金额、sex为顾客性别、smoker为顾客是否吸烟、day为消费的星期、time为聚餐的时间段、size为聚餐人数。import numpy as np from pandas import Series,DataFrame import pandas as pd import seaborn as sns #导入seaborn库 .
复制链接

扫一扫