Python零基础入门数据分析实战之小费数据集应用

本文介绍了一位Python初学者使用seaborn自带的小费数据集进行数据分析的过程,包括数据来源、问题探索、数据清洗和数据探索。研究了小费金额与消费总金额的关系,以及性别、吸烟状况、星期和聚餐人数对小费的影响。结果显示小费与消费总金额正相关,女性小费较低,周末小费较高,且小费比例大致服从正态分布。
摘要由CSDN通过智能技术生成

在这里插入图片描述

一、数据来源

本节选用的是Python的第三方库seaborn自带的数据集,该小费数据集为餐饮行业收集的数据,其中total_bill为消费总金额、tip为小费金额、sex为顾客性别、smoker为顾客是否吸烟、day为消费的星期、time为聚餐的时间段、size为聚餐人数。

import numpy as np 
from pandas import Series,DataFrame 
import pandas as pd 
import seaborn as sns    #导入seaborn库 
tips=sns.load_dataset('tips')  #seaborn库自带的数据集 
tips.head() 

在这里插入图片描述

二、问题探索

  • 小费金额与消费总金额是否存在相关性?
  • 性别、是否吸烟、星期几、聚餐人数和小费金额是否有一定的关联?
  • 小费金额占小费总金额的百分比是否服从正态分布?

三、数据清洗

tips.shape #数据集的维度 

(244,7)

共有244条数据,7列。

tips.describe() #描述统计 

在这里插入图片描述
描述统计结果如上所示。

tips.info() #查看缺失值信息 
<
  • 1
    点赞
  • 11
    收藏
    觉得还不错? 一键收藏
  • 0
    评论

“相关推荐”对你有帮助么?

  • 非常没帮助
  • 没帮助
  • 一般
  • 有帮助
  • 非常有帮助
提交
评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值