DAY10 宝可梦数据分析

最新推荐文章于 2022-10-10 14:44:49 发布

TJwuyeyoumin

最新推荐文章于 2022-10-10 14:44:49 发布

阅读量497

点赞数

分类专栏： Python基础学习

本文链接：https://blog.csdn.net/TJwuyeyoumin/article/details/108655080

版权

数据集下载

import pandas as pd 
import seaborn as sns 
import matplotlib.pyplot as plt  df = pd.read_csv("./pokemon_data.csv")

首先我们观察一下数据的尺寸，可以通过 df.shape 这个来实现。当然 df.info() 能够给我们更加详细的每个列的信息。这里我们通过这个方式，可以发现这个数据集一共收录了801行，41列的数据。说明一共有801只宝可梦，每只宝可梦我们有41个特征来描述它们。

然后就迎来了我们的第一个问题：这么多特征，是否会有数据缺失呢？毕竟有些宝可梦比较神秘感，就连大木博士都不一定知道。这里我们可以通过如下代码来观察每个特征的缺失情况：

# 计算出每个特征有多少百分比是缺失的
percent_missing = df.isnull().sum() * 100 / len(df)
missing_value_df = pd.DataFrame({
   
    'column_name': df.columns,
    'percent_missing': percent_missing
})
# 查看Top10缺失的
missing_value_df.sort_values(by='percent_missing', ascending=False).

最低0.47元/天解锁文章

TJwuyeyoumin

关注

0
点赞
踩
6

收藏

觉得还不错? 一键收藏
0
评论
DAY10 宝可梦数据分析

数据集下载import pandas as pd import seaborn as sns import matplotlib.pyplot as plt df = pd.read_csv("./pokemon_data.csv")首先我们观察一下数据的尺寸，可以通过 df.shape 这个来实现。当然 df.info() 能够给我们更加详细的每个列的信息。这里我们通过这个方式，可以发现这个数据集一共收录了801行，41列的数据。说明一共有801只宝可梦，每只宝可梦我们有41个特征来描述它们。
复制链接

扫一扫