数据分析-pandas 基础（二）分析泰坦尼克号数据

LuZer0

于 2020-06-18 21:27:22 发布

阅读量5.9k

点赞数 5

文章标签：数据分析

版权声明：本文为博主原创文章，遵循 CC 4.0 BY-SA 版权协议，转载请附上原文出处链接和本声明。

本文链接：https://blog.csdn.net/ZER0ll/article/details/106843620

版权

上一节课介绍了 Pandas 的基本用法，这一章节我们通过对 “泰坦尼克号” 幸存者进行数据分析，来进一步的学习 pandas。

titanic_train.csv

网盘链接：链接：https://pan.baidu.com/s/1hGc19QAGV6H-hDtOdz-GpQ 提取码：sgu8

image-20200618091812300

数据简介：

PassengerId:乘客ID
Survived:是否获救，用1和Rescued表示获救,用0或者not saved表示没有获救
Pclass:乘客等级，“1”表示Upper，“2”表示Middle，“3”表示Lower
Name:乘客姓名
Sex:性别
Age:年龄
SibSp:乘客在船上的配偶数量或兄弟姐妹数量）
Parch:乘客在船上的父母或子女数量
Ticket:船票信息
Fare:票价
Cabin:是否住在独立的房间，“1”表示是，“0”为否
embarked:表示乘客上船的码头距离泰坦尼克出发码头的距离，数值越大表示距离越远

首先读入数据

import pandas as pd
import numpy as np
titanic_survival = pd.read_csv("titanic_train.csv")
titanic_survival.head() #查看前几行数据

image-20200618091440524

在 pandas 中，使用 NaN 表示数据为空，表示数据缺失

使用 .isnull()函数判断一列数据是否为空

age = titanic_survival["Age"]
age_is_null = pd.isnull(age)
print(age_is_null)

image-20200618094104841

最低0.47元/天解锁文章

评论 1

被折叠的条评论为什么被折叠?

到【灌水乐园】发言

查看更多评论

添加红包

成就一亿技术人!

hope_wisdom

发出的红包

实付元

使用余额支付

点击重新获取

扫码支付

钱包余额 0

抵扣说明：

1.余额是钱包充值的虚拟货币，按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载，可以购买VIP、付费专栏及课程。