Pandas常用操作记录(更新中)

注意:本篇文章只设计相关操作函数,不会细讲函数参数作用,找到对应函数,可以在pandas的doc文件查看详细的参数说明。附上链接pandas文档

1.读取文件

import pandas as pd
df =  pd.read_csv('路径')
#pd.read_文件格式('路径')

2.读取某列某行,并使用map替换

2.1 直接读取某列数据

        在获取到df对象后,可以使用 df.列名  来获取该列数据,

import pandas as pd
df = pd.read_csv(r'data/winequality-red.csv')
print(df.quality)
#print(df.loc[:,'quality'])  #这是使用loc函数的方式

2.2使用loc函数读取

当然,我们可以更加优雅一点,使用loc函数来进行行、列、区域的数据的获取。

loc方法是通过行、列的名称或者标签来寻找我们需要的值。

2.2.1读取某行所有数据(检索是行数,注意这里的行数是行序列号,从0开始

#获取第一行的所有数据
print(df.loc[1,:])

2.2.2读取某列全部数据(检索是列名)

#获取quality一列的全部数据
print(df.loc[:,'quality'] )

2.2.3读取某列的部分行数据(注意这里的行数是行序列号,从0开始)

#获取quality一列的2-5行的数据,注意,这是一个闭区间
df.loc[2:5,'quality']

2.2.4读取某区块的数据

#获取从'sulphates'到'quality'列2-5行的数据
print(df.loc[2:5,'sulphates':'quality'])

2.3使用iloc函数进行读取

iloc方法是通过索引行、列的索引位置[index, columns]来寻找值

具体方法类似loc函数,这里简单展示(注意此处索引都是从0开始计算

#获取第二行的数据
print(df.iloc[1])
#读取第三列数据
print(df.iloc[:,2])

3.使用map函数使用字典映射列数据

        在机器学习中,我们往往会需要对csv文件的一些列数据进行独热编码,使用pandas自带的map函数来进行替换也是一种比较简单快速的编码方式。(注意map函数需要自提供映射字典,常用于类别较少的情况)

import pandas as pd
df = pd.read_csv(r'data/winequality-red.csv')
print(df)
quality_map = {
    3:0,
    4:1,
    5:2,
    6:3,
    7:4,
    8:5
}
df.loc[:,'quality'] = df.quality.map(quality_map)
print(df)

函数比较简单:df.map(字典对象),效果见下图

4.丢弃某行某列(drop)

我们利用drop函数来实现对某行或某列的丢弃

data = pd.concat([train_data,test_data],ignore_index=True)
data.drop(['Name'],axis = 1,inplace=True)
#axis = 1表示丢弃的是列,Name是列名,0表示丢弃的是行,inplace=True表示直接在原有数据上更改

5.统计文件非空数据、空数据

        以kaggle泰坦尼克宇宙飞船数据集为例,输出非空数据统计

5.1统计非空数据

train = pd.read_csv(r'data/train.csv')
print(train.info())

5.2统计空数据

train = pd.read_csv(r'data/train.csv')
total = train.isnull()
print(total)

利用isnull可以将DataFrame中每一格数据按空或非空判定

我们可以再追加sum()函数来进行统计

train = pd.read_csv(r'data/train.csv')
total = train.isnull().sum()
print(total)

依然可以再次追加sort_values()函数来进行排序

train = pd.read_csv(r'data/train.csv')
total = train.isnull().sum().sort_values(ascending=False) #降序
print(total)

  • 9
    点赞
  • 3
    收藏
    觉得还不错? 一键收藏
  • 打赏
    打赏
  • 0
    评论
大学生参加学科竞赛有着诸多好处,不仅有助于个人综合素质的提升,还能为未来职业发展奠定良好基础。以下是一些分析: 首先,学科竞赛是提高专业知识和技能水平的有效途径。通过参与竞赛,学生不仅能够深入学习相关专业知识,还能够接触到最新的科研成果和技术发展趋势。这有助于拓展学生的学科视野,使其对专业领域有更深刻的理解。在竞赛过程,学生通常需要解决实际问题,这锻炼了他们独立思考和解决问题的能力。 其次,学科竞赛培养了学生的团队合作精神。许多竞赛项目需要团队协作来完成,这促使学生学会有效地与他人合作、协调分工。在团队合作,学生们能够学到如何有效沟通、共同制定目标和分工合作,这对于日后进入职场具有重要意义。 此外,学科竞赛是提高学生综合能力的一种途径。竞赛项目通常会涉及到理论知识、实际操作和创新思维等多个方面,要求参赛者具备全面的素质。在竞赛过程,学生不仅需要展现自己的专业知识,还需要具备创新意识和解决问题的能力。这种全面的综合能力培养对于未来从事各类职业都具有积极作用。 此外,学科竞赛可以为学生提供展示自我、树立信心的机会。通过比赛的舞台,学生有机会展现自己在专业领域的优势,得到他人的认可和赞誉。这对于培养学生的自信心和自我价值感非常重要,有助于他们更加积极主动地投入学习和未来的职业生涯。 最后,学科竞赛对于个人职业发展具有积极的助推作用。在竞赛脱颖而出的学生通常能够引起企业、研究机构等用人单位的关注。获得竞赛奖项不仅可以作为个人履历的亮点,还可以为进入理想的工作岗位提供有力的支持。
评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包

打赏作者

渊兮旷兮

你的鼓励将是我创作的最大动力

¥1 ¥2 ¥4 ¥6 ¥10 ¥20
扫码支付:¥1
获取中
扫码支付

您的余额不足,请更换扫码支付或充值

打赏作者

实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值