数据去重;

本文介绍了Pandas库中用于处理数据重复问题的duplicated()函数,它返回布尔值表示数据重复,以及drop_duplicates()函数,可以删除重复行,还可以指定特定列进行判断。通过实例展示了如何在DataFrame中应用这些方法。
摘要由CSDN通过智能技术生成

对于数据重复的问题我们可以使用duplicated(),drop_duplicates()方法

注意:两个方法都为DataFrame数据对象的方法

duplicated()判断数据是否重复,返回的是布尔值

drop_duplicates()删除重复的行,可以通过指定参数,限定以哪列作为判断依据

duplicated()使用方法:

df1 = pd.DataFrame({'ID':[1.0,2.0,1.0,2.0,3.0],'lenget':[5.1,4.9,5.1,4.9,4.7],'width':[3.5,3.0,3.5,3.0,3.2],'lenhet1':[1.4,1.4,1.4,1.4,1.3],
                    'width2':[0.2,0.2,0.2,0.2,0.2],'Test':['test','test','test','test','test']})
print(df1)
print(df1.duplicated())

运行结果:

    ID  lenget  width  lenhet1  width2  Test
0  1.0     5.1    3.5      1.4     0.2  test
1  2.0     4.9    3.0      1.4     0.2  test
2  1.0     5.1    3.5      1.4     0.2  test
3  2.0     4.9    3.0      1.4     0.2  test
4  3.0     4.7    3.2      1.3     0.2  test
0    False
1    False
2     True
3     True
4    False

drop_duplicates()运行使用方法:

df1 = pd.DataFrame({'ID':[1.0,2.0,1.0,2.0,3.0],'lenget':[5.1,4.9,5.1,4.9,4.7],'width':[3.5,3.0,3.5,3.0,3.2],'lenhet1':[1.4,1.4,1.4,1.4,1.3],
                    'width2':[0.2,0.2,0.2,0.2,0.2],'Test':['test','test','test','test','Test']})
print(df1)
print(df1.drop_duplicates())
print(df1.drop_duplicates('width'))#添加width作为判断

运行结果:

    ID  lenget  width  lenhet1  width2  test
0  1.0     5.1    3.5      1.4     0.2  test
1  2.0     4.9    3.0      1.4     0.2  test
2  1.0     5.1    3.5      1.4     0.2  test
3  2.0     4.9    3.0      1.4     0.2  test
4  3.0     4.7    3.2      1.3     0.2  test

    ID  lenget  width  lenhet1  width2  test
0  1.0     5.1    3.5      1.4     0.2  test
1  2.0     4.9    3.0      1.4     0.2  test
4  3.0     4.7    3.2      1.3     0.2  test

    ID  lenget  width  lenhet1  width2  test
0  1.0     5.1    3.5      1.4     0.2  test
1  2.0     4.9    3.0      1.4     0.2  test
4  3.0     4.7    3.2      1.3     0.2  test

评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值