python excel数据对比_同事给你迷之Excel数据,4个数据处理案例教你Python数据对比更新...

35e99eb02ebcf17f88a3cb2393acdf40.png

转发本文并私信我"python",即可获得Python资料以及更多系列文章(持续更新的)

经常听别人说 Python 在数据领域有多厉害,结果学了很长时间,连数据处理都麻烦得要死。后来才发现,原来不是 Python 数据处理厉害,而是他有数据分析神器—— pandas

前言

有时候我们需要对比两份数据有哪些不同值,在 Excel 中虽然没有实现对比功能,但通过公式也可以简单完成。不过你可能没想到的是,在 pandas 中实现对比功能,与 Excel 有异曲同工之处。


案例1

你千辛万苦整理了一份数据表,发给了同事,几小时后,同事在表格中修改了某些单元格的值,然后扔下一句话:麻烦你看看修改的对不对?

6d4e91ba9970f1fa6604b9c019d3e7ac.png
  • 此时你很想问一句:可以告诉我哪些修改了?

Excel 中,我们可以简单写一个等号,把两个表的值都对比一下:

2482f7c6c208b42a8f62facd8d41af8e.png

虽然上述方式操作简单,但是你每次编写公式范围都要靠"手感"。现在看看 pandas 中怎么实现:

bc271d414fd5f210037b8091ac6388d7.png
  • pandas 中的原理其实与 Excel 操作是一样的,不过我们只需要写一次"双等号",pandas 会自动让2个表的每个值做对比

案例2

你会埋怨说,上面给我一堆 bool 值,有啥用?!你当然希望看看那些被修改的值。上面代码简单修改即可:

091c397e490d3dd598691ec9fbf4b75c.png
  • cond = df_mdf != df_src , 这次我们把判断条件写成"!=",是"不等于"的意思
  • df_mdf[cond] ,紧接着只要把那些"不等于"的结果放入"修改表",即可显示那些被修改的值

ae06e350f90bdf8d2cc6385ca83189e0.png

案例3

你的同事喜欢给你"开玩笑",这次他发过来的数据表,不小心把人名的顺序给打乱了:

b8dcf916dd4a503f6568a52102680cbc.png
  • 现在修改后的表格数据,是按销量降序排列

这次我们不能直接根据位置判断,不过只需要简单调整即可:

239a3bef8ef8434e9e058491b9c0d7e2.png
  • 关键1(红线部分),加载数据时,把第一列作为行索引
  • 关键2(蓝线部分),让"乱序表"按"原始表"的索引重置一下
  • 其他部分不变

实际上,pandas 中的判断是根据行列索引自动对齐


4af2adf0b94831aa17e0c674a0d6c4bb.png

案例4

有时候,同事不会给你完整的数据表,他只提供修改的记录:

946e8f6feccd9f37358cd5696f880945.png

这次你不再需要关心哪些被修改了,而是怎么把修改后的结果更新到"原始表"。

pandas 当然不会让你失望:

e781b1a66d7ef7c909c653f4118f3d6f.png
  • 关键在最后一行,DataFrame.update() ,按传入的 DataFrame 作为标准,更新原始表
  • 时刻谨记,一切按行列索引自动对齐

你会发现,即使是非常复杂的表头,也能完成这些操作,因为 DataFrame 可以包含各种多层行列索引。因此,这案例中的列顺序有变化,同样可以完成操作


如果希望从零开始系统学习 pandas ,这个 pandas 专栏不容错过。内含多个数据分析案例。

评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值