用 Python 自动化办公,能做到哪些有趣或有用的事情呢?大家浅看一下

0.先自我介绍一下:

我不是程序员,大学学的也不是IT专业。我在一个主要业务是成品粮交易的企业工作,我岗位的主要工作就是制作各类数据统计报表、台账、数据图表等等,反正就是各类日报,每天都要做一遍,此外还有什么周报月报什么的……这个岗位之前的同事,每天至少要花3.5到4个小时去折腾Excel,使用数据透视图、vlookup、其他各类函数去做出一份内含3000多个数据的日报。如果领导临时安排什么工作的话,那就要加班从浩如烟海的数据里找领导要的东西了。
在这里插入图片描述

1.噩梦开始时

我刚接手工作时,我们有一个巨大的,达70多M的Excel文件,每次公司配发的破电脑打开就需要小二十分钟,里面存着我们近十年的采购的每一车的详细信息……然后里面的数据格式还都是混乱的,打个比方,比如我们有个供货商全名叫:ABCD有限责任公司,那么这个Excel中会存有AB公司、AB有限公司、CD有限责任公司、CD责任有限公司、ACBD有限公司ABD公司等等等等名字,在我第一天看到这个Excel的时候

在这里插入图片描述
后来交接的同事告诉我,她用的Excel的 vlookup 函数,当匹配不上的时候,就手工搜索……

然后……我……在这里插入图片描述
就这样,经历了噩梦般的几个月……

等到了2021年年初,看到了 Python办公自动化,应该在理论上能替我处理所有事情(生孩子应该不行~~)

那我为什么不试着用Python去替我完成工作呢?

2.走了一些弯路,但胜过原地踏步

我的第一步是从数据清洗开始的。(当然那时并不知道这个叫数据清洗)先把刚才说的那个70M的Excel导成csv,去掉了其中不必要的格式、样式、对象等。然后我想统一一下各个数据的标准名称,刚才说了,由于经手的人太多,同一个数据,怎么表述的都有,几十万的数据量,人工交叉比对的话显然是不现实的。(后来才知道了笛卡尔积这个词)我第一步先使用了Excel自身的去重功能,将所有的供货商名称进行了一个去重,剩下了大概5000个左右的名称。然后,作为一个懒人,我肯定不会用人工去比对了。Python有一个库,叫做fuzzywuzzy,用它来进行模糊匹配。

from fuzzywuzzy import fuzz
print( fuzz.ratio("内容1", "内容
  • 4
    点赞
  • 2
    收藏
    觉得还不错? 一键收藏
  • 4
    评论
评论 4
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值