Python处理Excel,学会这十四个方法,工作量减少大半,阿里P8大佬亲自教你

vlookup是excel几乎最常用的公式,一般用于两个表的关联查询等。

所以我先把这张表分为两个表。

df1=sale[[‘订单明细号’,‘单据日期’,‘地区名称’, ‘业务员名称’,‘客户分类’, ‘存货编码’, ‘客户名称’, ‘业务员编码’, ‘存货名称’, ‘订单号’,

‘客户编码’, ‘部门名称’, ‘部门编码’]]

df2=sale[[‘订单明细号’,‘存货分类’, ‘税费’, ‘不含税金额’, ‘订单金额’, ‘利润’, ‘单价’,‘数量’]]

需求

想知道df1的每一个订单对应的利润是多少

利润一列存在于df2的表格中,所以想知道df1的每一个订单对应的利润是多少。

用excel的话首先确认订单明细号是唯一值,然后在df1新增一列写:=vlookup(a2,df2!a:h,6,0) ,然后往下拉就ok了。

那用python是如何实现的呢?

#查看订单明细号是否重复,结果是没。

df1[“订单明细号”].duplicated().value_counts()

df2[“订单明细号”].duplicated().value_counts()

df_c=pd.merge(df1,df2,on=“订单明细号”,how=“left”)

5、条件计算

需求

存货名称含“三星字眼”并且税费高于1000的订单有几个?

这些订单的利润总和和平均利润是多少?(或者最小值,最大值,四分位数,标注差)

sale.loc[sale[“存货名称”].str.contains(“三星”)&(sale[“税费”]>=1000)][[“订单明细号”,“利润”]].describe()

在这里插入图片描述6、分组

需求

根据利润数据分布把地区分组为:“较差”,“中等”,“较好”,“非常好”

首先,当然是查看利润的数据分布呀,这里我们采用四分位数去判断。

sale.groupby(“地区名称”)[“利润”].sum().describe()

在这里插入图片描述根据四分位数把地区总利润为[-9,7091]区间的分组为“较差”,(7091,10952]区间的分组为"中等"

(10952,17656]分组为较好,(17656,37556]分组为非常好。

#先建立一个Dataframe

sale_area=pd.DataFrame(sale.groupby(“地区名称”)[“利润”].sum()).reset_index()

#设置bins,和分组名称

bins=[-10,7091,10952,17656,37556]

groups=[“较差”,“中等”,“较好”,“非常好”]

#使用cut分组

#sale_area[“分组”]=pd.cut(sale_area[“利润”],bins,labels=groups)

7、对比两列差异

因为这表每列数据维度都不一样,比较起来没啥意义,所以我先做了个订单明细号的差异再进行比较。

需求:比较订单明细号与订单明细号2的差异并显示出来。

sale[“订单明细号2”]=sale[“订单明细号”]

#在订单明细号2里前10个都+1.

sale[“订单明细号2”][1:10]=sale[“订单明细号2”][1:10]+1

#差异输出

result=sale.loc[sale[“订单明细号”].isin(sale[“订单明细号2”])==False]

8、异常值替换

首先用describe()函数简单查看一下数据有无异常值。

#可看到销项税有负数,一般不会有这种情况,视它为异常值。

sale.describe()

在这里插入图片描述需求

用0代替异常值。

sale[“订单金额”]=sale[“订单金额”].replace(min(sale[“订单金额”]),0)

9、缺失值处理

先查看销售数据哪几列有缺失值

#列的行数小于index的行数的说明有缺失值,这里客户名称329<335,说明有缺失值

sale.info()

在这里插入图片描述

需求

用0填充缺失值或则删除有客户编码缺失值的行

实际上缺失值处理的办法是很复杂的,这里只介绍简单的处理方法,若是数值变量,最常用平均数或中位数或众数处理,比较复杂的可以用随机森林模型根据其他维度去预测结果填充。

自我介绍一下,小编13年上海交大毕业,曾经在小公司待过,也去过华为、OPPO等大厂,18年进入阿里一直到现在。

深知大多数Python工程师,想要提升技能,往往是自己摸索成长或者是报班学习,但对于培训机构动则几千的学费,着实压力不小。自己不成体系的自学效果低效又漫长,而且极易碰到天花板技术停滞不前!

因此收集整理了一份《2024年Python开发全套学习资料》,初衷也很简单,就是希望能够帮助到想自学提升又不知道该从何学起的朋友,同时减轻大家的负担。
img
img



既有适合小白学习的零基础资料,也有适合3年以上经验的小伙伴深入学习提升的进阶课程,基本涵盖了95%以上Python开发知识点,真正体系化!

由于文件比较大,这里只是将部分目录大纲截图出来,每个节点里面都包含大厂面经、学习笔记、源码讲义、实战项目、讲解视频,并且后续会持续更新

如果你觉得这些内容对你有帮助,可以添加V获取:vip1024c (备注Python)
img

一、Python所有方向的学习路线

Python所有方向的技术点做的整理,形成各个领域的知识点汇总,它的用处就在于,你可以按照下面的知识点去找对应的学习资源,保证自己学得较为全面。

img
img

二、Python必备开发工具

工具都帮大家整理好了,安装就可直接上手!img

三、最新Python学习笔记

当我学到一定基础,有自己的理解能力的时候,会去阅读一些前辈整理的书籍或者手写的笔记资料,这些笔记详细记载了他们对一些技术点的理解,这些理解是比较独到,可以学到不一样的思路。

img

四、Python视频合集

观看全面零基础学习视频,看视频学习是最快捷也是最有效果的方式,跟着视频中老师的思路,从基础到深入,还是很容易入门的。

img

五、实战案例

纸上得来终觉浅,要学会跟着视频一起敲,要动手实操,才能将自己的所学运用到实际当中去,这时候可以搞点实战案例来学习。img

六、面试宝典

在这里插入图片描述

在这里插入图片描述

简历模板在这里插入图片描述

0d6186c1.png)

六、面试宝典

在这里插入图片描述

在这里插入图片描述

简历模板在这里插入图片描述
  • 12
    点赞
  • 12
    收藏
    觉得还不错? 一键收藏
  • 0
    评论

“相关推荐”对你有帮助么?

  • 非常没帮助
  • 没帮助
  • 一般
  • 有帮助
  • 非常有帮助
提交
评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值