大数据最全Pandas - 数据分组统计_pandas分组计数(3)

df=pd.read_csv(‘JD.csv’,encoding=‘gbk’)
#抽取数据
df1=df[[‘一级分类’,‘二级分类’,‘7天点击量’,‘订单预定’]]
df2=df1.groupby([‘一级分类’,‘二级分类’]).sum() #分组统计求和


示例3:


        求各二级分类的七天点击量。首先按“二级分类”分类,而后进行分组统计求和。



df1 = df1.groupby(‘二级分类’)[‘七天点击量’].sum()


## 2.对分组数据进行迭代


示例1:


        按照“一级分类”分组,并且输出每一分类中的订单数据



抽取数据

df1 = df[[‘一级分类’,‘七天点击量’,‘订单预定’]]
for name, group in df.groupby(‘一级分类’)
print(name)
print(group)


        其中name是‘一级分类’, group是其他数据。因此使用groupby()函数对多列进行分组,那么需要在for循环中指定多列。


## 3.对分组的某列或多列使用聚合函数


Python也可以实现像SQL中的分组聚合运算操作,主要通过groupby()函数与agg()函数实现。


        以下代码实现:


        1. 以'一级分类'分组,求分组后的平均值与和


        2.以'一级分类'分组,求分组后'七天点击量'的平均值与和,求'订单预定'的和



df1.groupby(‘一级分类’).agg([‘mean’,‘sum’])

df1.groupby(‘一级

  • 1
    点赞
  • 3
    收藏
    觉得还不错? 一键收藏
  • 3
    评论

“相关推荐”对你有帮助么?

  • 非常没帮助
  • 没帮助
  • 一般
  • 有帮助
  • 非常有帮助
提交
评论 3
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值