大数据最全Pandas - 数据分组统计_pandas分组计数(3)

2401_84166236

于 2024-05-04 04:45:24 发布

阅读量224

点赞数 1

分类专栏：程序员文章标签：大数据 pandas 数据分析

本文链接：https://blog.csdn.net/2401_84166236/article/details/138432240

版权

df=pd.read_csv(‘JD.csv’,encoding=‘gbk’)
#抽取数据
df1=df[[‘一级分类’,‘二级分类’,‘7天点击量’,‘订单预定’]]
df2=df1.groupby([‘一级分类’,‘二级分类’]).sum() #分组统计求和


示例3:


        求各二级分类的七天点击量。首先按“二级分类”分类，而后进行分组统计求和。

df1 = df1.groupby(‘二级分类’)[‘七天点击量’].sum()


## 2.对分组数据进行迭代


示例1:


        按照“一级分类”分组，并且输出每一分类中的订单数据

抽取数据

df1 = df[[‘一级分类’,‘七天点击量’,‘订单预定’]]
for name, group in df.groupby(‘一级分类’)
print(name)
print(group)


        其中name是‘一级分类’， group是其他数据。因此使用groupby()函数对多列进行分组，那么需要在for循环中指定多列。


## 3.对分组的某列或多列使用聚合函数


Python也可以实现像SQL中的分组聚合运算操作，主要通过groupby()函数与agg()函数实现。


        以下代码实现：


        1. 以'一级分类'分组，求分组后的平均值与和


        2.以'一级分类'分组，求分组后'七天点击量'的平均值与和，求'订单预定'的和

df1.groupby(‘一级分类’).agg([‘mean’,‘sum’])

df1.groupby(‘一级

最低0.47元/天解锁文章

2401_84166236

关注

1
点赞
踩
3

收藏

觉得还不错? 一键收藏
3
评论
大数据最全Pandas - 数据分组统计_pandas分组计数(3)

抽取数据df1=df[[‘一级分类’,‘二级分类’,‘7天点击量’,‘订单预定’]]df2=df1.groupby([‘一级分类’,‘二级分类’]).sum() #分组统计求和df1 = df1.groupby(‘二级分类’)[‘七天点击量’].sum()
复制链接

扫一扫