Pandas - 数据分组统计_pandas分组计数

最新推荐文章于 2024-07-19 17:17:26 发布

2301_82244122

最新推荐文章于 2024-07-19 17:17:26 发布

阅读量329

点赞数 4

文章标签： pandas 大数据

本文链接：https://blog.csdn.net/2301_82244122/article/details/139816572

版权

对数据进行分组统计，主要适用DataFrame对象的groupby()函数。其功能如下。

（1）根据特定条件，将数据拆分成组

（2）每个组都可以独立应用函数（如求和函数sum()，均值函数mean()等）

（3）将结果合并到一个数据结构中

示例1:

根据“一级分类”对订单数据进行分组统计求和。

import pandas as pd  #导入pandas模块
df=pd.read_csv('JD.csv',encoding='gbk')
#抽取数据
df1=df[['一级分类','7天点击量','订单预定']]
df1=df1.groupby('一级分类').sum()       #分组统计求和

示例2:

按照图书“一级分类”和“二级分类”对订单数据进行分组统计求和

import pandas as pd  #导入pandas模块
df=pd.read_csv('JD.csv',encoding='gbk')
#抽取数据
df1=df[['一级分类','二级分类','7天点击量','订单预定']]
df2=df1.groupby(['一级分类','二级分类']).sum()    #分组统计求和

示例3:

求各二级分类的七天点击量。首先按“二级分类”分类，而后进行分组统计求和。

df1 = df1.groupby('二级分类')['七天点击量'].sum()

2.对分组数据进行迭代

示例1:

按照“一级分类”分组，并且输出每一分类中的订单数据

# 抽取数据
df1 = df[['一级分类',‘七天点击量’,‘订单预定’]]
for name, group in df.groupby('一级分类')
    print(name)
    print(group)

其中name是‘一级分类’， group是其他数据。因此使用groupby()函数对多列进行分组，那么需要在for循环中指定多列。

3.对分组的某列或多列使用聚合函数

Python也可以实现像SQL中的分组聚合运算操作，主要通过groupby()函数与agg()函数实现。

以下代码实现：

1. 以’一级分类’分组，求分组后的平均值与和

2.以’一级分类’分组，求分组后’七天点击量’的平均值与和，求’订单预定’的和

df1.groupby('一级分类').agg(['mean','sum'])

df1.groupby('一级分类').agg({'七天点击量':['mean','sum'],'订单预定':['sum']})

我们可以通过自定义函数实现数组分组统计。书本p110

以下代码实现：

1.统计一月份销售数据中，购买次数最多的产品，及其人均购买数，人均花费，总购买数，总花费。

df = pd.read_excel('1月.xlsx')
max1 = lambda x: x.value_counts(dropna=false).index[0]
df1 = df.agg({'宝贝标题':[max1],
              '数量':['sum','mean'],
              '卖家实际支付金额':['sum','mean']})
print(df1)

4.通过字典和Series对象进行分组统计

1.通过字典进行分组统计

既有适合小白学习的零基础资料，也有适合3年以上经验的小伙伴深入学习提升的进阶课程，涵盖了95%以上大数据知识点，真正体系化！

VLR-4701988631693)]
[外链图片转存中…(img-keDZODjw-4701988631693)]

既有适合小白学习的零基础资料，也有适合3年以上经验的小伙伴深入学习提升的进阶课程，涵盖了95%以上大数据知识点，真正体系化！

2301_82244122

关注

4
点赞
踩
9

收藏

觉得还不错? 一键收藏
0
评论
Pandas - 数据分组统计_pandas分组计数

对数据进行分组统计，主要适用DataFrame对象的groupby()函数。其功能如下。（1）根据特定条件，将数据拆分成组（2）每个组都可以独立应用函数（如求和函数sum()，均值函数mean()等）（3）将结果合并到一个数据结构中示例1:根据“一级分类”对订单数据进行分组统计求和。示例2:按照图书“一级分类”和“二级分类”对订单数据进行分组统计求和示例3:求各二级分类的七天点击量。首先按“二级分类”分类，而后进行分组统计求和。
复制链接

扫一扫