python-区间划分,统计年龄段性别占比

问题描述:

有个DataFrame(gender,age),需要按指定间隔划分不同分组,并求该分组的性别占比(男性+女性=100%)
间隔:bin = [0, 20, 40, 60, 100],左开右闭

知识点

1、通过该例可以学习random的使用
2、学习pd.cut划分数值区间
3、pd.agg()

解答:

# 1、构造测试数据
random.seed(1)  # 指定随机种子,保证每次运行结果一致
df = pd.DataFrame(
    {'gender': [random.choice([1, 0]) for _ in range(100)],
     'age': [random.randint(1, 100) for _ in range(100)]}
)
# 2、将年龄划分不同时间段
age_bin = [0, 20, 40, 60, 100]
df['layered'] = pd.cut(x=df['age'], bins=age_bin)
# 3、将age划分对应区间
df = df.groupby(['layered']).agg({'gender': 'sum', 'age': 'count'})

# 4、计算男女占比情况
df = df.assign(
    male_rate=df['gender'] / df['age'],
    female_rate=1 - df['gender'] / df['age']
)
# 5、输出结果
print(df[['male_rate', 'female_rate']])

输出结果

  • 1
    点赞
  • 13
    收藏
    觉得还不错? 一键收藏
  • 1
    评论
评论 1
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值