python的等深分箱

本文介绍了在Python中实现等深分箱的方法,提供了一个简单的轮子以方便数据处理。文章首先阐述了背景,指出等深分箱相较于等宽分箱的优势。接着展示了代码示例,并给出了项目的原始GitHub地址。案例中,作者使用特定数据进行了等深分箱操作,结果以数字型编码表示,但需要注意解码时的顺序问题,该问题计划年后解决。
摘要由CSDN通过智能技术生成

背景

当前很多文章尝试过最优分箱,python上也有cut等方法进行等宽分箱。为了方便日后输出结果以及分箱要求。做一个简单的轮子以供大家日后使用。很多能用其他轮子的地方也没有多余出力,也不托大会比别人写的好。空间复杂度尽我所能。

方法展示

话不多说上代码。

以下为等深分箱以及encoding方法

# -*- coding: utf-8 -*-
"""
Created on Tue Jan 29 17:26:38 2019

@author: DamomWCG
"""



class Equal_depth_box:
       
    def equal_box(list, bin_num):
        '''
        param:
        list:you need bin box list
        bin_num: you want bin num
        '''
        bin_num = 10
        list.sort() #need sort can replace by others
        list_2 = list.copy()
        all_num = len(list_2)
        bin_sep = all_num/bin_num
        bin_sep = int(bin_sep)
        bin_list = []
        for i in range(1,bin_num):
            bin_dict = {}
            bin_dict = i*bin_sep
            bin_list.append(bin_dict)
        bin_real_list = []
        for i in
评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值