数据挖掘小组学习:特征工程

2.1 任务要求

特征衍生

特征挑选:分别用IV值和随机森林等进行特征选择

……以及你能想到特征工程处理

2.2 特征衍生

根据特征’history_suc_fee’和’history_fail_fee’计算历史借款总额和还款成功率和失败率

features = pd.concat([X_train,x_test]).reset_index(drop=True)
features['history_total_fee'] = features['history_suc_fee'] + features['history_fail_fee']
features['history_suc_rate'] = features['history_suc_fee'] / (features['history_total_fee'] + 0.01) # 平滑处理
features['history_fail_rate'] = features['history_fail_fee'] / (features['history_total_fee'] + 0.01)
features.head()

在这里插入图片描述

2.3 归一化处理

对数值型的特征进行归一化处理,先提取出数值型特征名

numeric_dtypes = ['int16', 'int32', 'int64', 'float16', 'float32', 'float64']
numerics_features = []
for i in features.columns:
    if features[i].dtype in numeric_dtypes:
        numerics_features.append(i)
str(numerics_features)
"['low_volume_percent', 'middle_volume_percent', 'take_amount_in_later_12_month_highest', 'trans_amount_increase_rate_lately', 'trans_activity_month', 'trans_activity_day', 'transd_mcc', 'trans_days_interval_filter', 'trans_days_interval', 'regional_mobility', 'student_feature', 'repayment_capability', 'is_high_user', 'number_of_trans_from_2011', 'historical_trans_amount', 'historical_trans_day', 'rank_trad_1_month', 'trans_amount_3_month', 'avg_consume_less_12_valid_month', 'abs', 'top_trans_count_last_1_month', 'avg_price_last_12_month', 'avg_price_top_last_12_valid_month', 'reg_preference_for_trad', 'trans_top_time_last_1_month', 'trans_top_time_last_6_month', 'consume_top_time_last_1_month', 'consume_top_time_last_6_month', 'cross_consume_count_last_1_month', 'trans_fail_top_count_enum_last_1_month', 'trans_fail_top_count_enum_last_6_month', 'trans_fail_top_count_enum_last_12_month', 'consume_mini_time_last_1_month', 'max_cumulative_consume_later_1_month', 'max_consume_count_later_6_month', 'railway_consume_count_last_12_month', 'pawns_auctions_trusts_consume_last_1_month', 'pawns_auctions_trusts_consume_last_6_month', 'j
  • 0
    点赞
  • 0
    收藏
    觉得还不错? 一键收藏
  • 0
    评论

“相关推荐”对你有帮助么?

  • 非常没帮助
  • 没帮助
  • 一般
  • 有帮助
  • 非常有帮助
提交
评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值