一种独特的logistic定义 lift logistic变量选择法 2016.07.29回顾

1、上午解决了为什么weka和R拟合出来的系数不一样,R拟合出来的系数是weka拟合出来系数的2倍,后来问了博士,经讨论才知道,还有一种logistic的定义是-1和1的定义,那种的link函数,恰好是e的2z次方,所以说系数存在一个2倍关系,至于具体对于损失函数和系数迭代公式产生的影响我还有待继续研究一下,现在只是明白了weka的simplelogistic算法应该是用的2z的定义,我后来又用自己写的python的logistic regression跑了下,结果和R相同

2、下午看了同事用v3和offer amount做的linear和logistic的结果(就2个自变量)在10等分的情况下,的确bad rate和lift都很相近,可能simon说的linear和logistic差不多有一定道理

3、lift是所在分组的bad rate除以总体的bad rate,得到lift,计算还是很简单,但是有空还是需要看一下具体的来源和意义

4、调试了一下测试环境

5、查了下logistic中向前、向后、逐步回归的具体实现方法,还有AIC这个东西的应用,其实我主要是想考虑的问题还是:这个筛选方法,已经考察了变量间的组合情况!查了很久都无果,我准备去请教别人了,其实我想了解具体实现方法,自己能实现一次,应该也是全部都懂了!

评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值