一、sklearn中逻辑回归的相关类
在sklearn的逻辑回归中,主要用LogisticRegression和LogisticRegressionCV两个类来构建模型,两者的区别仅在于交叉验证与正则化系数C,下面介绍两个类(重要参数带**加绿):
sklearn.linear_model.LogisticRegression(penalty=’l2’, dual=False, tol=0.0001, C=1.0, fit_intercept=True, intercept_scaling=1, class_weight=None, random_state=None, solver=’liblinear’, max_iter=100, multi_class=’ovr’, verbose=0, warm_start=False, n_jobs=1)
penalty:可选'l1'、'l2',正则化系数。注意'l1'不适用于MVM的情况。
dual:一个布尔值。如果为True,则求解对偶形式(只是在penalty='l2' 且solver='liblinear' 有对偶形式);如果为False,则求解原始形式。这个参数一般不需要理会。
C:一个浮点数,它指定了正则化系数的倒数。如果它的值越小,则正则化越大。建议为10。
fit_intercept:一个布尔值,制定是否需要截距 值。如果为False,则不会计算b值(模型会假设你的数据已经中心化)。一般都需要截距,这个也可以不理会。
intercept_scaling:一个浮点