sklearn——逻辑回归、ROC曲线与KS曲线

最新推荐文章于 2022-07-19 21:10:57 发布

weixin_30443895

最新推荐文章于 2022-07-19 21:10:57 发布

阅读量1.4k

点赞数

文章标签：人工智能数据结构与算法 python

原文链接：http://www.cnblogs.com/dwithy/p/11583612.html

版权

本文介绍了sklearn库中的逻辑回归模型，重点讨论了LogisticRegression和LogisticRegressionCV类的主要参数，以及如何计算AUC和绘制ROC曲线。讲解了roc_auc_score和roc_curve函数的使用，并提供了代码示例。

摘要由CSDN通过智能技术生成

一、sklearn中逻辑回归的相关类

　　在sklearn的逻辑回归中，主要用LogisticRegression和LogisticRegressionCV两个类来构建模型，两者的区别仅在于交叉验证与正则化系数C，下面介绍两个类（重要参数带**加绿）：

　　sklearn.linear_model.LogisticRegression(penalty=’l2’, dual=False, tol=0.0001, C=1.0, fit_intercept=True, intercept_scaling=1, class_weight=None, random_state=None, solver=’liblinear’, max_iter=100, multi_class=’ovr’, verbose=0, warm_start=False, n_jobs=1)

**penalty：可选'l1'、'l2'，正则化系数。注意'l1'不适用于MVM的情况。
dual：一个布尔值。如果为True，则求解对偶形式（只是在penalty='l2' 且solver='liblinear' 有对偶形式）；如果为False，则求解原始形式。这个参数一般不需要理会。
**C：一个浮点数，它指定了正则化系数的倒数。如果它的值越小，则正则化越大。建议为10。
fit_intercept：一个布尔值，制定是否需要截距值。如果为False，则不会计算b值（模型会假设你的数据已经中心化）。一般都需要截距，这个也可以不理会。
intercept_scaling：一个浮点数，只有当 solver='liblinear' 才有意义。当采用 fit_intercept 时，相当于人造一个特征出来，该特征恒为 1，其权重为 b 。在计算正则化项的时候，该人造特征也被考虑了。因此为了降低人造特征的影响，需要提供 intercept_scaling。不需要理会。
**class_weight：Y的类别权重，一个字典或者字符串'balanced'。如果为字典：则以字典方式给出了每个分类的权重，如{class_1:0.4，class_2:0.6}。如果为字符串 'balanced'：则自动计算权重，样本量越小的权重越高。如果未指定，则每个分类的权重都为 1。
random_state：一个整数或者一个RandomState实例，或者None。 •如果为整数，则它指定了随机数生成器的种子。 •如果为RandomState实例，则

最低0.47元/天解锁文章

weixin_30443895

关注

0
点赞
踩
9

收藏

觉得还不错? 一键收藏
0
评论
sklearn——逻辑回归、ROC曲线与KS曲线

一、sklearn中逻辑回归的相关类　　在sklearn的逻辑回归中，主要用LogisticRegression和LogisticRegressionCV两个类来构建模型，两者的区别仅在于交叉验证与正则化系数C，下面介绍两个类（重要参数带**加绿）：　　　　sklearn.linear_model.LogisticRegression(penalty=’l2’, dual=F...
复制链接

扫一扫