python sklearn-04:逻辑回归及其效果评估

scikit-learn官方文档:http://scikit-learn.org/stable/tutorial/

译文:https://muxuezi.github.io/posts/4-from-linear-regression-to-logistic-regression.html

 

目录:

1.二元分类:

   >>逻辑回归

   >>网格搜索

2.多元分类

3.多标签分类

 

 

1.二元分类:

>>逻辑回归

 逻辑回归是用来做分类任务的。分类任务的目标是找一个函数,把观测值匹配到相关的类和标签上。学习算法必须用成对的特征向量和对应的标签来估计匹配函数的参数,从而实现更好的分类效果。

在二元分类(binary classification)中,分类算法必须把一个实例配置两个类别。二元分类案例包括,预测患者是否患有某种疾病,音频中是否含有人声,杜克大学男子篮球队在NCAA比赛中第一场的输赢。

多元分类中,分类算法需要为每个实例都分类一组标签。

 

在逻辑回归里,响应变量描述了类似于掷一个硬币结果为正面的概率。如果响应变量等于或超过了指定的临界值,预测结果就是正面,否则预测结果就是反面。响应变量是一个像线性回归中的解释变量构成的函数表示,称为逻辑函数(logistic function)。一个值在{0,1}之间的逻辑函数如下所示:

F(t)=1/(1+e(-t))

import matplotlib.pyplot as plt
from matplotlib.font_manager import FontProperties
font = FontProperties(fname=r"c:\windows\fonts\msyh.ttc", size=10)

import numpy as np
plt.figure()
plt.axis([-6, 6, 0, 1])
plt.grid(True)
X = np.arange(-6,6,0.1)
y = 1 / (1 + np.e ** (-X))
plt.plot(X, y, 'b-');

 

 

在逻辑回归中, 是解释变量的线性组合,公式如下:

  • 4
    点赞
  • 16
    收藏
    觉得还不错? 一键收藏
  • 0
    评论
可以使用sklearn中的逻辑回归模型来实现垃圾分类,具体步骤如下: 1. 数据预处理:将数据集划分为训练集和测试集,并进行特征提取和特征工程。 2. 构建模型:使用sklearn中的逻辑回归模型构建分类器。 3. 模型训练:使用训练集训练模型。 4. 模型评估:使用测试集对模型进行评估,并计算模型的准确率、精确率、召回率和F1值等指标。 下面是一个简单的示例代码: ```python # 导入库 from sklearn.feature_extraction.text import CountVectorizer from sklearn.model_selection import train_test_split from sklearn.linear_model import LogisticRegression from sklearn.metrics import accuracy_score, precision_score, recall_score, f1_score # 导入数据集并进行分割 data = # 自己准备数据集 X_train, X_test, y_train, y_test = train_test_split(data['text'], data['label'], random_state=0) # 特征提取和特征工程 vectorizer = CountVectorizer() X_train = vectorizer.fit_transform(X_train) X_test = vectorizer.transform(X_test) # 构建模型 clf = LogisticRegression() # 模型训练 clf.fit(X_train, y_train) # 模型评估 y_pred = clf.predict(X_test) print("Accuracy: ", accuracy_score(y_test, y_pred)) print("Precision: ", precision_score(y_test, y_pred)) print("Recall: ", recall_score(y_test, y_pred)) print("F1 Score: ", f1_score(y_test, y_pred)) ``` 在这个示例中,我们使用了sklearn中的CountVectorizer进行特征提取和特征工程,并使用逻辑回归模型进行垃圾分类。最后,我们使用测试集对模型进行评估,并输出了准确率、精确率、召回率和F1值等指标。

“相关推荐”对你有帮助么?

  • 非常没帮助
  • 没帮助
  • 一般
  • 有帮助
  • 非常有帮助
提交
评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值