logistics regression-ML

最新推荐文章于 2024-06-21 23:09:38 发布

weixin_42182413

最新推荐文章于 2024-06-21 23:09:38 发布

阅读量67

点赞数

文章标签：机器学习

本文链接：https://blog.csdn.net/weixin_42182413/article/details/111502427

版权

基于逻辑回归的分类预测
基本概念：逻辑回归也被称为广义线性回归模型，它与线性回归模型的形式基本上相同，都具有 ax+b，其中a和b是待求参数，其区别在于他们的因变量不同，多重线性回归直接将ax+b作为因变量，即y = ax+b，而logistic回归则通过函数L将ax+b对应到一个隐状态p，p = L(ax+b)，然后根据p与1-p的大小决定因变量的值。

逻辑回归原理简介：
以二分类为例。（事实上,多分类可以看做多个二分类迭代，下一篇将以鸢尾花的分类为例，讲解多分类在逻辑回归模型中如何解决）
Logistic回归虽然名字里带“回归”，但是它实际上是一种分类方法，主要用于两分类问题（即输出只有两种，分别代表两个类别），所以利用了Logistic函数（或称为Sigmoid函数），函数形式为：
$logi(z)=\frac{1}{1+e^{-z}}$

其对应的函数图像可以表示如下:
在这里插入图片描述

通过上图我们可以发现 Logistic 函数是单调递增函数，并且在z=0的时候取值为0.5，并且 $logi(\cdot)$ 函数的取值范围为 $(0, 1)$ 。

而回归的基本方程为 $z=w_0+\sum_i^N w_ix_i$ ，

将回归方程写入其中为：
$p(y=1|x,\theta) = h_\theta(x,\theta)=\frac{1}{1+e^{-(w_0+\sum_i^N w_ix_i)}}$

所以, $p(y=1|x,\theta) = h_\theta(x,\theta)$ ， $p(y=0|x,\theta) = 1-h_\theta(x,\theta)$

逻辑回归从其原理上来说，逻辑回归其实是实现了一个决策边界：对于函数 $y=\frac{1}{1+e^{-z}}$ ,当 $z = > 0$ 时, $y = > 0.5$ ,分类为1，当 $z < 0$ 时, $y < 0.5$ ,分类为0，其对应的 $y$ 值我们可以视为类别1的概率预测值.

对于模型的训练而言：实质上来说就是利用数据求解出对应的模型的特定的 $w$ 。从而得到一个针对于当前数据的特征逻辑回归模型。

而对于多分类而言，将多个二分类的逻辑回归组合，即可实现多分类。

机器学习：基本概念，
数据集，模型，训练，验证

```python
## 构造数据集
x_fearures = np.array([[-1, -2], [-2, -1], [-3, -2], [1, 3], [2, 1], [3, 2]])
y_label = np.array([0, 0, 0, 1, 1, 1])

## 调用逻辑回归模型
lr_clf = LogisticRegression()

## 用逻辑回归模型拟合构造的数据集
lr_clf = lr_clf.fit(x_fearures, y_label) #其拟合方程为 y=w0+w1*x1+w2*x2
# 可视化决策边界
plt.figure()
plt.scatter(x_fearures[:,0],x_fearures[:,1], c=y_label, s=50, cmap='viridis')
plt.title('Dataset')

# 可视化决策边界（等概率线）
nx, ny = 200, 100
x_min, x_max = plt.xlim()
y_min, y_max = plt.ylim()
x_grid, y_grid = np.meshgrid(np.linspace(x_min, x_max, nx),np.linspace(y_min, y_max, ny))

# 利用逻辑回归模型预测平面网格点对应的概率值
z_proba = lr_clf.predict_proba(np.c_[x_grid.ravel(), y_grid.ravel()])
z_proba = z_proba[:, 1].reshape(x_grid.shape) 
# 填充等概率线（可以借助等高线理解）
c=plt.contour(x_grid, y_grid, z_proba, linewidths=2., colors='blue')
 # 等高线标签
plt.clabel(c,inline=True,fontsize=10)
plt.show()

在这里插入图片描述

函数解析参考
np.c_,np.meshgrid,np.linspace
plt.contour 等高线绘图函数

weixin_42182413

关注

0
点赞
踩
0

收藏

觉得还不错? 一键收藏
0
评论
logistics regression-ML

逻辑回归也被称为广义线性回归模型，它与线性回归模型的形式基本上相同，都具有 ax+b，其中a和b是待求参数，其区别在于他们的因变量不同，多重线性回归直接将ax+b作为因变量，即y = ax+b，而logistic回归则通过函数L将ax+b对应到一个隐状态p，p = L(ax+b)，然后根据p与1-p的大小决定因变量的值。机器学习：基本概念，数据集，模型，训练，验证```python## 构造数据集x_fearures = np.array([[-1, -2], [-2, -1], [-3, -2
复制链接

扫一扫