大学生录取预测——逻辑回归

最新推荐文章于 2023-12-04 08:58:47 发布

mmい

最新推荐文章于 2023-12-04 08:58:47 发布

阅读量9.2k

点赞数 2

分类专栏： Machine Learning

本文链接：https://blog.csdn.net/zm714981790/article/details/51242593

版权

这篇博客探讨了如何使用逻辑回归来预测大学录取情况。通过对admissions.csv数据集的分析，发现线性回归不适用于二元变量admit，而逻辑回归能提供0到1之间的接受概率。文章详细介绍了逻辑回归的logit函数、模型训练过程，以及通过ROC曲线评估模型性能，结果显示模型具有较好的预测能力。

摘要由CSDN通过智能技术生成

Dataset

每年高中生和大学生都会申请进入到各种各样的高校中去。每个学生都有一组唯一的考试分数，成绩和背景数据。录取委员会根据这个数据决定是否接受这些申请者。在这种情况下一个二元分类算法可用于接受或拒绝申请，逻辑回归是个不错的方法。

数据集admissions.csv包含了1000个申请者的信息，特征如下：

gre - Graduate Record Exam（研究生入学考试）, a generalized test for prospective graduate students（一个通用的测试未来的研究生）, continuous between 200 and 800.
gpa - Cumulative grade point average（累积平均绩点）, continuous between 0.0 and 4.0.
admit - Binary variable, 0 or 1, where 1 means the applicant was admitted to the program.

Use Linear Regression To Predict Admission

这是原本的数据，admit的值是0或者1。可以发现”gpa”和”admit”并没有线性关系，因为”admit”只取两个值。

import pandas
import matplotlib.pyplot as plt
admissions = pandas.read_csv("admissions.csv")
plt.scatter(admissions["gpa"], admissions["admit"])
plt.show()

这里写图片描述

这是通过线性回归模型预测的admit的值，发现admit_prediction 取值范围较大，有负值，不是我们想要的。

# The admissions DataFrame is in memory

# Import linear regression class
from sklearn.linear_model import LinearRegression

# Initialize a linear regression model
model = LinearRegression()

# Fit model
model.fit(admissions[['gre', 'gpa']], admissions["admit"])

# Prediction of admission
admit_prediction = model.predict(admissions