hnu计算机与人工智能概论5.25

第1关:数据可视化

1.从文件examdata.csv中读取数据 (没有标题行)

2.用散点图实现数据可视化(细节参考左侧编程要求,红色叉代表不及格,绿色点代表不及格)

import pandas as pd
import matplotlib.pyplot as plt

plt.rcParams['font.sans-serif'] = ['SimHei'] # 步骤一(替换sans-serif字体)
plt.rcParams['axes.unicode_minus'] = False  # 步骤二(解决坐标轴负数的负号显示问题)

#1.从文件examdata.csv中读取数据 (没有标题行)
############begin############
df=pd.read_csv('examdata.csv',header=None)
df1=df[df[2]==1]
x1=df1[0]
y1=df1[1]
df2=df[df[2]==0]
x2=df2[0]
y2=df2[1]
#############end#############
#2.用散点图实现数据可视化(细节参考左侧编程要求,红色叉代表不及格,绿色点代表不及格)
def draw_fig(filename):
    plt.figure('fig1')
    ############begin############
    plt.scatter(x2,y2,c='r',marker='x',label='不及格')
    plt.scatter(x1,y1,c='g',marker='o',label='及格')
    plt.legend(loc = 'lower right')
    plt.xlabel('测试1成绩')
    plt.ylabel('测试2成绩')
    plt.savefig(filename)
    plt.show()
#############end#############

第2关:归一化/标准化 

1.从文件examdata.csv中读取数据 (没有标题行)

2.对数据中的自变量x进行归一化

3.对数据中的特征值进行标准化

4.将归一化的数据arr_new(连因变量一起)写入文件examdata_new.csv中

5.将标准化的数据arr_new2(连因变量一起)写入文件examdata_new2.csv中

第二关,代价一定要记得引入pandas库,引入pandas库,引入pandas库!

第三问注意是要将特征值标准化

import numpy as np
import pandas as pd

#1.从文件examdata.csv中读取数据 (没有标题行)
############begin############
df=pd.read_csv('examdata.csv',header=None)
arr_new2=df.copy()
#############end#############

#2.对数据中的自变量x进行归一化
############begin############
def normalization(data):
    _range = np.max(data,axis=0)-np.min(data,axis=0)
    return(data - np.min(data,axis=0))/_range
arr_new=normalization(df)
#############end#############

#3.对数据中的特征值进行标准化
############begin############
def standard(data):
    _mean=np.mean(data,axis=0)
    _std=np.std(data,axis=0)
    return (data - _mean)/_std
arr_new2[[0,1]]=standard(df[[0,1]])
#############end#############

#4.将归一化的数据arr_new(连因变量一起)写入文件examdata_new.csv中
############begin############
arr_new.to_csv('examdata_new.csv')
#############end#############
np.savetxt('student_ans/examdata_new.csv',arr_new,fmt='%.4f',delimiter=',')

#5.将标准化的数据arr_new2(连因变量一起)写入文件examdata_new2.csv中
############begin############
arr_new2.to_csv('examdata_new2.csv')
#############end#############
np.savetxt('student_ans/examdata_new2.csv',arr_new2,fmt='%.4f',delimiter=',')

 第3关:模型建立、训练与评估

1.从文件examdata_new.csv中读取数据 (没有标题行)

2.拆分训练集和测试集(3:1的比例)

3.建模、训练、测试并输出分类准确率score

也要记得引入pandas库

import numpy as np
from sklearn.linear_model import LogisticRegression
from sklearn.model_selection import train_test_split
import pandas as pd
#输入random_state参数值
para=eval(input())
#1.从文件examdata_new.csv中读取数据 (没有标题行)
############begin############
df = pd.read_csv('examdata_new.csv')
x=df.iloc[:,[1,2]]
y=df.iloc[:,3]
#############end#############

#2.拆分训练集和测试集(3:1的比例)
############begin############
x_train, x_test, y_train, y_test = train_test_split(x, y, test_size=0.25, random_state=para)
#############end#############

#3.建模、训练、测试并输出分类准确率score
############begin############
reg = LogisticRegression()
reg.fit(x_train, y_train)
score = reg.score(x_test, y_test)
#############end#############
print('%.4f'%score)

  • 4
    点赞
  • 5
    收藏
    觉得还不错? 一键收藏
  • 打赏
    打赏
  • 4
    评论
评论 4
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包

打赏作者

howell(Python)

你的鼓励将是我创作的最大动力

¥1 ¥2 ¥4 ¥6 ¥10 ¥20
扫码支付:¥1
获取中
扫码支付

您的余额不足,请更换扫码支付或充值

打赏作者

实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值