机器学习-分类模型的评估

最新推荐文章于 2024-03-15 07:30:00 发布

V大表姐

最新推荐文章于 2024-03-15 07:30:00 发布

阅读量225

点赞数

文章标签：算法 python

本文链接：https://blog.csdn.net/weixin_47079718/article/details/124125726

版权

准确率

estimator.score()
一般最常见使用的是准确率，即预测结果正确的百分比
在这里插入图片描述

召回率

真实为正例的样本中预测结果为正例的比例（查得全，对正样本的区分能力），常用到
在这里插入图片描述

精确率

预测结果为正例样本中真实为正例的比例（查得准）
在这里插入图片描述

F1-score

反应了模型的稳健性
在这里插入图片描述

from sklearn.datasets import load_iris, fetch_20newsgroups, load_boston
from sklearn.model_selection import train_test_split, GridSearchCV
from sklearn.preprocessing import StandardScaler
from sklearn.feature_extraction.text import TfidfVectorizer
from sklearn.naive_bayes import MultinomialNB
from sklearn.metrics import classification_report
import pandas as pd
def naviebayes():
    """
    朴素贝叶斯进行文本分类
    :return: None
    """
    news = fetch_20newsgroups(subset='all')

    # 进行数据分割
    x_train, x_test, y_train, y_test = train_test_split(news.data, news.target, test_size=0.25)

    # 对数据集进行特征抽取
    tf = TfidfVectorizer()

    # 以训练集当中的词的列表进行每篇文章重要性统计['a','b','c','d']
    x_train = tf.fit_transform(x_train)

    print(tf.get_feature_names())

    x_test = tf.transform(x_test)

    # 进行朴素贝叶斯算法的预测
    mlt = MultinomialNB(alpha=1.0)

    print(x_train.toarray())

    mlt.fit(x_train, y_train)

    y_predict = mlt.predict(x_test)

    print("预测的文章类别为：", y_predict)

    # 得出准确率
    print("准确率为：", mlt.score(x_test, y_test))

    print("每个类别的精确率和召回率：", classification_report(y_test, y_predict, target_names=news.target_names))

    return None
if __name__ == "__main__":
    naviebayes()

V大表姐

关注

0
点赞
踩
0

收藏

觉得还不错? 一键收藏
0
评论
机器学习-分类模型的评估

准确率estimator.score()一般最常见使用的是准确率，即预测结果正确的百分比召回率真实为正例的样本中预测结果为正例的比例（查得全，对正样本的区分能力），常用到精确率预测结果为正例样本中真实为正例的比例（查得准）F1-score反应了模型的稳健性from sklearn.datasets import load_iris, fetch_20newsgroups, load_bostonfrom sklearn.model_selection import train_t
复制链接

扫一扫