对MovieLens 数据集进行评分预测-ALS 与 Surprise 工具的使用-详细解释

本文介绍了如何利用Surprise库进行推荐系统的评分预测,详细阐述了Surprise库的用途、常用算法,如BaselineOnly和KNNBasic。BaselineOnly算法基于统计的基准预测评分,而KNNBasic算法则采用基于邻域的协同过滤理论。通过代码解析和运行结果展示,读者可以深入理解这两个模型的工作原理和实现过程。
摘要由CSDN通过智能技术生成

理论基础

surprise 用途

这个库用来做MF(矩阵分解)

surprise 中的常用算法

  • Baseline 算法
  • 基于邻域的协同过滤
  • 矩阵分解:SVD, SVD++,PMF,NMF
  • slopeOne 协同过滤算法

关于surprise 使用方法的说明

surprise 推荐系统工具算法描述

在这里插入图片描述

model_selection 包

项目解析

BaslineOnly

算法理论部分

基准算法包含两个主要的算法NormalPredictor和BaselineOnly。
BaselineOnly 是基于统计的基准预测线打分,思想是设立基线,并引入user的偏差以及item的偏差。
在这里插入图片描述
μ为所有用户对电影评分的均值
bui:待求的基线模型中用户u给物品i打分的预估值
bu:user偏差(如果用户比较苛刻,打分都相对偏低, 则bu<0;反之,bu>0);
bi为item偏差,反映商品受欢迎程度

Baselines can be estimated in two different ways:
-Using Stochastic Gradient Descent (SGD).
-Using Alternating Least Squares (ALS).

代码讲解

#from surprise import SVD
from surprise import Dataset
from surprise import Reader
from surprise import BaselineOnly, KNNBasic, NormalPredictor
from surprise import accuracy
from surprise.model_selection import KFold
#import pandas as pd

# 数据读取,先定义一个读取器,以','分隔,第一行跳过
reader = Reader(line_format='user item rating timestamp', sep=',', skip_lines
评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值