北大《推荐系统》课程-基于模型的协同过滤

目录

1.基于关联规则的推荐算法

定义和基本概念:

置信度和支持度的计算:

关联规则挖掘:

生成频繁项集的Apriori算法:

提升度和相关度筛选规则:

基于关联规则的算法:

2.矩阵分解模型

2.1 SVD分解矩阵分解模型(不含缺失值)

2.2 隐语义模型LFM(可以含缺失值)

使用的目标函数:

解决最小二乘法的过拟合问题:

参数学习方法一 梯度下降法:

参数学习方法二 交替最小二乘法:

2.3 概率矩阵分解PMF(系统存在噪音)

算法假设:

使用最大后验概率估计计算参数:

2.4 限制性概率矩阵分解PMF

2.5带偏置的矩阵分解BisaSVD

2.6 SVD++

实际中遇到缺少负样本和矩阵稀疏问题

2.7 基于正样本过采样的矩阵分解

2.8 基于负样本欠采样:


注:北大刘宏志老师的《推荐系统》课程学习,图片来源于课程PPT和参考书籍

1.基于关联规则的推荐算法

算法的基本思想是计算不同项目同时出现的概率的大小,也就是计算支持度和置信度。使用基于模型的原因:基于邻域的协同过滤只利用局部信息,没有利用全局信息,而且内存占用多。

定义和基本概念:

描述在交易中项目之间同时出现的规律的知识模式。通过量化的数字描述项目A的出现对项目B的出现有多大的影响。

 

置信度和支持度的计算:

 

关联规则挖掘:

 

生成频繁项集的Apriori算法:

 

提升度和相关度筛选规则:

当项目的总体先验概率比通过规则计算出来的置信度要高,则规则无效。所以需要提升度和相关度对规则进行筛选。经过筛选后的规则是强关联的有效规则。

 

 

基于关联规则的算法:

 

2.矩阵分解模型

2.1 SVD分解矩阵分解模型(不含缺失值)

 

 

2.2 隐语义模型LFM(可以含缺失值)

 

使用的目标函数:

解决最小二乘法的过拟合问题:

 

 

参数学习方法一 梯度下降法:

 

参数学习方法二 交替最小二乘法:

 

2.3 概率矩阵分解PMF(系统存在噪音)

通过观测值推测内部特征矩阵

贝叶斯观点:

 

算法假设:

 

 

使用最大后验概率估计计算参数:

 

2.4 限制性概率矩阵分解PMF

相比于PMF,限制性就是加上一些用户和项目的隐藏特征,例如点击等

 

2.5带偏置的矩阵分解BisaSVD

 

2.6 SVD++

 

实际中遇到缺少负样本和矩阵稀疏问题

 

2.7 基于正样本过采样的矩阵分解

 

2.8 基于负样本欠采样:

 

 

  • 2
    点赞
  • 15
    收藏
    觉得还不错? 一键收藏
  • 打赏
    打赏
  • 1
    评论
评论 1
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包

打赏作者

KPer_Yang

你的鼓励将是我创作的最大动力

¥1 ¥2 ¥4 ¥6 ¥10 ¥20
扫码支付:¥1
获取中
扫码支付

您的余额不足,请更换扫码支付或充值

打赏作者

实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值