- 博客(3)
- 资源 (4)
- 收藏
- 关注
转载 Mahout-DistanceMeasure (数据点间的距离计算方法)
在分类聚类算法,推荐系统中,常要用到两个输入变量(通常是特征向量的形式)距离的计算,即相似性度量.不同相似性度量对于算法的结果,有些时候,差异很大.因此,有必要根据输入数据的特征,选择一种合适的相似性度量方法.令X=(x1,x2,..,xn)T,Y=(y1,y2,...yn)T为两个输入向量, 1.欧几里得距离(Euclidean distance)-EuclideanDistance
2015-11-05 19:47:59 380
转载 机器学习中的相似性度量
from http://blog.sina.com.cn/s/blog_ab3fbf1b0101jfj1.html在做分类时常常需要估算不同样本之间的相似性度量(Similarity Measurement),这时通常采用的方法就是计算样本间的“距离”(Distance)。采用什么样的方法计算距离是很讲究,甚至关系到分类的正确与否。本文的目的就是对常用的相似性度量作一个总结。本文目录:
2015-11-03 14:31:12 221
转载 基于mahout的相似度算法的实现
欧几里德相似度(Euclidean Distance)最初用于计算欧几里德空间中两个点的距离,以两个用户x和y为例子,看成是n维空间的两个向量x和y, xi表示用户x对itemi的喜好值,yi表示用户y对itemi的喜好值,他们之前的欧几里德距离是 对应的欧几里德相似度,一般采用以下公式进行转换:距离越小 ,相似度越大 在taste里,计算user
2015-11-02 10:22:03 489
空空如也
TA创建的收藏夹 TA关注的收藏夹
TA关注的人