云计算
yiweis
这个作者很懒,什么都没留下…
展开
-
使用Orange进行数据挖掘之聚类分析(1)------层次聚类
一、层次聚类1 层次聚类的基本概念 层次聚类方法是古老而且常用的聚类方法。层次聚类方法又有两种产生层次聚类的基本方法。凝聚的:该方法是自底向上的方法,初始每个对象看做一个簇,每一步合并最相近的簇,最终形成一个簇。分类的:该方法是自顶向下的方法,从包含的所有点的簇开始,每一步分裂一个簇,知道仅剩下单点的簇。本文主要关注凝聚的层次聚类方法。2 簇之间的邻近性在凝原创 2012-12-29 19:18:37 · 8198 阅读 · 0 评论 -
使用Orange进行数据挖掘之分类(1)------朴素贝叶斯分类
基本概念贝叶斯分类法是基于统计学的分类法。比较分类算法,该方法可以和决策树、神经网络分类相媲美。朴素贝叶斯分类法基于数据属性之间是独立的假定。贝叶斯定理首先是用到的基本表达式,P(H|X)表示条件X下,H的后验概率。P(H)是表示H发生的先验概率。贝叶斯定理是:P(H|X)=P(X|H)P(H)/P(X)朴素贝叶斯分类 设D是用于训练的数据集,原创 2013-01-02 14:18:28 · 5680 阅读 · 0 评论 -
使用Orange进行数据挖掘之分类(3)------决策树
决策树决策树基本决策树类似流程图,内部节点表示在一个属性的上的测试,比如age属性是否大于30等,每个分支代表一个属性测试的输出,最下层的叶子节点代表具体的类。下面是《数据挖掘:概念与技术》上的例子,数据为:根据ID3算法生成的决策树如下:生成据测树的基本算法在这一算法步骤(6)中计算信息增益我们对每个分布计算期望信息。对于age= ”I(s11原创 2013-01-04 15:18:09 · 13239 阅读 · 0 评论 -
使用Orange进行数据挖掘之分类(2)------KNN分类
knn基本概念knn把每个样例看做是空间上的一个点,给定一个测试样例,使用适当的邻近性度量算法,计算出该点与训练集中其他点的邻近度。选择K个最相近的点。在选择出的K个样例中,比例最好的类就是测试样例的类。从以上描述中可以看出,如果k选择的太小,该算法容易受到噪声的影响,而产生过度拟合的影响,然而如果选择的过大,可能造成误分类。算法描述:k是最近邻数目,D是训练样例的原创 2013-01-02 17:00:57 · 4833 阅读 · 0 评论 -
使用Orange进行数据挖掘之聚类分析(2)------K-means
一、基本k均值算法1 根据用户指定的参数K,首先选择K个初始化质心;2 然后每个点指派到最近的质心,指派到一个质心的点形成一个簇。3 更新每个簇的质心4重复步骤2、3,直到簇不在发生变化。伪代码描述如下:选择K个点作为初始质心repeat 将每个质心指派到最近的质心,形成K个簇 重新计算每个簇的质心until 质心不在发生变化二、Orange中K原创 2012-12-31 10:25:27 · 9148 阅读 · 0 评论 -
Cloud Foundry参赛博文——用BOSH部署CloudFoundry实战
Cloud Foundry参赛博文——用BOSH部署CloudFoundry实战当您看到这篇文章的时候,相信对什么是CloudFoundry、BOSH、dev_setup已经非常熟悉了。客套的我们就不说了,直接上干果。用dev_setup部署看官,您先别惊讶,文章名字虽说叫用BOSH部署CloudFoundry实战,还允许我说下对用dev_setup部署的一点经验,也许对您有一原创 2012-10-13 23:07:02 · 6325 阅读 · 3 评论