- 博客(3)
- 收藏
- 关注
原创 Spark的GraphX中关于两图合并的算法
目前,spark的Graphx库中没有实现两个图的合并算法。 图合并:意味着名称相同的定点要进行合并,所有其他的唯一的定点和边也要和进来。 为了深度数据分析的需要,如果将不同的数据源构建的两个图,合并成一个大图,图合并(Mergeing)是非常有用的。 实现代码如下: import org.apache.spark.graphx._ def mergeGraphs(g1:Graph[S
2016-10-12 16:56:41 1859
原创 spark的Graphx中subGraph算法的改进
众所周知,在spark Graphx的求子图方法subgraph中,返回的子图有可能会包含孤立点,即该点无任何边: 算法源码如下所示: override def subgraph( epred: EdgeTriplet[VD, ED] => Boolean = x => true, vpred: (VertexId, VD) => Boolean = (a, b) => t
2016-10-11 21:24:45 1485
原创 王家林老师的免费大数据视频,欢迎大家下载学习。
王家林的第一个中国梦:免费为全社会培养100万名优秀的大数据从业人员! 您可以通过王家林老师的微信号18610086859发红包捐助大数据、互联网+、O2O、工业4.0、微营销、移动互联网等系列免费实战课程, 目前已经发布的王家林免费视频全集如下: 1,《大数据不眠夜:Spark内核天机解密(共100讲)》:http://pan.baidu.com/s/1eQsHZAq 2,《
2015-11-09 19:58:41 1522 3
空空如也
空空如也
TA创建的收藏夹 TA关注的收藏夹
TA关注的人