自定义博客皮肤VIP专享

*博客头图:

格式为PNG、JPG,宽度*高度大于1920*100像素,不超过2MB,主视觉建议放在右侧,请参照线上博客头图

请上传大于1920*100像素的图片!

博客底图:

图片格式为PNG、JPG,不超过1MB,可上下左右平铺至整个背景

栏目图:

图片格式为PNG、JPG,图片宽度*高度为300*38像素,不超过0.5MB

主标题颜色:

RGB颜色,例如:#AFAFAF

Hover:

RGB颜色,例如:#AFAFAF

副标题颜色:

RGB颜色,例如:#AFAFAF

自定义博客皮肤

-+
  • 博客(3)
  • 收藏
  • 关注

原创 Spark的GraphX中关于两图合并的算法

目前,spark的Graphx库中没有实现两个图的合并算法。 图合并:意味着名称相同的定点要进行合并,所有其他的唯一的定点和边也要和进来。 为了深度数据分析的需要,如果将不同的数据源构建的两个图,合并成一个大图,图合并(Mergeing)是非常有用的。 实现代码如下: import org.apache.spark.graphx._ def mergeGraphs(g1:Graph[S

2016-10-12 16:56:41 1859

原创 spark的Graphx中subGraph算法的改进

众所周知,在spark Graphx的求子图方法subgraph中,返回的子图有可能会包含孤立点,即该点无任何边: 算法源码如下所示: override def subgraph( epred: EdgeTriplet[VD, ED] => Boolean = x => true, vpred: (VertexId, VD) => Boolean = (a, b) => t

2016-10-11 21:24:45 1485

原创 王家林老师的免费大数据视频,欢迎大家下载学习。

 王家林的第一个中国梦:免费为全社会培养100万名优秀的大数据从业人员! 您可以通过王家林老师的微信号18610086859发红包捐助大数据、互联网+、O2O、工业4.0、微营销、移动互联网等系列免费实战课程, 目前已经发布的王家林免费视频全集如下: 1,《大数据不眠夜:Spark内核天机解密(共100讲)》:http://pan.baidu.com/s/1eQsHZAq  2,《

2015-11-09 19:58:41 1522 3

空空如也

空空如也

TA创建的收藏夹 TA关注的收藏夹

TA关注的人

提示
确定要删除当前文章?
取消 删除