自定义博客皮肤VIP专享

*博客头图:

格式为PNG、JPG,宽度*高度大于1920*100像素,不超过2MB,主视觉建议放在右侧,请参照线上博客头图

请上传大于1920*100像素的图片!

博客底图:

图片格式为PNG、JPG,不超过1MB,可上下左右平铺至整个背景

栏目图:

图片格式为PNG、JPG,图片宽度*高度为300*38像素,不超过0.5MB

主标题颜色:

RGB颜色,例如:#AFAFAF

Hover:

RGB颜色,例如:#AFAFAF

副标题颜色:

RGB颜色,例如:#AFAFAF

自定义博客皮肤

-+
  • 博客(3)
  • 收藏
  • 关注

原创 RDD数据去重(时间连续变化,断面以及客流连续不变的只保留第一条记录)

先将RDD按断面分组,生成新的RDDrdd.groupBy(s => (s.station_fore,s.station_back)).map(s=> cleandata(s)).flatMap(s=>s)//flatMap将数组展开,每条数据生成一条记录def cleandata(data:((String,String),Iterable[sample])):Array[sa...

2018-03-13 09:28:29 1523

原创 spark基础知识点

1.     Spark是一个基于内存的用于处理、分析大数据的集群计算框架。他提供了一套简单的编程接口,从而使得应用程序开发者方便使用集群节点的CPU、内存、存储资源来处理大数据。2.     Spark主要特点:1.     使用方便:spark提供了比MapReduce更简单的编程模型。Spark针对开发大数据应用程序提供了丰富的API,这些API比Hadoop MapReduce更易读懂。相...

2018-03-12 23:18:13 639

原创 Python-Fatal error in launcher: Unable to create process using '"'

将python3.6安装在C:\Python36目录下然后进入C:\Python36目录下执行pip -V能正常使用但是为了同时使用python2和python3,于是将python.exe改名为python3.exe,重新执行pip -V发现错误C:\Python36>pip3Fatal error in launcher: Unable to create process using ...

2018-03-08 10:55:06 565

空空如也

空空如也

TA创建的收藏夹 TA关注的收藏夹

TA关注的人

提示
确定要删除当前文章?
取消 删除