从容入世-CSDN博客

排序：: 按最后发布时间; 按访问量; RSS订阅

空空如也

03_SparkRDD（RDD编程实战）

通过spark实现运营案例，使用spark的python接口实现。

2018-08-28

Spark是一种快速、通用、可扩展的大数据分析引擎，2009年诞生于加州大学伯克利分校AMPLab，2010年开源，2013年6月成为Apache孵化项目，2014年2月成为Apache顶级项目。目前，Spark生态系统已经发展成为一个包含多个子项目的集合，其中包含SparkSQL、Spark Streaming、GraphX、MLlib等子项目，Spark是基于内存计算的大数据并行计算框架。Spark基于内存计算，提高了在大数据环境下数据处理的实时性，同时保证了高容错性和高可伸缩性，允许用户将Spark部署在大量廉价硬件之上，形成集群。Spark得到了众多大数据公司的支持，这些公司包括Hortonworks、IBM、Intel、Cloudera、MapR、Pivotal、百度、阿里

2018-08-28

空空如也

TA创建的收藏夹 TA关注的收藏夹

TA关注的人

u010749802的博客

空空如也

03_SparkRDD（RDD编程实战）

01_Spark基础（spark概述、spark集群安装）

空空如也