大数据(十一)--Spark概述

Apache-Qibao

于 2018-11-18 17:42:45 发布

阅读量2k

点赞数 7

分类专栏：大数据文章标签：大数据 Spark概述历史技术栈优势

版权声明：本文为博主原创文章，遵循 CC 4.0 BY-SA 版权协议，转载请附上原文出处链接和本声明。

本文链接：https://blog.csdn.net/skisqibao/article/details/84130389

版权

Spark是一个由Apache基金会开发的内存计算大数据处理框架，它以其高效、易用和通用性受到广泛欢迎。相较于Hadoop，Spark在内存计算和DAG执行引擎的支持下，能够提供更快的运行速度和更低的延迟，尤其适用于需要迭代计算的场景。Spark支持Scala、Java、Python和R编程，并提供SQL查询、流处理、机器学习和图计算等多种组件。

摘要生成于 C知道，由 DeepSeek-R1 满血版支持，前往体验 >

Spark概述

Spark 简介
Spark 历史
Spark 技术栈
Spark相较于Hadoop的优点

Spark 简介

Spark官网为: http://spark.apache.org/, Spark也是用于海量数据处理的计算框架. 官方对Spark的定义是:

Apache Spark™ is a unified analytics engine for large-scale data processing.
翻译过来是: Spark是用于大规模数据处理的统一分析引擎。

Spark最初由美国加州伯克利大学（UCBerkeley）的AMP（Algorithms, Machines and People）实验室于2009年开发. Spark是基于内存计算的大数据并行计算框架, 可用于构建大型的、低延迟的数据分析应用程序. 2013年, Spark加入Apache孵化器项目后, 开始迅猛发展, 如今已成为Apache软件基金会最重要的三大分布式计算系统开源项目之一.

Spark作为大数据计算平台的后起之秀, 在2014年打破了Hadoop保持的基准排序 (Sort Benchmark) 纪录, 使用206个节点在23分钟的时间里完成了100TB数据的排序; 而Hadoop则是使用2000个节点在72分钟的时间里完成同样数据的排序. 也就是说, Spark仅使用了Hadoop十分之一的计算资源, 获得了比Hadoop快3倍的速度. 新纪录的诞生, 使得Spark获得多方追捧, 也表明了Spark可以作为一个更加快速、高效的大数据计算平台.

Spark具有如下几个主要特点:

运行速度快, 高效: Spark使用先进的DAG(Directed Acyclic Graph, 有向无环图)执行引擎, 以支持循环数据流与内存计算, 减少了迭代过程中的数据落地. 基于内存的执行速度可比MapReduce快上百倍, 基于磁盘的执行速度能快十倍

最低0.47元/天解锁文章

博客等级

码龄8年

50
原创

155
点赞

246
收藏

237
粉丝

关注

私信

热门文章

分类专栏

展开全部收起

最新评论

大数据(十九) -- Hive操作--基础
馬鹿不思議: 期待大佬回归呀
微博抽奖男人 = 辣鸡, IG.WXZ为你证明
私は婕が好きだ: 写的很好啊，但是没什么人看见，可以换个标题和关键词！
Java基础知识点总结--从细节再看Java（一）
烨尧: 我的java个人心得，入门很重要，但是大多数人都搞错了方向，把入门变成了入土。。。：第一.切记不要一上来就找一大本厚书看。这样你绝对会放弃。《Java核心技术》《Java编程思想》等都不适合入门阅读，很容易半途而废。第二.先找一个入门级别的java教程看。网上有很多极简入门教程。例如runoob网站、w3cschool网站(它还有手机app)（上网搜一下关键词就有了）。我记得我一开始入门找的教程，知识面全而精炼简洁，含有基础、spring、Hibernate Servlet 等,地址如下仅供参考。https://how2j.cn/p/7245 第三.当你学完刚才那些网站之后，你应该此时对java有了一个整体的认识，那就去找一个小项目，GitHub很棒，https://github.com/上手练习，边做项目边查资料。进步会飞快。第四.这个阶段再回头精读一些java经典书籍。获得内功上的提升。总之，一定要循序渐进，一点点学才是最正确的选择。个人愚见，仅供参考
大数据(二) --分布式文件系统(HDFS)
Apache-Qibao: 哈哈哈,good job,可惜我快忘干净了,准备面试尴尬的一批
大数据(二) --分布式文件系统(HDFS)
黑瞳丶: 2019年参加的大数据比赛，现在考研复试复习看一下，很nice 啊博主把我的记忆唤醒了！

大家在看

最新文章

目录

展开全部

收起

评论

被折叠的条评论为什么被折叠?

到【灌水乐园】发言

查看更多评论

添加红包

成就一亿技术人!

hope_wisdom

发出的红包

实付元

使用余额支付

点击重新获取

扫码支付

钱包余额 0

抵扣说明：

1.余额是钱包充值的虚拟货币，按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载，可以购买VIP、付费专栏及课程。