黑猴子的家：Spark SQL 的背景故事

最新推荐文章于 2022-06-09 15:35:00 发布

黑猴子的家

最新推荐文章于 2022-06-09 15:35:00 发布

阅读量270

点赞数 1

版权声明：本文为博主原创文章，遵循 CC 4.0 BY-SA 版权协议，转载请附上原文出处链接和本声明。

本文链接：https://blog.csdn.net/qq_28652401/article/details/95453773

版权

1、Spark SQL的前身是Shark。

为了给熟悉RDBMS（关系型数据库）但又不理解MapReduce的技术人员，提供快速上手的工具，Hive应运而生，它是当时唯一运行在Hadoop上的SQL-on-Hadoop工具。但是MapReduce计算过程中大量的中间磁盘落地过程消耗了大量的I/O，降低的运行效率，为了提高SQL-on-Hadoop的效率，大量的SQL-on-Hadoop工具开始产生，其中表现较为突出的是：
（1）MapR的Drill
（2）Cloudera的Impala
（3）Shark

2、SparkSQL摆脱了对Hive的依赖性

Shark对于Hive的太多依赖（如采用Hive的语法解析器、查询优化器等等），但SparkSQL摆脱了对Hive的依赖性，无论在数据兼容、性能优化、组件扩展方面都得到了极大的方便。

（1）数据兼容方面不但兼容Hive，还可以从RDD、parquet文件、JSON文件中获取数据，未来版本甚至支持获取RDBMS数据以及cassandra等NOSQL数据；

（2）性能优化方面除了采取In-Memory Columnar Storage、byte-code generation等优化技术外、将会引进Cost Model对查询进行动态评估、获取最佳物理计划等等；

（3）组件扩展方面无论是SQL的语法解析器、分析器还是优化器都可以重新定义，进行扩展；

黑猴子的家

关注

1
点赞
踩
0

收藏

觉得还不错? 一键收藏
0
评论
黑猴子的家：Spark SQL 的背景故事

1、Spark SQL的前身是Shark。为了给熟悉RDBMS（关系型数据库）但又不理解MapReduce的技术人员，提供快速上手的工具，Hive应运而生，它是当时唯一运行在Hadoop上的SQL-on-Hadoop工具。但是MapReduce计算过程中大量的中间磁盘落地过程消耗了大量的I/O，降低的运行效率，为了提高SQL-on-Hadoop的效率，大...
复制链接

扫一扫

黑猴子的家

博客等级

码龄9年

1543
原创

176
点赞

671
收藏

443
粉丝

关注

私信

热门文章

分类专栏

最新评论

黑猴子的家：华为 OpenEuler-20.03-LTS 配置UKUI图形化界面
cqwuliu: 远程有界面吗
黑猴子的家：Centos 7.x gcc 4.8.5 升级到 gcc 4.9.4
m0_75017410: make install也是报错。 [root@localhost build]# make install make[1]: 进入目录“/root/software/gcc-4.9.0/build” /bin/sh ../mkinstalldirs /usr/local /usr/local make[2]: 进入目录“/root/software/gcc-4.9.0/build/fixincludes” make[2]: *** 没有规则可以创建目标“install”。停止。 make[2]: 离开目录“/root/software/gcc-4.9.0/build/fixincludes” make[1]: *** [install-fixincludes] 错误 2 make[1]: 离开目录“/root/software/gcc-4.9.0/build” make: *** [install] 错误 2 [root@localhost build]#
黑猴子的家：Centos 7.x gcc 4.8.5 升级到 gcc 4.9.4
m0_75017410: 为什么 make -j4后会出现以下情况。 ranlib .libs/libgmp.a rm -fr .libs/libgmp.lax creating libgmp.la (cd .libs && rm -f libgmp.la && ln -s ../libgmp.la libgmp.la) make[5]: 离开目录“/root/software/gcc-4.9.0/build/gmp” make[4]: 离开目录“/root/software/gcc-4.9.0/build/gmp” make[3]: 离开目录“/root/software/gcc-4.9.0/build/gmp” make[2]: 离开目录“/root/software/gcc-4.9.0/build” make[1]: *** [stage1-bubble] 错误 2 make[1]: 离开目录“/root/software/gcc-4.9.0/build” make: *** [all] 错误 2 [root@localhost build]#
黑猴子的家：Centos 7.x gcc 4.8.5 升级到 gcc 4.9.4
ironSid: 得到子目录是吗
黑猴子的家：Centos 7.x gcc 4.8.5 升级到 gcc 4.9.4
MoXiaoJie_55: me too

最新文章

目录

评论

被折叠的条评论为什么被折叠?

到【灌水乐园】发言

查看更多评论

添加红包

成就一亿技术人!

hope_wisdom

发出的红包

实付元

使用余额支付

点击重新获取

扫码支付

钱包余额 0

抵扣说明：

1.余额是钱包充值的虚拟货币，按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载，可以购买VIP、付费专栏及课程。