hive on spark 已测，完美搭建

小源有知识

已于 2024-01-23 16:21:59 修改

阅读量3.1k

点赞数 7

分类专栏：大数据组件搭建文章标签： spark hive hadoop

于 2022-07-01 14:00:31 首次发布

本文链接：https://blog.csdn.net/qq_42147602/article/details/125556761

版权

大数据组件搭建专栏收录该内容

2 篇文章 0 订阅

订阅专栏

hive on spark 已测，完美搭建

前言

安装包版本
Hadoop-3.1.3
Hive-3.1.2
Spark-3.0.0
最下面可下载博主安装包，已经经过编译，可以避开许多坑

一、Hive on Spark配置

1）兼容性说明
注意：官网下载的Hive3.1.2和Spark3.0.0默认是不兼容的。因为Hive3.1.2支持的Spark版本是2.4.5，所以需要我们重新编译Hive3.1.2版本。
编译步骤：官网下载Hive3.1.2源码，修改pom文件中引用的Spark版本为3.0.0，如果编译通过，直接打包获取jar包。如果报错，就根据提示，修改相关方法，直到不报错，打包获取jar包，不过上面的链接已经是经过编译的，可以直接拿来使用。
2）在Hive所在节点部署Spark
如果之前已经部署了Spark，则该步骤可以跳过，但要检查SPARK_HOME的环境变量配置是否正确。

二、使用步骤

1.上传并解压解压spark-3.0.0-bin-hadoop3.2.tgz

代码如下（示例）：

[root@node1 software]$ tar -zxvf spark-3.0.0-bin-hadoop3.2.tgz -C /opt/module/
[root@node1 software]$ mv /opt/module/spark-3.0.0-bin-hadoop3.2 /opt/module/spark

2.配置SPARK_HOME环境变量

代码如下（示例）：

[root@node1 software]$ sudo vim /etc/profile.d/my_env.sh
# 添加如下内容
# SPARK_HOME
export SPARK_HOME=/opt/module/spark
export PATH=$PATH:$SPARK_HOME/bin

source 使其生效
[root@node1 software]$ source /etc/profile.d/my_env.sh

3.在hive中创建spark配置文件

1) 添加如下内容（在执行任务时，会根据如下参数执行），如果没有重命名spark-defaults.conf请重命名
[root@node1 software]$ vim /opt/module/hive/conf/spark-defaults.conf
	spark.master                               yarn
	spark.eventLog.enabled                   true
	spark.eventLog.dir                        hdfs://node1:8020/spark-history
	spark.executor.memory                    1g
	spark.driver.memory					   1g

在HDFS创建如下路径，用于存储历史日志

[root@node1  software]$ hadoop fs -mkdir hdfs://node1:8020/spark-history

向HDFS上传Spark纯净版jar包

（1）上传并解压spark-3.0.0-bin-without-hadoop.tgz

[root@node1 software]$ tar -zxvf /opt/software/spark-3.0.0-bin-without-hadoop.tgz

（2）上传Spark纯净版jar包到HDFS

[root@node1 software]$ hadoop fs -mkdir /spark-jars

[root@node1 software]$ hadoop fs -put spark-3.0.0-bin-without-hadoop/jars/* /spark-jars

4.修改hive-site.xml文件

[root@node1 ~]$ vim /opt/module/hive/conf/hive-site.xml

添加如下内容

<!--Spark依赖位置（注意：端口号8020必须和namenode的端口号一致）-->
<property>
    <name>spark.yarn.jars</name>
    <value>hdfs://node1:8020/spark-jars/*</value>
</property>
  
<!--Hive执行引擎-->
<property>
    <name>hive.execution.engine</name>
    <value>spark</value>
</property>

5.Hive on Spark测试

1）启动hive客户端

[root@node1 hive]$ bin/hive

（2）创建一张测试表

hive (default)> create table student(id int, name string);

（3）通过insert测试效果

hive (default)> insert into table student values(1,'abc');

若结果如下，则说明配置成功
在这里插入图片描述

总结

本次是对已经有搭建基础的人做讲解，其他组件安装教程后续发布

在这里插入图片描述
回复【hive-spark】

小源有知识

关注

7
点赞
踩
26

收藏

觉得还不错? 一键收藏
打赏
8
评论
复制链接

分享到 QQ

分享到新浪微博

扫一扫

专栏目录

hive on spark 已测，完美搭建

前言

一 、Hive on Spark配置

二、使用步骤

1.上传并解压解压spark-3.0.0-bin-hadoop3.2.tgz

2.配置SPARK_HOME环境变量

3.在hive中创建spark配置文件

4.修改hive-site.xml文件

5.Hive on Spark测试

总结

一、Hive on Spark配置