Hadoop环境下安装Spark-2.4.8

Hadoop环境下安装Spark-2.4.8

环境准备

  • Linux(CentOS7)

  • Hadoop(3.1.3)

  • JDK(1.8)

1.下载Spark安装包

访问Spark官网下载Spark安装文件,spark-2.4.8版本下载地址,将其放到/opt/software目录下。

下载完安装文件后,需要对文件进行解压,执行命令将其解压到/opt/module/目录下。

$ tar -zxvf spark-2.4.8-bin-hadoop2.7.tgz -C /opt/module

修改spark目录名称。

$ cd /opt/module
$ mv spark-2.4.8-bin-hadoop2.7/ ./spark-2.4.8

2.配置相关文件

安装文件解压缩后,还需修改Spark的配置文件spark-env.sh。首先复制一份Spark安装文件自带的配置文件模板以修改。

$ cd spark-2.4.8/
$ cp ./conf/spark-env.sh.template ./conf/spark-env.sh

然后使用vim编辑器打开spark-env.sh文件进行编辑,

$ vim ./conf/spark-env.sh

在文件第一行添加配置信息

export SPARK_DIST_CLASSPATH=$(/opt/module/hadoop-3.1.3/bin/hadoop classpath) 
#括号里是/hadoop安装目录/bin/hadoop空格后直接输classpath

image-20230923130800264

添加后保存,这样Spark就可以把数据存储到Hadoop分布式文件系统HDFS中,也可以从HDFS中读取数据。

3.通过实例验证Spark是否安装成功

进入到Spark目录下,执行实例SparkPi

$ cd /opt/module/spark-2.4.8/
$ bin/run-example SparkPi

执行命令会输出很多屏幕信息,不容易找到输出结果,通过grep命令过滤,

$ bin/run-example SparkPi  2>&1 |grep "Pi is roughly"

过滤后得到,可以得到Π的近似值。

image-20230923131003801

  • 0
    点赞
  • 1
    收藏
    觉得还不错? 一键收藏
  • 1
    评论

“相关推荐”对你有帮助么?

  • 非常没帮助
  • 没帮助
  • 一般
  • 有帮助
  • 非常有帮助
提交
评论 1
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值