搭建hadoop集群

1.虚拟机准备

首先通过 该文搭建好一台服务器
《适合小白的配置hadoop环境教程》

如何克隆出两个服务器

修改:
mac地址
ip地址
主机名
主机列表
添加主机互信

scp(secure copy)安全拷贝

scp定义:
scp可以实现服务器与服务器之间的数据拷贝。(from server1 to server2)
基本语法

scp    -r          $pdir/$fname              $user@hadoop$host:$pdir
命令   递归       要拷贝的文件路径/名称          目的用户@主机:目的路径

在这里插入图片描述

2.集群配置

2.1集群部署规划

hadoop001(192.168.83.101)hadoop002 (1921.168.83.102)hadoop003(192.168.83.103)
HDFSNameNode、DataNodeDataNodeSecondaryNameNode、DataNode
YARNNodeManagerResourceManager、NodeManagerNodeManager

2.2. 配置集群

配置core-site.xml

<!-- 指定HDFS中NameNode的地址 -->
<property>
		<name>fs.defaultFS</name>
      <value>hdfs://192.168.83.101:9000</value>
</property>

配置hdfs-site.xml

<property>
		<name>dfs.replication</name>
		<value>3</value>
</property>

<!-- 指定Hadoop辅助名称节点主机配置 -->
<property>
      <name>dfs.namenode.secondary.http-address</name>
      <value>192.168.83.103:50090</value>
 </property>

配置yarn-site.xml

<!-- 指定YARN的ResourceManager的地址 -->
<property>
		<name>yarn.resourcemanager.hostname</name>
		<value>hadoop002</value>
</property>

配置salves,添加主机名称
在这里插入图片描述

分发配置文件

[root@hadoop001 etc]# scp -r hadoop root@hadoop002:/opt/hadoop/etc/
[root@hadoop001 etc]# scp -r hadoop root@hadoop003:/opt/hadoop/etc/

3.集群单点启动

只在主节点(hadoop001)执行

首先删除logs/tmp

rm -rf logs/
rm -rf tmp/

格式化namenode

hadoop namenode -format

启动

start-all.sh

在这里插入图片描述
在这里插入图片描述
在这里插入图片描述
访问web测试成功
在这里插入图片描述

4.后续

博主在后续部署过程当中发现,DataNode、ResourceManager总是启动失败,这时可以手动单独启动。
启动 ResourceManage

yarn-daemon.sh start resourcemanager

启动DataNode

hadoop-daemon.sh start datanode
  • 0
    点赞
  • 1
    收藏
    觉得还不错? 一键收藏
  • 0
    评论
RHadoop是运行R语言的Hadoop分布式计算平台的简称。要认识Rhadoop首先我们分别来认识R语言和HadoopHadoop已经成名好多年了,它是Apache软件基金会旗下的一个JAVA开源分布式计算平台,现已被各大互联网企业(包括Yahoo和Facebook等)用于大规模数据分布式存储与分布式计算。近年来随着云计算、大数据处理、数据挖掘等概念和应用越来越火,Hadoop更是名声大噪,各大企业对熟悉Hadoop体系架构和性能优化的人才需求也相当旺盛,人才缺口也相对加大。 R语言可能对大多数人来说比较陌生,但是做数理统计、数据分析的人不会不知道R。R是一门主要运用于统计分析与绘图的编程语言和操作工具。和Matlab类似,R是一门高级脚本化编程语言,直接在命令行输入指令即可运行,无需编译链接。它可以进行高效的向量化运算,效率远高于传统的循环运算。另外,R是开源的,有大批杰出的工程师和程序员为R开发了许多好用的函数库和图形化工具,尤其在数理统计方面有大量成熟的开源的程序包。所以R是做数据挖掘、数据分析的廉价高效的方案。 所以如果让能R运行在Hadoop平台上可以说是如虎添翼,可以让数据分析人员,即能用到R丰富的程序包,又能借助Hadoop分布式运算、分布式存储的优势做海量数据的处理。 现在,这个如果已经可以成为结果

“相关推荐”对你有帮助么?

  • 非常没帮助
  • 没帮助
  • 一般
  • 有帮助
  • 非常有帮助
提交
评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值