搭建完全分布式系统+主机名无法访问hadoop web页面

最新推荐文章于 2024-07-11 18:52:23 发布

张渝俊

最新推荐文章于 2024-07-11 18:52:23 发布

阅读量1.8k

点赞数

分类专栏：大数据学习文章标签： hadoop

本文链接：https://blog.csdn.net/weixin_44253659/article/details/124230482

版权

大数据学习专栏收录该内容

3 篇文章 1 订阅

订阅专栏

搭建完全分布式系统

一、通用脚本编写

1.群发分发脚本编写

群发脚本常用命令

scp    -r  $pdir/$fname $user@hadoop$host:$pdir/$fname
命令   递归       要拷贝的文件路径/名称    目的用户@主机:目的路径/名称

rsync    -av   $pdir/$fname  $user@hadoop$host:$pdir/$fname
命令   选项参数  要拷贝的文件路径/名称    目的用户@主机:目的路径/名称

群发脚本编写

首先需要在/home/zyj/bin目录下存放脚本，这样zyj用户才可以在系统的任何地方直接执行。

1. cd /home/zyj
2. mkdir bin
3. vim bin/my_xsync.sh

my_xsync.sh具体代码

#!/bin/bash
#1. 判断参数个数
if [ $# -lt 1 ]
then
  echo Not Enough Arguement!
  exit;
fi
#2. 遍历集群所有机器
for host in hadoop102 hadoop103 hadoop104
do
  echo ====================  $host  ====================
  #3. 遍历所有目录，挨个发送
  for file in $@
  do
    #4. 判断文件是否存在
    if [ -e $file ]
    then
      #5. 获取父目录
      pdir=$(cd -P $(dirname $file); pwd)
      #6. 获取当前文件的名称
      fname=$(basename $file)
      ssh $host "mkdir -p $pdir"
      rsync -av $pdir/$fname $host:$pdir
    else
      echo $file does not exists!
    fi
  done
done

修改文件权限chmod 744 my_xsync.sh

2.查看三台java服务器进程的脚本

同上面操作创建脚本my_jpsall.shtouch my_jpsall.sh ，给权限chmod 744 my_jpsall.sh，编辑文件vim my_jpsall.sh

#!/bin/bash
for host in hadoop102 hadoop103 hadoop104
do
        echo =============== $host ===============
        ssh $host jps $@ | grep -v Jps
done

3.群起群停脚本

同上面操作创建脚本my_hadoop.shtouch my_hadoop.sh ，给权限chmod 744 my_hadoop.sh，编辑文件vim my_hadoop.sh

#!/bin/bash
if [ $# -lt 1 ]
then
    echo "No Args Input..."
    exit ;
fi
case $1 in
"start")
        echo " =================== 启动 hadoop集群 ==================="

        echo " --------------- 启动 hdfs ---------------"
        ssh hadoop102 "/opt/module/hadoop-3.1.3/sbin/start-dfs.sh"
        echo " --------------- 启动 yarn ---------------"
        ssh hadoop103 "/opt/module/hadoop-3.1.3/sbin/start-yarn.sh"
        echo " --------------- 启动 historyserver ---------------"
        ssh hadoop102 "/opt/module/hadoop-3.1.3/bin/mapred --daemon start historyserver"
;;
"stop")
        echo " =================== 关闭 hadoop集群 ==================="

        echo " --------------- 关闭 historyserver ---------------"
        ssh hadoop102 "/opt/module/hadoop-3.1.3/bin/mapred --daemon stop historyserver"
        echo " --------------- 关闭 yarn ---------------"
        ssh hadoop103 "/opt/module/hadoop-3.1.3/sbin/stop-yarn.sh"
        echo " --------------- 关闭 hdfs ---------------"
        ssh hadoop102 "/opt/module/hadoop-3.1.3/sbin/stop-dfs.sh"
;;
*)
    echo "Input Args Error..."
;;
esac

群起：my_hadoop.sh start；群停：my_hadoop.sh stop

二、SSH无密登录配置

[zyj@hadoop101 .ssh]$ ssh-keygen -t rsa
[zyj@hadoop101 .ssh]$ ssh-copy-id hadoop101
[zyj@hadoop101 .ssh]$ ssh-copy-id hadoop102
[zyj@hadoop101 .ssh]$ ssh-copy-id hadoop103

三、配置集群

1.核心配置文件

[atguigu@hadoop102 ~]$ cd $HADOOP_HOME/etc/hadoop
[atguigu@hadoop102 hadoop]$ vim core-site.xml

<?xml version="1.0" encoding="UTF-8"?>
<?xml-stylesheet type="text/xsl" href="configuration.xsl"?>

<configuration>
	<!-- 指定NameNode的地址 -->
    <property>
        <name>fs.defaultFS</name>
        <value>hdfs://hadoop102:9820</value>
</property>
<!-- 指定hadoop数据的存储目录 -->
    <property>
        <name>hadoop.tmp.dir</name>
        <value>/opt/module/hadoop-3.1.3/data</value>
</property>

<!-- 配置HDFS网页登录使用的静态用户为atguigu -->
    <property>
        <name>hadoop.http.staticuser.user</name>
        <value>atguigu</value>
</property>

<!-- 配置该atguigu(superUser)允许通过代理访问的主机节点 -->
    <property>
        <name>hadoop.proxyuser.atguigu.hosts</name>
        <value>*</value>
</property>
<!-- 配置该atguigu(superUser)允许通过代理用户所属组 -->
    <property>
        <name>hadoop.proxyuser.atguigu.groups</name>
        <value>*</value>
</property>
<!-- 配置该atguigu(superUser)允许通过代理的用户-->
    <property>
        <name>hadoop.proxyuser.atguigu.groups</name>
        <value>*</value>
</property>

</configuration>

2.HDFS配置文件

[atguigu@hadoop102 hadoop]$ vim hdfs-site.xml

<?xml version="1.0" encoding="UTF-8"?>
<?xml-stylesheet type="text/xsl" href="configuration.xsl"?>

<configuration>
	<!-- nn web端访问地址-->
	<property>
        <name>dfs.namenode.http-address</name>
        <value>hadoop102:9870</value>
    </property>
	<!-- 2nn web端访问地址-->
    <property>
        <name>dfs.namenode.secondary.http-address</name>
        <value>hadoop104:9868</value>
    </property>
</configuration>

3.YARN配置文件

[atguigu@hadoop102 hadoop]$ vim yarn-site.xml

<?xml version="1.0" encoding="UTF-8"?>
<?xml-stylesheet type="text/xsl" href="configuration.xsl"?>

<configuration>
	<!-- 指定MR走shuffle -->
    <property>
        <name>yarn.nodemanager.aux-services</name>
        <value>mapreduce_shuffle</value>
</property>
<!-- 指定ResourceManager的地址-->
    <property>
        <name>yarn.resourcemanager.hostname</name>
        <value>hadoop103</value>
</property>
<!-- 环境变量的继承 -->
    <property>
        <name>yarn.nodemanager.env-whitelist</name>
        <value>JAVA_HOME,HADOOP_COMMON_HOME,HADOOP_HDFS_HOME,HADOOP_CONF_DIR,CLASSPATH_PREPEND_DISTCACHE,HADOOP_YARN_HOME,HADOOP_MAPRED_HOME</value>
</property>
<!-- yarn容器允许分配的最大最小内存 -->
    <property>
        <name>yarn.scheduler.minimum-allocation-mb</name>
        <value>512</value>
    </property>
    <property>
        <name>yarn.scheduler.maximum-allocation-mb</name>
        <value>4096</value>
</property>
<!-- yarn容器允许管理的物理内存大小 -->
    <property>
        <name>yarn.nodemanager.resource.memory-mb</name>
        <value>4096</value>
</property>
<!-- 关闭yarn对物理内存和虚拟内存的限制检查 -->
    <property>
        <name>yarn.nodemanager.pmem-check-enabled</name>
        <value>false</value>
    </property>
    <property>
        <name>yarn.nodemanager.vmem-check-enabled</name>
        <value>false</value>
    </property>
</configuration>

4.MapReduce配置文件

[atguigu@hadoop102 hadoop]$ vim mapred-site.xml

<?xml version="1.0" encoding="UTF-8"?>
<?xml-stylesheet type="text/xsl" href="configuration.xsl"?>

<configuration>
	<!-- 指定MapReduce程序运行在Yarn上 -->
    <property>
        <name>mapreduce.framework.name</name>
        <value>yarn</value>
    </property>
</configuration>

5.配置历史服务器

[atguigu@hadoop102 hadoop]$ vim mapred-site.xml

<!-- 历史服务器端地址 -->
<property>
    <name>mapreduce.jobhistory.address</name>
    <value>hadoop102:10020</value>
</property>

<!-- 历史服务器web端地址 -->
<property>
    <name>mapreduce.jobhistory.webapp.address</name>
    <value>hadoop102:19888</value>
</property>

6.群发配置文件

[atguigu@hadoop102 hadoop]$ my_xsync.sh /opt/module/hadoop-3.1.3/etc/hadoop/

三、群起集群

1.配置workers

[atguigu@hadoop102 hadoop]$ vim /opt/module/hadoop-3.1.3/etc/hadoop/workers

增加内容

hadoop102
hadoop103
hadoop104

群发节点配置文件

[atguigu@hadoop102 hadoop]$ xsync /opt/module/hadoop-3.1.3/etc

2.启动集群

（1）如果是第一次启动，需要在hadoop102节点格式化NameNode（注意格式化NameNode，会产生新的集群id，导致NameNode和DataNode的集群id不一致，集群找不到已往数据。如果集群在运行过程中报错，需要重新格式化NameNode的话，一定要先停止namenode和datanode进程，并且要删除所有机器的data和logs目录，然后再进行格式化。）[atguigu@hadoop102 ~]$ hdfs namenode -format

启动集群 my_hadoop.sh start

1)Web端查看HDFS的NameNode

浏览器中输入：http://hadoop102:9870

2)查看HDFS上存储的数据信息

Web端查看YARN的ResourceManager

浏览器中输入：http://hadoop103:8088

查看YARN上运行的Job信息

四、可能遇到的问题

如果不能使用主机名访问，但可以使用ip地址访问，首先产看主机和虚拟机中的hosts文件中是否如下有配置

192.168.1.101 hadoop101
192.168.1.102 hadoop102
192.168.1.103 hadoop103
192.168.1.104 hadoop104

如果有配置，看是否有使用Clash等软件，如果有关掉就好了，这种是没有对DNS进行解析。

张渝俊

关注

0
点赞
踩
0

收藏

觉得还不错? 一键收藏
0
评论
搭建完全分布式系统+主机名无法访问hadoop web页面

搭建完全分布式系统目录搭建完全分布式系统一、通用脚本编写1.群发分发脚本编写群发脚本常用命令群发脚本编写2.查看三台java服务器进程的脚本3.群起群停脚本二、**SSH无密登录配置**三、配置集群1.核心配置文件2.HDFS配置文件3.YARN配置文件4.MapReduce配置文件5.配置历史服务器6.群发配置文件三、群起集群1.配置workers2.启动集群四、可能遇到的问题一、通用脚本编写1.群发分发脚本编写群发脚本常用命令scp -r $pdir/$fname $user@hado
复制链接

扫一扫