Hadoop集群启动后添加和删除节点

标题集群添加节点

  1. 添加新的虚拟主机
    a) 修改主机名 vi /etc/sysconfig/network
    b) 永久关闭防火墙 /etc/init.d/iptables stop chkconfig iptables off
    c) 关闭selinux vi /etc/selinux/config SELINUX=disabled
    d) 主节点到新节点的ssh无密码登录 ssh-copy-id node04
    e) 修改所有节点的 /etc/hosts文件。添加新节点的ip和主机名
    f) Jdk安装
    g) 重启新节点 reboot
  2. 将主机添加到集群
    a) 在hadoop配置文件路径中创建dfs.hosts(白名单:可以和NN通信的所有节点)文件
    b) 在白名单中添加可以通信的所有DataNode
    c)
    c) 在hdfs-site.xml中添加一下配置
<property>
<name>dfs.hosts</name>              
<value>/export/servers/hadoop-2.6.0-cdh5.14.0/etc/hadoop/dfs.hosts</value>
</property>

d) 刷新NameNode和ResourceManager

hdfs dfsadmin –refreshNodes
yarn rmadmin –refreshNodes

在这里插入图片描述
在这里插入图片描述
e) 启动新节点的DataNode 和NodeManager

sbin/hadoop-daemon.sh start datanode
sbin/yarn-daemon.sh start nodemanager

f) 验证
在这里插入图片描述
g) 负载均衡 start-balancer.sh

集群删除节点

  1. 创建dfs.hosts.exclude配置文件,并添加需要退役的主机名称
cd /export/servers/hadoop-2.6.0-cdh5.14.0/etc/hadoop
touch dfs.hosts.exclude
vim dfs.hosts.exclude
  1. 编辑namenode所在机器的hdfs-site.xml
<property>
<name>dfs.hosts.exclude</name>
<value>/export/servers/hadoop-2.6.0-cdh5.14.0/etc/hadoop/dfs.hosts.exclude</value>
</property>
  1. 刷新namenode,刷新resourceManager
hdfs dfsadmin -refreshNodes
yarn rmadmin -refreshNodes

在这里插入图片描述

退役以后
在这里插入图片描述

  1. 节点退役完成,停止该节点进程
cd /export/servers/hadoop-2.6.0-cdh5.14.0
sbin/hadoop-daemon.sh stop datanode
sbin/yarn-daemon.sh stop nodemanager
  1. 在白名单中删掉退役的节点
    vim dfs.hosts 删除node04
  2. 在slaves文件中删除掉node04
  3. 负载均衡 start-balancer.sh
  • 1
    点赞
  • 3
    收藏
    觉得还不错? 一键收藏
  • 1
    评论
Hadoop集群重新格式化是指对Hadoop分布式文件系统(HDFS)进行重新格式化,以清除现有的数据和元数据,并使其恢复到初始状态。重新格式化Hadoop集群通常是在以下情况下进行: 1. 集群新建或重建:当使用新的硬件或重新安装操作系统时,需要重新格式化Hadoop集群。这样可以确保集群中的所有节点都处于相同的状态,并准备好将来存储和处理数据。 2. 故障恢复:当集群发生故障,导致数据无法访问或元数据损坏时,可以通过重新格式化集群来恢复数据的可用性。这样可以清除任何损坏的数据块或元数据,以便后续的数据复制和恢复操作。 3. 节点扩展:当需要扩展现有Hadoop集群的容量或性能时,可以通过向集群中添加节点并重新格式化它们来实现。这样可以确保新节点被正确地集成到现有集群中,并且具有正确的配置和数据副本。 在重新格式化Hadoop集群之前,需要先停止Hadoop服务,以便确保不会有任何写操作在重新格式化过程中发生。然后,可以使用以下命令重新格式化Hadoop集群: hdfs namenode -format 此命令将删除HDFS中的所有数据和元数据,并生成一个新的namespaceID。重新格式化完成后,可以启动Hadoop服务,并开始使用集群存储和处理数据。 重新格式化Hadoop集群是一个非常谨慎的操作,因为它会删除所有的数据和元数据。因此,在执行此操作之前,必须先备份重要的数据,并确保所有相关的配置文件和参数都正确设置。

“相关推荐”对你有帮助么?

  • 非常没帮助
  • 没帮助
  • 一般
  • 有帮助
  • 非常有帮助
提交
评论 1
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值