Hadoop入门 day2

最新推荐文章于 2024-07-03 10:14:40 发布

2401_84181058

最新推荐文章于 2024-07-03 10:14:40 发布

阅读量276

点赞数 4

分类专栏：程序员文章标签： hadoop 大数据分布式

本文链接：https://blog.csdn.net/2401_84181058/article/details/138261220

版权

程序员专栏收录该内容

171 篇文章 1 订阅

订阅专栏

fs.trash.interval 1440


配置hdfs-site.xml（记得要放在两个configuration中间）

dfs.namenode.secondary.http-address node2:9868 ```

配置mapred-site.xml（记得要放在两个configuration中间）

<!-- 设置MR程序默认运行模式： yarn集群模式 local本地模式 -->
<property>
<name>mapreduce.framework.name</name>
<value>yarn</value>
</property>

<!-- MR程序历史服务器端地址 -->
<property>
<name>mapreduce.jobhistory.address</name>
<value>hadoop130:10020</value>
</property>

<!-- 历史服务器web端地址 -->
<property>
<name>mapreduce.jobhistory.webapp.address</name>
<value>hadoop130:19888</value>
</property>

<property>
<name>yarn.app.mapreduce.am.env</name>
<value>HADOOP_MAPRED_HOME=${HADOOP_HOME}</value>
</property>

<property>
<name>mapreduce.map.env</name>
<value>HADOOP_MAPRED_HOME=${HADOOP_HOME}</value>
</property>

<property>
<name>mapreduce.reduce.env</name>
<value>HADOOP_MAPRED_HOME=${HADOOP_HOME}</value>
</property>

配置yarn-site.xml

<!-- 设置YARN集群主角色运行机器位置 -->
<property>
<name>yarn.resourcemanager.hostname</name>
<value>node1</value>
</property>

<property>
<name>yarn.nodemanager.aux-services</name>
<value>mapreduce_shuffle</value>
</property>

<!-- 是否将对容器实施物理内存限制 -->
<property>
<name>yarn.nodemanager.pmem-check-enabled</name>
<value>false</value>
</property>

<!-- 是否将对容器实施虚拟内存限制。 -->
<property>
<name>yarn.nodemanager.vmem-check-enabled</name>
<value>false</value>
</property>

<!-- 开启日志聚集 -->
<property>
<name>yarn.log-aggregation-enable</name>
<value>true</value>
</property>

<!-- 设置yarn历史服务器地址 -->
<property>
<name>yarn.log.server.url</name>
<value>http://node1:19888/jobhistory/logs</value>
</property>

<!-- 保存的时间7天 -->
<property>
<name>yarn.log-aggregation.retain-seconds</name>
<value>604800</value>
</property>

配置workers

//输入各主机地址

192.168.10.130
192.168.10.131
192.168.10.132

复制hadoop文件给另外两台文件到该路径下

scp -r hadoop-3.1.3 root@hadoop131:$PWD
scp -r hadoop-3.1.3 root@hadoop132:$PWD

3.初始化hadoop

初始化

hdfs namenode -format

format只能进行一次，只对hadoop130初始化即可，如果多次format除了造成数据丢失外，还会导致 hdfs集群主从角色之间互不识别。通过删除所有机器hadoop.tmp.dir目录重新format解决。

4.集群启停

在hadoop130上，使用软件自带的shell脚本一键启动。

前提：配置好机器之间的SSH免密登录和workers文件。

HDFS集群：start-dfs.sh

stop-dfs.sh

YARN集群：start-yarn.sh

stop-yarn.sh

Hadoop集群：start-all.sh

stop-all.sh

单个关闭：hdfs --daemon stop/start datanode

yarn --daemon stop/start nodemanager

既有适合小白学习的零基础资料，也有适合3年以上经验的小伙伴深入学习提升的进阶课程，涵盖了95%以上大数据知识点，真正体系化！

由于文件比较多，这里只是将部分目录截图出来，全套包含大厂面经、学习笔记、源码讲义、实战项目、大纲路线、讲解视频，并且后续会持续更新

需要这份系统化资料的朋友，可以戳这里获取

经验的小伙伴深入学习提升的进阶课程，涵盖了95%以上大数据知识点，真正体系化！**

由于文件比较多，这里只是将部分目录截图出来，全套包含大厂面经、学习笔记、源码讲义、实战项目、大纲路线、讲解视频，并且后续会持续更新

需要这份系统化资料的朋友，可以戳这里获取

2401_84181058

关注

4
点赞
踩
3

收藏

觉得还不错? 一键收藏
0
评论
Hadoop入门 day2

1440设置SNN进程运行机器位置信息node2:9868```配置mapred-site.xml（记得要放在两个configuration中间）配置yarn-site.xml配置workers复制hadoop文件给另外两台文件到该路径下。
复制链接

扫一扫