Hadoop内存大小设置问题

最新推荐文章于 2023-05-21 14:03:48 发布

weixin_44256848

最新推荐文章于 2023-05-21 14:03:48 发布

阅读量2.7k

点赞数

分类专栏：大数据

原文链接：https://blog.csdn.net/xygl2009/article/details/46858671/

版权

大数据专栏收录该内容

36 篇文章 0 订阅

订阅专栏

namenode管理着集群里面所有文件的信息。简单根据文件信息给出一个准确计算内存大小的公式是不现实的。

hadoop默认namenode内存的大小为1000M，这个值对于数百万的文件来说是足够的，可以保守地设置每百万数据块需要1000MB内存。

例如，有这样一个场景，一个含有200个节点的集群，每个节点有一个24TB的磁盘，hadoop的block的大小为128MB，有三份拷贝总共需要块的数目大概在200万或者更多，那么内存大致需要多少？

首先计算可以有多少块：

（20024000000MB)/(128MB3)=12500,000。
（节点数每个节点的磁盘大小）/ (Block大小备份数）

然后保守估计需要多少内存：

12500,000*1000MB（默认内存）/1000,000（百万文件）=12,500MB

从上面的计算结果看出，将namenode内存的大小设置为12,000MB这个数量级别可以满足。

计算大致的值之后，怎么设置呢？

hadoop配置文件，hadoop-env.sh中有个选项HADOOP_NAMENODE_OPTS，此JVM选项是用来设置内存大小的。比如：

export HADOOP_NAMENODE_OPTS=-Xmx2000m
那么就是给namenode分配了2000MB的空间。

如果改变了namenode的内存大小，那么secondarynamenode的内存的大小同样也要改变，其选项是HADOOP_SECONDARYNAMENODE_OPTS。

weixin_44256848

关注

0
点赞
踩
3

收藏

觉得还不错? 一键收藏
0
评论
Hadoop内存大小设置问题

namenode管理着集群里面所有文件的信息。简单根据文件信息给出一个准确计算内存大小的公式是不现实的。hadoop默认namenode内存的大小为1000M，这个值对于数百万的文件来说是足够的，可以保守地设置每百万数据块需要1000MB内存。例如，有这样一个场景，一个含有200个节点的集群，每个节点有一个24TB的磁盘，hadoop的block的大小为128MB，有三份拷贝总共需要块的数目大...
复制链接

扫一扫

专栏目录

评论

被折叠的条评论为什么被折叠?

到【灌水乐园】发言

查看更多评论

添加红包

成就一亿技术人!

hope_wisdom

发出的红包

实付元

使用余额支付

点击重新获取

扫码支付

钱包余额 0

抵扣说明：

1.余额是钱包充值的虚拟货币，按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载，可以购买VIP、付费专栏及课程。