Nodemanager in unhealthy state

最新推荐文章于 2023-02-19 20:00:53 发布

踩大侠

最新推荐文章于 2023-02-19 20:00:53 发布

阅读量1.3k

点赞数

分类专栏： HADOOP 文章标签： yarn

本文链接：https://blog.csdn.net/liu82327114/article/details/56279804

版权

HADOOP 专栏收录该内容

2 篇文章 0 订阅

订阅专栏

Unhealthy Node local-dirs and log-dirs are bad”

ambari的系统里出现这个告警，但是nodemanager也没有挂掉，所有的mapreduce任务都不能进行，处于卡主状态，有的日志还出现这个

2017-02-20 15:45:07,920 ERROR [WALProcedureStoreSyncThread] wal.WALProcedureStore: Unable to close the stream
org.apache.hadoop.ipc.RemoteException(org.apache.hadoop.hdfs.server.namenode.LeaseExpiredException): No lease on /apps/hbase/data/MasterProcWALs/state-00000000000000000058.log (inode 45740): File does not exist. Holder DFSClient_NONMAPREDUCE_-96565186_1 does not have any open files.
at org.apache.hadoop.hdfs.server.namenode.FSNamesystem.checkLease(FSNamesystem.java:3597)
at org.apache.hadoop.hdfs.server.namenode.FSNamesystem.analyzeFileState(FSNamesystem.java:3400)
at org.apache.hadoop.hdfs.server.namenode.FSNamesystem.getAdditionalBlock(FSNamesystem.java:3256)
at org.apache.hadoop.hdfs.server.namenode.NameNodeRpcServer.addBlock(NameNodeRpcServer.java:677)
at org.apache.hadoop.hdfs.server.namenode.AuthorizationProviderProxyClientProtocol.addBlock(AuthorizationProviderProxyClientProtocol.java:213)
at org.apache.hadoop.hdfs.protocolPB.ClientNamenodeProtocolServerSideTranslatorPB.addBlock(ClientNamenodeProtocolServerSideTranslatorPB.java:485)
at org.apache.hadoop.hdfs.protocol.proto.ClientNamenodeProtocolProtos$ClientNamenodeProtocol$2.callBlockingMethod(ClientNamenodeProtocolProtos.java)
at org.apache.hadoop.ipc.ProtobufRpcEngine$Server$ProtoBufRpcInvoker.call(ProtobufRpcEngine.java:617)
at org.apache.hadoop.ipc.RPC$Server.call(RPC.java:1073)
at org.apache.hadoop.ipc.Server$Handler$1.run(Server.java:2086)
at org.apache.hadoop.ipc.Server$Handler$1.run(Server.java:2082)
at java.security.AccessController.doPrivileged(Native Method)
at javax.security.auth.Subject.doAs(Subject.java:415)
at org.apache.hadoop.security.UserGroupInformation.doAs(UserGroupInformation.java:1693)
at org.apache.hadoop.ipc.Server$Handler.run(Server.java:2080)

yarn all application 中显示任务已经accept，但是没有执行，没有分配job url，原因就是磁盘的空间太满了，跟yarn-site.xml中的以下配置有关

<property>
        <name>yarn.nodemanager.disk-health-checker.max-disk-utilization-per-disk-percentage</name>
        <value>98.5</value>
</property>

try adding the property yarn.nodemanager.disk-health-checker.max-disk-utilization-per-disk-percentage to yarn-site.xml. This property specifies the maximum percentage of disk space utilization allowed after which a disk is marked as bad. Values can range from 0.0 to 100.0.

你可以清理磁盘空间，或者你可以暂时的吧这个使用率调大，但是这不是解决问题的根本，最好是清理磁盘空间或扩展

踩大侠

关注

0
点赞
踩
0

收藏

觉得还不错? 一键收藏
0
评论
Nodemanager in unhealthy state

Unhealthy Node local-dirs and log-dirs are bad”ambari的系统里出现这个告警，但是nodemanager也没有挂掉，所有的mapreduce任务都不能进行，处于卡主状态，有的日志还出现这个2017-02-20 15:45:07,920 ERROR [WALProcedureStoreSyncThread] wal.WALProced
复制链接

扫一扫

专栏目录