hadoop tyarn冲突_YARN环境中应用程序JAR包冲突问题的分析及解决

最新推荐文章于 2021-04-22 00:43:54 发布

weixin_39664746

最新推荐文章于 2021-04-22 00:43:54 发布

阅读量212

点赞数

文章标签： hadoop tyarn冲突

本文链接：https://blog.csdn.net/weixin_39664746/article/details/113005839

版权

本文详细分析了Hadoop on YARN环境下MapReduce应用程序因JAR包冲突导致的问题，通过实例展示了如何解决这类冲突。通过解析YARN运行应用程序的过程，以及深入源码，提出通过修改YARN_APPLICATION_CLASSPATH并使用-libjars参数来确保正确加载自定义版本的JAR包，从而避免版本不匹配导致的错误。

摘要由CSDN通过智能技术生成

Hadoop框架自身集成了很多第三方的JAR包库。Hadoop框架自身启动或者在运行用户的MapReduce等应用程序时，会优先查找Hadoop预置的JAR包。这样的话，当用户的应用程序使用的第三方库已经存在于Hadoop框架的预置目录，但是两者的版本不同时，Hadoop会优先为应用程序加载Hadoop自身预置的JAR包，这种情况的结果是往往会导致应用程序无法正常运行。

下面从我们在实践中遇到的一个实际问题出发，剖析Hadoop on YARN 环境下，MapReduce程序运行时JAR包查找的相关原理，并给出解决JAR包冲突的思路和方法。

一、一个JAR包冲突的实例

我的一个MR程序需要使用jackson库1.9.13版本的新接口：

图1：MR的pom.xml，依赖jackson的1.9.13

但是我的Hadoop集群(CDH版本的hadoop-2.3.0-cdh5.1.0)预置的jackson版本是1.8.8的，位于Hadoop安装目录下的share/hadoop/mapreduce2/lib/下。

使用如下命令运行我的MR程序时：

hadoop jar mypackage-0.0.1-jar-with-dependencies.jar com.umeng.dp.MainClass --input=../input.pb.lzo --output=/tmp/cuiyang/output/

由于MR程序中使用的JsonNode.asText()方法，是1.9.13版本新加入的，在1.8.8版本中没有，所以报错如下：

…

15/11/13 18:14:33 INFO mapreduce.Job: map 0% reduce 0%

15/11/13 18:14:40 INFO mapreduce.Job: Task Id : attempt_1444449356029_0022_m_000000_0, Status : FAILED

Error: org.codehaus.jackson.JsonNode.asText()Ljava/lang/String;

…

二、搞清YARN框架执行应用程序的过程

在继续分析如何解决JAR包冲突问题前，我们需要先搞明白一个很重要的问题，就是用户的MR程序是如何在NodeManager上运行起来的？这是我们找出JAR包冲突问题的解决方法的关键。

本篇文章不是一篇介绍YARN框架的文章࿰

最低0.47元/天解锁文章

weixin_39664746

关注

0
点赞
踩
1

收藏

觉得还不错? 一键收藏
0
评论
hadoop tyarn冲突_YARN环境中应用程序JAR包冲突问题的分析及解决

Hadoop框架自身集成了很多第三方的JAR包库。Hadoop框架自身启动或者在运行用户的MapReduce等应用程序时，会优先查找Hadoop预置的JAR包。这样的话，当用户的应用程序使用的第三方库已经存在于Hadoop框架的预置目录，但是两者的版本不同时，Hadoop会优先为应用程序加载Hadoop自身预置的JAR包，这种情况的结果是往往会导致应用程序无法正常运行。下面从我们在实践中遇到的一个...
复制链接

扫一扫