初步学习MapReduce编程——编程实现文件合并和去重操作

最新推荐文章于 2024-05-16 15:46:43 发布

不争气大王

最新推荐文章于 2024-05-16 15:46:43 发布

阅读量6.3k

点赞数 5

分类专栏： # MapReduce

本文链接：https://blog.csdn.net/weixin_45990325/article/details/118102669

版权

对于两个输入文件，即文件A和文件B，编写MapReduce程序，对两个文件进行合并，并剔除其中重复的内容，得到一个新的输出文件C。数据放TXT文件时，不能多出数据外的空行光标，不然运行程序时会显示错误：For input string: “”直接运行Java代码得出结果package Merge;import java.io.IOException;import org.apache.hadoop.conf.Configuration;import org.apache.hadoop.fs

摘要由CSDN通过智能技术生成

对于两个输入文件，即文件A和文件B，编写MapReduce程序，对两个文件进行合并，并剔除其中重复的内容，得到一个新的输出文件C。

数据放TXT文件时，不能多出数据外的空行光标，不然运行程序时会显示错误：For input string: “”
在这里插入图片描述

直接运行Java代码得出结果

package Merge;

import java.io.IOException;
import org.apache.hadoop.conf.Configuration;
import org.apache.hadoop.fs.Path;
import org.apache.hadoop.io.IntWritable;
import org.apache.hadoop.io.Text;
import org.apache.hadoop.mapreduce.Job;
import org.apache.hadoop.mapreduce.Mapper;
import org.apache.hadoop.mapreduce.Reducer;
import org.apache.hadoop.mapreduce.lib.input

最低0.47元/天解锁文章

不争气大王

关注

5
点赞
踩
47

收藏

觉得还不错? 一键收藏
4
评论
初步学习MapReduce编程——编程实现文件合并和去重操作

对于两个输入文件，即文件A和文件B，编写MapReduce程序，对两个文件进行合并，并剔除其中重复的内容，得到一个新的输出文件C。数据放TXT文件时，不能多出数据外的空行光标，不然运行程序时会显示错误：For input string: “”直接运行Java代码得出结果package Merge;import java.io.IOException;import org.apache.hadoop.conf.Configuration;import org.apache.hadoop.fs
复制链接

扫一扫

专栏目录