初步学习MapReduce编程——词频统计

词频统计就是获取HDFS上的input文件夹下的所有的文本文件,通过MapReduce编程,将里面的所有单词进行统计出个数。

1、文件准备

开启hadoop
在这里插入图片描述
清空HDFS上的input和output文件夹
在这里插入图片描述
创建需要统计的文本
在这里插入图片描述
新建input文件夹,并把文本上传
在这里插入图片描述

2、打包Java文件

运行代码,没有错误就可以开始打包
在这里插入图片描述

选择对应的java文件右键导出,Runnable JAR file选择下一步
在这里插入图片描述
这里注意一定要选到对应的java文件,finish后面弹出的窗口一直OK确认下去。
在这里插入图片描述

3、在shell命令行运行代码

在/usr/local/hadoop路径下运行shell命令:./bin/hadoop jar ./myapp/WordCount.jar input output
出现这些说明运行成功了
在这里插入图片描述
查看output下所有文件即可得到结果
在这里插入图片描述

import java.io.IOException;
import java.util.Iterator;
import java.util.StringTokenizer;
import org.apache.hadoop.conf.Configuration;
import org.apache.hadoop.fs.Path;
import org.apache.hadoop.io.IntWritable;
import org.apache.hadoop.io.Text;
import org.apache.hadoop.mapreduce.Job;
import org.apache.hadoop.mapreduce.Mapper;
import org.apache.hadoop.mapreduce.Reducer;
import org.apache.hadoop.mapreduce.l
  • 0
    点赞
  • 15
    收藏
    觉得还不错? 一键收藏
  • 0
    评论

“相关推荐”对你有帮助么?

  • 非常没帮助
  • 没帮助
  • 一般
  • 有帮助
  • 非常有帮助
提交
评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值