文章标题

Hadoop系列学习-MapReduce的排序与自定义排序

默认排序

由于Hadoop默认是根据key去排序的。


实现效果:
排序前:
1991 06
1991 08
1991 07
1989 01
1979 02
1990 03
2000 04
排序后:
1979 1979 02
1989 1989 01
1990 1990 03
1991 1991 06
1991 1991 08
1991 1991 07
2000 2000 04
是针对第一列的key进行排序。

Map
public static class ComparedDefaultMap extends Mapper<LongWritable, Text, LongWritable, Text>{
        String line;
        @Override
        protected void map(LongWritable key, Text value, Context context) throws IOException, InterruptedException {
            line = value.toString();
            String [] str = line.split(" ");
            if(str.length > 1){
                long l = Long.parseLong(str[0]);
                context.write(new LongWritable(l), value);
            }
        }
    }

Reduce阶段

public static class ComparedDefaultReduce extends Reducer<LongWritable, Text, LongWritable, Text>{
        @Override
        protected void reduce(LongWritable key, Iterable<Text> values, Context context) throws IOException, InterruptedException {
            for (Text value: values){
                context.write(key, value);
            }
        }
    }

根据默认排序的结果
1979 1979 02
1989 1989 01
1990 1990 03
1991 1991 06
1991 1991 08
1991 1991 07
2000 2000 04
但是希望获得的是:

1979 1979 02
1989 1989 01
1990 1990 03
1991 1991 06
1991 1991 07
1991 1991 08
2000 2000 04


所以需要自定义排序

自定义Writable

/**
 * 自定义Writable
 * Created with IntelliJ IDEA.
 * User: Administrator
 * Date: 15-5-20
 * Time: 上午11:17
 * To change this template use File | Settings | File Templates.
 */
public class ComparedKey implements WritableComparable<ComparedKey> {
    long first;
    long second;

    public ComparedKey() {
    }
    public ComparedKey(long first, long second) {
        this.first = first;
        this.second = second;
    }

    @Override
    public int compareTo(ComparedKey o) {
        long min = first - o.first;
        if(min != 0){
            return (int)min;
        }
        return (int)(second-o.second);
    }

    @Override
    public void write(DataOutput out) throws IOException {
        out.writeLong(first);
        out.writeLong(second);
    }

    @Override
    public void readFields(DataInput in) throws IOException {
        first=in.readLong();
        second=in.readLong();
    }
}

Map阶段

public static class ComparedMapper extends Mapper<LongWritable, Text, ComparedKey, Text>{
        String line;
        @Override
        protected void map(LongWritable key, Text value, Mapper<LongWritable, Text, ComparedKey, Text>.Context context) throws IOException, InterruptedException {
            line = value.toString();
            System.out.println(line);
            ComparedKey comparedKey = null;
            String [] str = line.split(" ");
            if(str.length>2){
                long first = Long.parseLong(str[0]);
                long second = Long.parseLong(str[1]);
                System.out.println("SUCCESS");
                comparedKey = new ComparedKey(first, second);
            }
            if(comparedKey != null){
                System.out.println("write SUCCESS");
                context.write(comparedKey, new Text(line));
            }
        }
    }

Reduce阶段

 public static class CompareReducer extends Reducer<ComparedKey, Text, LongWritable, Text>{
        @Override
        protected void reduce(ComparedKey key, Iterable<Text> values, Reducer<ComparedKey, Text, LongWritable, Text>.Context context) throws IOException, InterruptedException {
            for(Text text : values){
                System.out.println();
                context.write(new LongWritable(key.first), text);
            }
        }
    }

执行Job中

 Job job = new Job(configuration, "compared");
        job.setJarByClass(ComparedToTest.class);
        job.setMapperClass(ComparedMapper.class);
        job.setReducerClass(CompareReducer.class);
        job.setMapOutputKeyClass(ComparedKey.class);
        job.setOutputKeyClass(LongWritable.class);
        job.setOutputValueClass(Text.class);

最后结果:

1979 1979 02
1989 1989 01
1990 1990 03
1991 1991 06
1991 1991 07
1991 1991 08
2000 2000 04

  • 0
    点赞
  • 0
    收藏
    觉得还不错? 一键收藏
  • 0
    评论
### 内容概要 《计算机试卷1》是一份综合性的计算机基础和应用测试卷,涵盖了计算机硬件、软件、操作系统、网络、多媒体技术等多个领域的知识点。试卷包括单选题和操作应用两大类,单选题部分测试学生对计算机基础知识的掌握,操作应用部分则评估学生对计算机应用软件的实际操作能力。 ### 适用人群 本试卷适用于: - 计算机专业或信息技术相关专业的学生,用于课程学习或考试复习。 - 准备计算机等级考试或职业资格认证的人士,作为实战演练材料。 - 对计算机操作有兴趣的自学者,用于提升个人计算机应用技能。 - 计算机基础教育工作者,作为教学资源或出题参考。 ### 使用场景及目标 1. **学习评估**:作为学校或教育机构对学生计算机基础知识和应用技能的评估工具。 2. **自学测试**:供个人自学者检验自己对计算机知识的掌握程度和操作熟练度。 3. **职业发展**:帮助职场人士通过实际操作练习,提升计算机应用能力,增强工作竞争力。 4. **教学资源**:教师可以用于课堂教学,作为教学内容的补充或学生的课后练习。 5. **竞赛准备**:适合准备计算机相关竞赛的学生,作为强化训练和技能检测的材料。 试卷的目标是通过系统性的题目设计,帮助学生全面复习和巩固计算机基础知识,同时通过实际操作题目,提高学生解决实际问题的能力。通过本试卷的学习与练习,学生将能够更加深入地理解计算机的工作原理,掌握常用软件的使用方法,为未来的学术或职业生涯打下坚实的基础。

“相关推荐”对你有帮助么?

  • 非常没帮助
  • 没帮助
  • 一般
  • 有帮助
  • 非常有帮助
提交
评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值