优酷面试题

转载 2015年07月06日 17:33:31

 mapred找共同朋友,数据格式如下
A B C D E F
B A C D E
C A B E
D A B E
E A B C D
F A


第一字母表示本人,其他是他的朋友,找出有共同朋友的人,和共同朋友是谁


 运行结果
AB      E:C:D
AC      E:B
AD      B:E
AE      C:B:D
BC      A:E
BD      A:E
BE      C:D:A
BF      A
CD      E:A:B
CE      A:B
CF      A
DE      B:A
DF      A
EF      A

 


思路:对于每一行,两两进行组合作为一个新key,把每一行的第一个人作为value,map输出<key,value>。


reduce函数进行聚合合并相同的key(即在map阶段的两两组合的新key),具有相同key的   "每行第一个人列表"  就是key的共同朋友。



代码:

package 优酷面试题;


import java.io.IOException;
import java.util.Set;
import java.util.StringTokenizer;
import java.util.TreeSet;


import org.apache.hadoop.conf.Configuration;
import org.apache.hadoop.fs.Path;
import org.apache.hadoop.io.Text;
import org.apache.hadoop.mapreduce.Job;
import org.apache.hadoop.mapreduce.Mapper;
import org.apache.hadoop.mapreduce.Reducer;
import org.apache.hadoop.mapreduce.lib.input.FileInputFormat;
import org.apache.hadoop.mapreduce.lib.output.FileOutputFormat;
import org.apache.hadoop.util.GenericOptionsParser;


public class FindFriend {
        
          public static class ChangeMapper extends Mapper<Object, Text, Text, Text>{                      
                   @Override
                   public void map(Object key, Text value, Context context) throws IOException, InterruptedException {
                             StringTokenizer itr = new StringTokenizer(value.toString());
                                 Text owner = new Text();
                                 Set<String> set = new TreeSet<String>();
                             owner.set(itr.nextToken());
                             while (itr.hasMoreTokens()) {
                                     set.add(itr.nextToken());
                             }             
                             String[] friends = new String[set.size()];
                             friends = set.toArray(friends);
                             
                             for(int i=0;i<friends.length;i++){
                                     for(int j=i+1;j<friends.length;j++){
                                             String outputkey = friends[i]+friends[j];
                                             context.write(new Text(outputkey),owner);
                                     }                                     
                             }
                   }
          }
          /*
           	这是 StringTokenizer 类下的一个方法。你首先要知道 StringTokenizer 是干什么用的。
			StringTokenizer 用来分割字符串,你可以指定分隔符,比如',',或者空格之类的字符。nextToken() 用于返回下一个匹配的字段。
			-----------------------
				给你一个Demo:
				import java.util.StringTokenizer;
				public class Demo {
        			public static void main (String args[]) {
                			String str = "Hello, world";
                			StringTokenizer st = new StringTokenizer(str, ",");    // 用逗号分隔
             			while (st.hasMoreTokens())    // 判断是否已经到结尾
                 			System.out.println(st.nextToken());    // 打印下一个字段
     				}
				}
				----------------------
				结果:
				Hello
				world
           */
          public static class FindReducer extends Reducer<Text,Text,Text,Text> {                          
                        public void reduce(Text key, Iterable<Text> values, 
                                        Context context) throws IOException, InterruptedException {
                                  String  commonfriends =""; 
                              for (Text val : values) {
                                  if(commonfriends == ""){
                                          commonfriends = val.toString();
                                  }else{
                                          commonfriends = commonfriends+":"+val.toString();
                                  }
                               }
                              context.write(key, new Text(commonfriends));                                
                        }                          
          }
          


        @SuppressWarnings("deprecation")
		public static void main(String[] args) throws IOException,InterruptedException, ClassNotFoundException {
                
            Configuration conf = new Configuration();
            String[] otherArgs = new GenericOptionsParser(conf, args).getRemainingArgs();
            /*
             	比如运行命令为:bin/hadoop dfs -fs master:8020 -ls /data
				GenericOptionsParser把  -fs master:8020配置到配置conf中
				而getRemainingArgs()方法则得到剩余的参数,就是 -ls /data。供下面使用输入输出参数
             */
            if (otherArgs.length < 2) {
              System.err.println("args error");
              System.exit(2);
            }
            Job job = new Job(conf, "word count");
            job.setJarByClass(FindFriend.class);
            job.setMapperClass(ChangeMapper.class);
            job.setCombinerClass(FindReducer.class);
            job.setReducerClass(FindReducer.class);
            job.setOutputKeyClass(Text.class);
            job.setOutputValueClass(Text.class);
            for (int i = 0; i < otherArgs.length - 1; ++i) {
              FileInputFormat.addInputPath(job, new Path(otherArgs[i]));
            }
            FileOutputFormat.setOutputPath(job,new Path(otherArgs[otherArgs.length - 1]));
            System.exit(job.waitForCompletion(true) ? 0 : 1);
                
        }
    /*
  	GenericOptionsParser 命令行解析器
	是hadoop框架中解析命令行参数的基本类。它能够辨别一些标准的命令行参数,能够使应用程序轻易地指定namenode,jobtracker,以及其他额外的配置资源
    */
}



优酷hadoop mapred 面试题[find friends]

package com.sanmao.hadoop_02.mianshi;import com.sanmao.hadoop_02.mr.WordCountTest; import org.apache...

京东/优酷IOS面试题

京东,优酷的IOS开发面试题,配有答案。

将一个升序排列的单链表和一个降序排列的单链表合并成一个升序排列的单链表(优酷土豆2014校园招聘笔试题)

思路:首先可以将降序排列的单链表反转,这样两个链表均为升序,再将两个升序排列的单链表合并成一个升序排列的单链表。于是这里我们需要解决两个问题: Q1:如何将一个单链表反转? A1:以一般情况为例,下图...

优酷土豆北京站笔试题 2012.9.12 北邮

2. 广告系统为了做地理位置定向,将IPv4分割成627,672个区间,并标识了地理位置信息, 区间之间无重叠,用二分查找将IP地址映射到地理位置住处请问在最坏的情况下,需要查找多少步?     A...

(优酷2014年笔试题 )数组重新组合求最小值

题目:含有n个元素的整型数组,将这个n个元素重新组合,求出最小的数,如{321,3,32},最小的数为   321323 之前想了一些办法 最后还是用了字符串  复杂度为 o(n²);太累 不想解释 ...

【优酷土豆2012.9.12校园招聘笔试题】分析

完整题目参考:http://blog.csdn.net/hackbuteer1/article/details/8017749

优酷 Java笔试题(摘要)

优酷土豆package com.java;class HelloA { public HelloA() { System.out.println("HelloA"); ...

关于ThreadLocal的一道面试题(酷我公司)

http://blog.csdn.net/jiangwei0910410003/article/details/20448895#comments 2013年8月,本人那时候刚毕业来到了北京找工作...

关于ThreadLocal的一道面试题(酷我公司)

2013年8月,本人那时候刚毕业来到了北京找工作,在网上投递了各种简历,也面试了很多家公司,遇到最大的问题就是:你什么时候毕业的呀?,做过什么项目呀?都将我拒之门外,但是我还是幸运总会来的,那天早上9...

传智播客DotNet面试题 (原文转载酷小孩博客)

技术类面试、笔试题汇总(整理者:杨中科,部分内容从互联网中整理而来) 注:标明*的问题属于选择性掌握的内容,能掌握更好,没掌握也没关系。 下面的参考解答只是帮助大家理解,不用背,面试题、笔试题...
  • ghevinn
  • ghevinn
  • 2012年08月20日 14:06
  • 4257
内容举报
返回顶部
收藏助手
不良信息举报
您举报文章:优酷面试题
举报原因:
原因补充:

(最多只允许输入30个字)