Spark Serializable与KryoRegistrator比较

一、示例代码

        List<HashMap<String, Object>> mapList = buildMapArray();

        List<Tuple2<String, Iterable<HashMap<String, Object>>>> collect = javaSparkContext.parallelize(mapList).mapToPair(new PairFunction<HashMap<String, Object>, String, HashMap<String, Object>>() {
            @Override
            public Tuple2<String, HashMap<String, Object>> call(HashMap<String, Object> student) throws Exception {
                return new Tuple2<String, HashMap<String, Object>>("x", student);
            }
            //会产生shuffle
        }).groupByKey().collect();

        LOG.info("collect : " + collect);

二、执行结果:看read和write,这是Serializable的结果

101318_lgla_1476358.png

三、使用KryoRegistrator需要注意事项

   public void registerClasses(Kryo kryo) {
        //kryo.register(SparkSerilizeTest.Student.class);
        //kryo.register(SparkSerilizeTest.class);
        kryo.register(java.util.HashMap.class);
        //kryo.register(java.util.List.class);
    }

sparkConf.set("spark.serializer", "org.apache.spark.serializer.KryoSerializer");
sparkConf.set("spark.kryo.registrator", "com.sdyc.ndmp.wechat.job.MyRegistrator");

四、执行结果:看read和write,这是KryoRegistrator结果

101919_JCfZ_1476358.png

所以,序列化这块能提高不少效率


转载于:https://my.oschina.net/momisabuilder/blog/646420

评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值