mapreduce 和hive 的区别

MapReduce和Hive在大数据处理中各有优劣。Hive是对Hadoop MapReduce的封装,适合处理结构化数据,但无法应对所有场景,复杂的日志处理通常需要先用MapReduce。业务复杂时,MapReduce的灵活性更胜一筹。相比之下,Hive的开发和维护成本较低,采用SQL语法,便于数据管理和逻辑修改,但在调试和性能要求高的任务中不如MapReduce。
摘要由CSDN通过智能技术生成

mapreduce 和hive 的区别

首先:
1.hive本身只是在hadoop map reduce 或者spark 计算引擎上的封装,应用场景自然更局限,不可能满足所有需求。有些场景是不能用hive来实现,就需要map reduce或者spark rdd编程来实现。
2.结构复杂的日志文件,首先要经过ETL处理(使用mapreduce)得到的数据再有hive处理比较合适。直接让hive处理结构复杂的数据估计很难处理。

小结:业务比较复杂的,还是必须写mapreduce才能实现。
二 背景介绍
随着工作的数据内容越来越多,越来越复杂,对应的调整也越来越多,越来越复杂.纯使用MR方式整个流程就比较复杂,如果需要修改某个部分,那首先需要修改代码中的逻辑,然后把代码打包上传到某个可访问路径上(一般就是hdfs),然后在调度平台内执行.如果改动较大的情况,可能还会需要在测试环境中多次调试. 总之就是会花比较多的时间在非业务逻辑改动的工作上.
考虑到维护的成本的增大,慢慢的开始准备将MR的作业,逐渐的移植到一些脚本平台上去,hive成了我们的首选。

mr和hive比较
1. 运算资源消耗
无论从时间,数据量,计算量上来看,一般情况下mr都是优于或者等于hive的。mr的灵活性是毋庸置疑的。在转换到hive的过程中,会有一些为了实现某些场景的需求而不得不用多步hive来实现的时候。

  • 2
    点赞
  • 8
    收藏
    觉得还不错? 一键收藏
  • 0
    评论
评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值