hive 调优

hive 本地模式

根据数据量的大小,可以开启hive的本地模式:hive.exec.mode.local.auto 

该参数的默认值为false。


也可以把该属性配置到hive-site.xml中。

hive并行执行

hive并行执行,hive可以把一个查询转化成一个或者多个阶段,这些阶段并不是完全相互依赖的,也就是说有些阶段是可以并行执行的,这样就可以使整个job的执行时间变短。通过设置参数 mapred.exec.parallel 参数的值为true,就可以开启job的并行执行。


hive严格模式

如果要防止用户执行那些可能产生意想不到的查询的行为,可以设置参数 hive.mapred.mode 为strict。通过设置 set hive.mapred.mode=strict。可以禁止用户3中行为。

1:对于分区表,除非where子句中有分区字段的查询限制,负责不允许执行。

2:对于order by 语句必须增加limit限制,防止reduce界面额外执行很长的时间。

3:限制笛卡尔积的查询,join 语句中必须有on条件限制,负责不允许执行。

调整mapper,reducer个数

hive把查询划分成一个或者多个mapreduce任务达到并行的目的。确定合适的mapper,reducer个数,需要参考数据的数据量大小,以及执行的操作。

hive.exec.reducers.bytes.per.reducer 这个参数也可以控制reduce 的个数。

mapred.reduce.tasks 可是吧reduce个数设置为一个固定的值

hive.exec.reducers.max 可以这是job最大允许的task的个数。

多个group by 组装到多个mapredec任务中 通过这是 hive.mulitgroupby.singlemr 参数为true。(如果这些group by 中使用相同的key,这个优化将会生效)

虚拟列

一种用户将要划分的输入的文件名,另外一种用于文件内的块的偏移量。当hive产生非预期,或者null的结果时,可以通过虚拟列诊断查询。通过查询这写列,可以定位到那个文件,那行数据。




  • 0
    点赞
  • 1
    收藏
    觉得还不错? 一键收藏
  • 0
    评论
4S店客户管理小程序-毕业设计,基于微信小程序+SSM+MySql开发,源码+数据库+论文答辩+毕业论文+视频演示 社会的发展和科学技术的进步,互联网技术越来越受欢迎。手机也逐渐受到广大人民群众的喜爱,也逐渐进入了每个用户的使用。手机具有便利性,速度快,效率高,成本低等优点。 因此,构建符合自己要求的操作系统是非常有意义的。 本文从管理员、用户的功能要求出发,4S店客户管理系统中的功能模块主要是实现管理员服务端;首页、个人中心、用户管理、门店管理、车展管理、汽车品牌管理、新闻头条管理、预约试驾管理、我的收藏管理、系统管理,用户客户端:首页、车展、新闻头条、我的。门店客户端:首页、车展、新闻头条、我的经过认真细致的研究,精心准备和规划,最后测试成功,系统可以正常使用。分析功能调整与4S店客户管理系统实现的实际需求相结合,讨论了微信开发者技术与后台结合java语言和MySQL数据库开发4S店客户管理系统的使用。 关键字:4S店客户管理系统小程序 微信开发者 Java技术 MySQL数据库 软件的功能: 1、开发实现4S店客户管理系统的整个系统程序; 2、管理员服务端;首页、个人中心、用户管理、门店管理、车展管理、汽车品牌管理、新闻头条管理、预约试驾管理、我的收藏管理、系统管理等。 3、用户客户端:首页、车展、新闻头条、我的 4、门店客户端:首页、车展、新闻头条、我的等相应操作; 5、基础数据管理:实现系统基本信息的添加、修改及删除等操作,并且根据需求进行交流信息的查看及回复相应操作。
评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值