Hive视频教程|hive企业级架构课程

Hive企业级架构课程
百度网盘下载:链接: http://pan.baidu.com/s/1eQErqAu 密码:6alg


课程大纲


第一章:架构方面优化策略(5讲)
Hadoop的主要性能瓶颈是IO负载,降IO负载是优化的重头戏。
本章大纲:
作业架构优化手段大探底
多个降IO负载的策略和场景                          
分表、源表归纳                               
合理设计表分区、动态分区                                
压缩、分布式缓存          
                     
第二章:Hive Sql语法层面和Properties参数层面优化(4讲)
语法优化手段归纳
Map数和Reduce数的决定和控制及案例分析                              
数据倾斜的避免和解决办法                             
执行计划剖析,从执行计划上找倾斜根本                             
Properties参数                             
高效Join、MapJoin、SEMI JOIN                             
减少Job 合并MR                             
Mapreduce中间参数                            


第三章:Impala熟悉和使用(1讲)                             
Impala是Cloudera 公司推出仿Hive的一个产品,目前已经有稳定的发行版本。             
理论上性能比Hive好,但目前版本功能和扩展性上远不能替代Hive。
未来该产品或会有一定影响力。                              
特点:同Hive一样是类sql产品                             
公用Hive的元数据库                             
                              
第一讲:Hive体系结构及Hive作业形式
第二讲:Hive优化策略大探底及架构优化案例一
第三讲:架构优化案例二之降IO负载策略I
第四讲:架构优化案例二之降IO负载策略II
第五讲:架构优化案例二之降IO负载策略III—压缩和分布式缓存
第六讲:Hive语法、参数层面优化一
第七讲:Hive语法、参数层面优化二
第八讲:Hive语法、参数层面优化三                                       
第九讲:Hive语法、参数层面优化四
第十讲:10.Impala熟悉和使用    
 
 
2、课程环境:
   Cloudera Hadoop 4 (Hadoop 2.0)
   Hive-0.90
 
 
3、所需技术基础:
  Hadoop基础、Hive基础、Linux基础,其他不限制(不分Java和.Net方向,皆适合)。
  • 0
    点赞
  • 0
    收藏
    觉得还不错? 一键收藏
  • 3
    评论

“相关推荐”对你有帮助么?

  • 非常没帮助
  • 没帮助
  • 一般
  • 有帮助
  • 非常有帮助
提交
评论 3
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值