hive操作

本文档详细介绍了在Linux环境下,使用Hive2.3.6与Hadoop2.7.3进行大数据操作的过程,包括源数据准备、员工与部门表的创建、数据导入、分区表与桶表的建立,以及查询与报表制作,特别是如何根据部门号创建分区和根据职位进行数据分桶。
摘要由CSDN通过智能技术生成

前提条件:

安装好hadoop2.7.3(Linux系统下),参考:Ubuntu下安装Hadoop

安装好hive2.3.6(Linux系统下),参考:安装Hive

准备源数据:

  1. 打开终端,新建emp.csv文件
vim emp.csv

输入内容如下,保存退出。

7369,SMITH,CLERK,7902,1980/12/17,800,,20
7499,ALLEN,SALESMAN,7698,1981/2/20,1600,300,30
7521,WARD,SALESMAN,7698,1981/2/22,1250,500,30
7566,JONES,MANAGER,7839,1981/4/2,2975,,20
7654,MARTIN,SALESMAN,7698,1981/9/28,1250,1400,30
7698,BLAKE,MANAGER,7839,1981/5/1,2850,,30
7782,CLARK,MANAGER,7839,1981/6/9,2450,,
评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值