内部表和外部表区别和详解

 在linux中进行文件上传

1.上传student.csv和techer.csv文件到linux上的/opt/hive上

 

 

2.使用myhive数据库

 

3.创建表并将本地文件上传到表中

创建老师表(外部表):

create external table techer (t_id string,t_name string) row format delimited fields terminated by '\t';

创建老师表(内部表):

create table techer (t_id string,t_name string) row format delimited fields terminated by '\t';

 

 

 

 

 

创建学生表(外部表):

create external table student (s_id string,s_name string,s_birth string , s_sex string ) row format delimited fields terminated by '\t';

创建学生表(内部表):

create table student (s_id string,s_name string,s_birth string , s_sex string ) row format delimited fields terminated by '\t';

4.添加数据

load data local inpath '/opt/hive/student.csv' into table student;(从本地添加)

load data inpath '/opt/hive/student.csv' into table student;(从hdfs中添加)

load data local inpath '/export/servers/hivedatas/student.csv' overwrite  into table student;(从本地添加并进行覆盖)

load data inpath '/export/servers/hivedatas/student.csv' overwrite  into table student;(从hdfs中添加并进行覆盖)

 

5.selec * from  filename;(查看表)

   drop table student;(删除表)

 

(1)将外部表删除后,hdfs中的数据仍然存在,但hive里面表删除,创建表查看时,还会看见原有数据

(2)将内部表删除后,hive里面和hdfs里面数据都会删除

 总结:内部表数据由Hive自身管理,外部表数据由HDFS管理; 
内部表数据存储的位置是hive.metastore.warehouse.dir(默认:/user/hive/warehouse),外部表数据的存储位置由自己制定; 
删除内部表会直接删除元数据(metadata)及存储数据;删除外部表仅仅会删除元数据,HDFS上的文件并不会被删除; 
对内部表的修改会将修改直接同步给元数据,而对外部表的表结构和分区进行修改,则需要修复(MSCK REPAIR TABLE table_name;)
 

 

 

 

 

 

 

 

 

 

  • 4
    点赞
  • 15
    收藏
    觉得还不错? 一键收藏
  • 4
    评论

“相关推荐”对你有帮助么?

  • 非常没帮助
  • 没帮助
  • 一般
  • 有帮助
  • 非常有帮助
提交
评论 4
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值