未被external修饰的是内部表(managed table),被external修饰的为外部表(external table)。
区别
1. 内部表数据由Hive自身管理,外部表数据由HDFS管理;
2.内部表数据存储的位置是hive.metastore.warehouse.dir(默认:/user/hive/warehouse),外部表数据的存储位置由自己制定(如果没有LOCATION,Hive将在HDFS的/user/hive/warehouse文件夹下以外部表的表名创建一个文件夹,并将属于这个表的数据存放在这里)。
3.删除内部表会直接删除元数据(metadata)及存储数据;删除外部表仅仅会删除元数据,HDFS上的文件并不会被删除。
4.对内部表的修改会将修改直接同步给元数据,而对外部表的表结构和分区进行修改,则需要修复(MSCK REPAIR TABLE table_name;)。
创建内部表
CREATE TABLE IF NOT EXISTS b2(
id int,
name string,
age int
)
ROW FORMAT DELIMITED
FIELDS TERMINATED BY ',';
hive> describe formatted b2;
OK
# col_name data_type comment
id int