大数据离线---Hive的表操作介绍

本文介绍了Hive的表操作,包括托管表和外部表的区别。托管表的数据会被移动到Hive仓库,删除时连同数据一起消失;而外部表仅管理元数据,数据保持在原位置。此外,文章还讲解了分区和桶的概念,分区通过partitioned by关键字实现,提高查询速度;桶通过clustered by创建,用于提升查询效率和开发阶段的取样测试。
摘要由CSDN通过智能技术生成

这次我们主要针对hive的操作表做简单的介绍:

  • 托管表和外部表
  • 分区和桶

这2个部分做简介


Hive表格逻辑上有存储的数据和描述表格中数据形式的相关元数据组成。数据一般存储在HDFS上,也可以存放在本地文件系统中。元数据存放在关系数据库中。

1. 托管表和外部表

托管表
  • hive会把数据移动到它的仓库,这里使用的是load的命令,把文件系统的数据移动到hive的仓库目录,如果数据和表的结构不匹配,这里是不会异常,在查询的时候会出现null空值
  //加载hdfs的数据,数据会移动到hive的表目录下
  create table managed_table(dummy string);
  load data inpath '/usr/tom/data.txt' into table manage_table;
  //加载本地的数据,增加了local的关键字,数据不会移动
   create table managed_table(dummy string);
  load data local inpath '/usr/tom/data.txt' into table manage_table;
  • 删除表 drop
    drop table manage_table ;
    会将表的元数据和表的数据一起删除,会导致数据彻底丢失。而load是移动操作,而drop是删除,所以这里是托管表.
外部表
  create external table external_table(dummy 
  • 0
    点赞
  • 0
    收藏
    觉得还不错? 一键收藏
  • 0
    评论
评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值