初识Hive:3张图了解Hive的数据类型、架构图!

Hive是一个基于Hadoop的数据仓库工具,它允许通过SQL-like查询语言HiveQL来处理大规模数据集。Hive将元数据存储在metastore中,可以将SQL查询转换为MapReduce任务执行。其优点包括低学习成本和便于数据仓库统计分析。安装Hive后,可以启动Hive shell进行交互。Hive支持多种数据类型,并提供了与SQL的对比,还可以以服务器模式运行,供应用程序通过不同机制连接。
摘要由CSDN通过智能技术生成

Hive是一个构建在Hadoop上的数据仓库框架,可以将结构化的数据文件,映射为一张数据库表,并提供完整的sql查询功能。可以将sql语句,转换为MapReduce任务进行运行。

Hive选择Hadoop来存储和处理数据,因为Hadoop有较好的性价比。Hive设计的目标是让精通SQL技能(Java较弱的)分析师,能够从存放在HDFS的大规模数据集上,运行查询。

Hive 一般在工作站上运行,将SQL查询转换为一系列MapReducejob,在Hadoopcluster上运行。

表模式等元数据存放在名为metastore的数据库中。默认的metastore在本地运行。此时创建的Hive表在本地上,无法与其它用户共享。

Hive优点

Hive学习成本低,可以通过类SQL语句快速实现简单的MapReduce统计,不必开发专门的MapReduce应用,十分适合数据仓库的统计分析。

安装和启动Hive

解压缩:

$ tar xvzfhive-1.X.X-dev.tar.gz

配置路径:

export HIVE_INSTALL=/home/hadoop-2.X/hive

export PATH=$PATH:$HIVE_INSTALL/bin

启动Hive shell:

$ hive

hive>

Hive数据类型

  • 0
    点赞
  • 0
    收藏
    觉得还不错? 一键收藏
  • 0
    评论
评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值