初识Hive：3张图了解Hive的数据类型、架构图！

最新推荐文章于 2023-08-06 02:19:08 发布

qingdsj

最新推荐文章于 2023-08-06 02:19:08 发布

阅读量289

点赞数

分类专栏：大数据人工智能互联网文章标签：大数据 hive 大数据开发大数据分析大数据入门

版权声明：本文为博主原创文章，遵循 CC 4.0 BY-SA 版权协议，转载请附上原文出处链接和本声明。

本文链接：https://blog.csdn.net/qingdsj/article/details/103905442

版权

Hive是一个基于Hadoop的数据仓库工具，它允许通过SQL-like查询语言HiveQL来处理大规模数据集。Hive将元数据存储在metastore中，可以将SQL查询转换为MapReduce任务执行。其优点包括低学习成本和便于数据仓库统计分析。安装Hive后，可以启动Hive shell进行交互。Hive支持多种数据类型，并提供了与SQL的对比，还可以以服务器模式运行，供应用程序通过不同机制连接。

摘要由CSDN通过智能技术生成

Hive是一个构建在Hadoop上的数据仓库框架，可以将结构化的数据文件，映射为一张数据库表，并提供完整的sql查询功能。可以将sql语句，转换为MapReduce任务进行运行。

Hive选择Hadoop来存储和处理数据，因为Hadoop有较好的性价比。Hive设计的目标是让精通SQL技能(Java较弱的)分析师，能够从存放在HDFS的大规模数据集上，运行查询。

Hive 一般在工作站上运行，将SQL查询转换为一系列MapReducejob，在Hadoopcluster上运行。

表模式等元数据存放在名为metastore的数据库中。默认的metastore在本地运行。此时创建的Hive表在本地上，无法与其它用户共享。

Hive优点

Hive学习成本低,可以通过类SQL语句快速实现简单的MapReduce统计，不必开发专门的MapReduce应用，十分适合数据仓库的统计分析。

安装和启动Hive

解压缩：

$ tar xvzfhive-1.X.X-dev.tar.gz

配置路径：

export HIVE_INSTALL=/home/hadoop-2.X/hive

export PATH=$PATH:$HIVE_INSTALL/bin

启动Hive shell：

$ hive

hive>

Hive数据类型

最低0.47元/天解锁文章

关注

0
点赞
踩
0

收藏

觉得还不错? 一键收藏
0
评论
复制链接

分享到 QQ

分享到新浪微博

扫一扫

专栏目录

评论

被折叠的条评论为什么被折叠?

到【灌水乐园】发言

查看更多评论

添加红包

成就一亿技术人!

hope_wisdom

发出的红包

实付元

使用余额支付

点击重新获取

扫码支付

钱包余额 0

抵扣说明：

1.余额是钱包充值的虚拟货币，按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载，可以购买VIP、付费专栏及课程。