数据仓库中Hive、Mysql、Hadoop之间的关联

最新推荐文章于 2024-05-28 10:55:52 发布

柚子一只

最新推荐文章于 2024-05-28 10:55:52 发布

阅读量2.8k

点赞数

分类专栏： Hive编程文章标签： Hive数据仓库 mysql Hadoop

本文链接：https://blog.csdn.net/qq_32572085/article/details/86160807

版权

1. Hive 与 HDFS 之间的联系

（1）hive 是基于 Hadoop 的一个数据仓库工具，可以将结构化的数据文件映射为一张数据库表，并提供完整的 sql 查询功能，可以将 sql 语句转换为 MapReduce 任务进行运行。其优点是学习成本低，可以通过类 SQL 语句快速实现简单的 MapReduce 统计，不必开发专门的 MapReduce 应用，十分适合数据仓库的统计分析。

（2）Hive 是建立在 Hadoop 上的数据仓库基础构架。它提供了一系列的工具，可以用来进行数据提取转化加载（ETL），这是一种可以存储、查询和分析存储在 Hadoop 中的大规模数据的机制。Hive 定义了简单的类 SQL 查询语言，称为 HQL，它允许熟悉 SQL 的用户查询数据。同时，这个语言也允许熟悉 MapReduce 开发者的开发自定义的 mapper 和 reducer 来处理内建的 mapper 和 reducer 无法完成的复杂的分析工作。

2. Hive的特点

官网介绍：The Apache Hive ™ data warehouse software facilitates reading, writing, and managing large datasets residing in distributed storage using SQL 。也就是说：hive数据仓库软件使用sql读取、写入和管理驻留在分布式存储中的大型数据集。说明Hive的开发语言是SQL,而实际我们常见的分布式计算框架也就spark，MapReduce,Storm等，那么Hive如何使用SQL语言去进行分布式计算呢?

2.1 Hive可以看做是MapReduce的客户端

因为Hive的底层运算是MapReduce计算框架，Hiv

最低0.47元/天解锁文章

柚子一只

关注

0
点赞
踩
16

收藏

觉得还不错? 一键收藏
0
评论
数据仓库中Hive、Mysql、Hadoop之间的关联

1. Hive 与 HDFS 之间的联系（1）hive 是基于 Hadoop 的一个数据仓库工具，可以将结构化的数据文件映射为一张数据库表，并提供完整的 sql 查询功能，可以将 sql 语句转换为 MapReduce 任务进行运行。其优点是学习成本低，可以通过类 SQL 语句快速实现简单的 MapReduce 统计，不必开发专门的 MapReduce 应用，十分适合数据仓库的统计分析。（...
复制链接

扫一扫

专栏目录