大数据面试题知识点分析（四）

最新推荐文章于 2024-07-17 18:46:04 发布

且听_风吟

最新推荐文章于 2024-07-17 18:46:04 发布

阅读量1.3k

点赞数 2

分类专栏：大数据面试大数据面试题知识点分析文章标签： Hbase 大数据面试题

本文链接：https://blog.csdn.net/qq_26803795/article/details/79152808

版权

本文深入探讨了HBase与Hive的区别、处理数据导入锁、HBase搭建过程、写数据原理、宕机恢复策略以及时间戳作为行键可能导致的热点问题。通过这些关键知识点，帮助读者理解HBase的核心特性和使用技巧。

摘要由CSDN通过智能技术生成

为了保证效率和质量，每篇文章发布6个知识点，由简单及难，我们继续Hbase：

1）hive 跟 hbase 的区别是？

1.hbase与hive都是架构在hadoop之上的。都是用hadoop作为底层存储
2.Hive是建立在Hadoop之上为了减少MapReduce jobs编写工作的批处理系统，HBase是为了支持弥补Hadoop对实时操作的缺陷的项目。
3.想象你在操作RMDB数据库，如果是全表扫描，就用Hive+Hadoop,如果是索引访问，就用HBase+Hadoop 。
4.Hive query就是MapReduce jobs可以从5分钟到数小时不止，HBase是非常高效的，肯定比Hive高效的多。
5.Hive本身不存储和计算数据，它完全依赖于HDFS和MapReduce，Hive中的表纯逻辑。
6.hive借用hadoop的MapReduce来完成一些hive中的命令的执行
7.hbase是物理表，不是逻辑表，提供一个超大的内存hash表，搜索引擎通过它来存储索引，方便查询操作。
8.hbase是列存储。
9.hdfs作为底层存储，hdfs是存放文件的系统，而Hbase负责组织文件。
10.hive需要用到hdfs存储文件，需要用到MapReduce计算框架。