HBase简介
1. 什么是HBase
HBase的原型是Google的BigTable论文,受到了该论文思想的启发,目前作为Hadoop的子项目来开发维护,用于支持结构化的数据存储。
HBase是一个高可靠性、高性能、面向列、可伸缩的分布式存储系统
,利用HBASE技术可在廉价PC Server上搭建起大规模结构化存储集群。
2. Hbase特点
1)海量存储
Hbase适合存储PB级别的海量数据,在PB级别的数据以及采用廉价PC存储的情况下,能在几十到百毫秒内返回数据。
这与Hbase的极易扩展性息息相关。正式因为Hbase良好的扩展性,才为海量数据的存储提供了便利。
2)列式存储
这里的列式存储其实说的是列族(ColumnFamily)存储
,Hbase是根据列族来存储数据的。列族下面可以有非常多的列
,列族在创建表的时候就必须指定。
3)极易扩展
HBase的扩展性主要体现在两个方面:
① 一个是基于上层处理能力(RegionServer)的扩展:
通过横向添加RegionSever的机器,进行水平扩展,提升Hbase上层的处理能力,提升Hbsae服务更多Region的能力。
② 一个是基于存储的扩展(HDFS)