大数据之Hbase:HBase简介

Posted 浊酒南街

tags:

篇首语:本文由小常识网(cha138.com)小编为大家整理,主要介绍了大数据之Hbase:HBase简介相关的知识,希望对你有一定的参考价值。

1.HBase定义

HBase是一种分布式、可扩展、支持海量数据存储的NoSQL数据库;

2.HBase逻辑结构

在这里插入图片描述
逻辑结构:包含列,rowkey,region,store,列族等基本概念;

3.HBase物理存储结构

在这里插入图片描述
数据实际存储在storefile中,即Hfile中;

4.数据模型

1)Name Space
命名空间,类似于关系型数据库的database概念,每个命名空间下有多个表。HBase两个自带的命名空间,分别是hbase和default,hbase中存放的是HBase内置的表,default表是用户默认使用的命名空间。
2)Table
类似于关系型数据库的表概念。不同的是,HBase定义表时只需要声明列族即可,不需要声明具体的列。这意味着,往HBase写入数据时,字段可以动态、按需指定。因此,和关系型数据库相比,HBase能够轻松应对字段变更的场景。
3)Row
HBase表中的每行数据都由一个RowKey和多个Column(列)组成,数据是按照RowKey的字典顺序存储的,并且查询数据时只能根据RowKey进行检索,所以RowKey的设计十分重要。
4)Column
HBase中的每个列都由Column Family(列族)和Column Qualifier(列限定符)进行限定,例如info:name,info:age。建表时,只需指明列族,而列限定符无需预先定义。
5)Time Stamp
用于标识数据的不同版本(version),每条数据写入时,系统会自动为其加上该字段,其值为写入HBase的时间。
6)Cell
由{rowkey, column Family:column Qualifier, time Stamp} 唯一确定的单元。cell中的数据全部是字节码形式存贮。

以上是关于大数据之Hbase:HBase简介的主要内容,如果未能解决你的问题,请参考以下文章

大数据之Hbase:HBase之读写数据流程

大数据之Hbase:Hbase面试题

大数据存储之hbase数据存储

大数据之Hbase:Hbase工作机制

大数据之Hbase:HBase优化

大数据之Hbase:Hbase中的rowkey以及热点问题