赞
踩
HBase是Apache的Hadoop项目的子项目,是Hadoop Database的简称。
HBase是一个高可靠性、高性能、面向列、可伸缩
的分布式存储系统
,利用HBase技术可在廉价PC Server上搭建起大规模结构化存储集群。
HBase不同于一般的关系数据库(Nosql),它是一个适合于非结构化数据存储的数据库
,HBase基于列
的而不是基于行的模式。
HBase数据模型术语
表(Table)
HBase 会将数据组织进一张张的表里面,一个 HBase 表由多行组成。
HBase 中的一行包含一个行键和一个或多个与其相关的值的列。在存储行时,行按字母顺序排序(字典序)。出于这个原因,行键的设计非常重要。
HBase 中的列由一个列族和一个列限定符组成,它们由:(冒号)字符分隔。
出于性能原因,列族在物理上共同存在一组列和它们的值。在 HBase 中每个列族都有一组存储属性,例如其值是否应缓存在内存中,数据如何压缩或其行编码是如何编码的等等。表中的每一行都有相同的列族,可能为空。
列族一旦确定后,就不能轻易修改,因为它会影响到 HBase 真实的物理存储结构,但是列族中的列标识(Column Qualifier)以及其对应的值可以动态增删。
列限定符被添加到列族中,以提供给定数据段的索引。鉴于列族的content,列限定符可能是content:html,而另一个可能是content:pdf。虽然列族在创建表时是固定的,但列限定符是可变
的,并且在行之间可能差别很大。
单元格是行、列族和列限定符的组合,并且包含值和时间戳,它表示值的版本。
时间戳(Timestamp)
时间戳与每个值一起编写,并且是给定版本的值的标识符。默认情况下,时间戳表示写入数据时 RegionServer 上的时间,但可以在将数据放入单元格时指定不同的时间戳值。
region、列族:表的水平拆分、竖直拆分,提高效率。store:hdfs存储的数据
Copyright © 2003-2013 www.wpsshop.cn 版权所有,并保留所有权利。