容量大
Hbase单表可以有百亿行、百万列,横纵向数据量级具有弹性。企业级应用的HBase可实现单表千亿条数据(每行百万列)的秒级查询。
列族存储
面向列族的存储和权限控制,并支持独立检索,可以动态增加列,即,可单独对列进行各方面的操作。
数据多版本
Hbase的每一个列的数据存储有多个Version,比如住址列,可能有多个变更,所以该列可以有多个version
稀疏性
为空的列并不占用存储空间,表可以设计的非常稀疏。不必像关系型数据库那样需要预先知道所有列名然后再进行null填充。
拓展性
底层依赖HDFS,当磁盘空间不足的时候,只需要动态增加datanode节点服务(机器)就可以了。
高可靠性
WAL机制,保证数据写入的时候不会因为集群异常而导致写入数据丢失。副本机制,保证了在集群出现严重的问题时候,数据不会发生丢失或者损坏。Hbase底层使用HDFS,本身也有备份。
高性能
底层的LSM数据结构和RowKey有序排列等架构上的独特设计,使得Hbase写入性能非常高。
Region切分、主键索引、缓存机制使得Hbase在海量数据下具备一定的随机读取性能,该性能针对Rowkey的查询能够到达毫秒级别。