加载中...

| 类别 | 大数据 |
| 领域 | 大数据 / 数据科学 |
Apache HBase是一个开源的分布式、面向列的 NoSQL 数据库,源自 Google 的 BigTable 论文,运行在 HDFS 之上。它弥补了 HDFS 不擅长随机读写的短板,可对数十亿行、数百万列的超大表提供实时随机访问。
HBase 采用稀疏的多维映射结构,数据按行键(RowKey)字典序存储:
HBase 由 HMaster 负责管理与负载均衡,RegionServer 负责实际数据读写。大表被水平切分为多个 Region 分布在不同节点上,并借助 ZooKeeper 协调集群状态与故障转移。
HBase 适合写多读多、需要随机访问的海量数据场景,如用户画像、消息存储、订单历史、物联网时序数据与实时查询。它与 Hive、Spark、Phoenix 等组件集成,常作为大数据平台的实时存储层。

| 类别 | 大数据 |
| 领域 | 大数据 / 数据科学 |
登录 后参与讨论
暂无讨论,来发表第一条评论吧