当前位置: 首页 > article >正文

Hbase要点简记

Hbase要点简记

  • Hbase
    • 1、底层架构
    • 2、表逻辑结构

Hbase

HBase是一个分布式的、列式的、实时查询的、非关系型数据库,可以处理PB级别的数据,吞吐量可以到的百万查询/每秒。主要应用于接口等实时数据应用需求,针对具体需求,设计高效率的数据查询接口。

1、底层架构

hbase底层架构
● Master:HBase 管理节点。管理 Region Server,分配 Region 到 Region Server,提供负载均衡能力;执行创建表等 DDL 操作。
● Region Server:HBase 数据节点。管理 Region,一个 Region Server 可包含多个 Region,Region 相当于表的分区。客户端可直接与 Region Server 通信,实现数据增删改查等 DML 操作。
● ZooKeeper:协调中心。负责 Master 选举,节点协调,存储 hbase:meta 等元数据。
● HDFS:底层存储系统。负责存储数据,Region 中的数据通过 HDFS 存储。

2、表逻辑结构

在这里插入图片描述
● RowKey(行键):行键是HBase记录条目的主键,物理存储时会按照RowKey的字典序排序存储,HBase基于RowKey实现索引;
● Column Family(列族):纵向切割,HBase中的每个列都归属于某个列族,列族不能改变,一行可有多个列族,一个列族可有任意个列;
● Column(列):一般都是从属于某个列族,跟列族不一样,这些列都可以动态添加。

注意:
● Key-Value(键值对):每一列存储的是一个键值对,Key是列名,Value是列值。通过{行键,列族名,列名}可以唯一确定一个列单元并获取数据Value,和关系型数据库不同的是,HBase中的数据是没有类型的,都是以bytes形式存储;
● Byte(数据类型):数据在HBase中以Byte存储,实际的数据类型交由用户转换;

如果HBase中的一张表只有一个列族的话,等于是这个列族包含了这张表的所有列,也就是将表整行的数据连续存储在了一起,就等于是行式存储了。如果一张表有多个列族,并且每个列族下仅有一列,也就是将表的列数据连续存储在了一起,就等于是列式存储了。

只有一个列族:
在这里插入图片描述
每个列族下仅有一列:
在这里插入图片描述


http://www.kler.cn/news/336738.html

相关文章:

  • windows查看端口占用情况并终结该进程
  • 【C++掌中宝】类和对象(二):隐藏的this指针
  • 基于Zynq SDIO WiFi移植三(支持2.4/5G)
  • clickhouse数据字典
  • 《Linux从小白到高手》理论篇:Linux的系统环境管理
  • MicoZone-Maven
  • Ubuntu2404安装
  • 15分钟学 Python 第40天:Python 爬虫入门(六)第一篇
  • Android SystemUI组件(11)SystemUIVisibility解读
  • 头歌 | 获取最多金币
  • rabbitmq----数据管理模块
  • 智能视界·大模型驱动视频矩阵管理系统
  • Anaconda的安装与环境设置
  • Android车载——VehicleHal初始化(Android 11)
  • MATLAB计算与建模常见函数:2.回归模型
  • 计算机视觉中的3D变换:让虚拟与现实无缝对接
  • CSS给一行按钮统一设置间隔
  • 【代码实现】torch实现F.pixel_shuffle和F.pixel_unshuffle
  • guava里常用功能
  • 强化学习笔记之【Q-learning算法和DQN算法】