大数据开发岗面试复习30天冲刺 - 日积月累,每日五题【Day08】——Hbase2
2023-04-18 13:07:56 时间
本栏目大数据开发岗高频面试题主要出自
大数据技术
专栏的各个小专栏,由于个别笔记上传太早,排版杂乱,后面会进行原文美化、增加。
文章目录
停 不要往下滑了,
默默想5min,
看看这5道面试题你都会吗?
面试题 01、Hbase与Hive的区别是什么?
面试题02、Hbase的按列存储是什么?
面试题 03、请简述Namespace、Rowkey、ColumnFamily及多版本的功能及含义
面试题04、请简述Hbase的分布式主从架构
面试题05、请简述Table表与RegionServer的关系
以下答案仅供参考:
面试题 01、Hbase与Hive的区别是什么?
•Hive是通过构建元数据,映射HDFS文件构建成表,本质还是HDFS,实现离线
大数据仓库
•Hbase是通过构建上层分布式内存,底层HDFS,实现大数据实时
存储的NoSQL数据库
面试题02、Hbase的按列存储是什么?
•Hbase按列存储的设计是指Hbase中的最小操作单元
是列,可以实现对每一行的每一列进行读写
•每一行的列都是动态的
,每一行可以拥有不同的列
面试题 03、请简述Namespace、Rowkey、ColumnFamily及多版本的功能及含义
•Namespace
:命名空间,类似于数据库的设计,用于区分不同的业务表
•Rowkey
:行健,类似于主键的设计,唯一标识一条数据并且作为Hbase中的唯一索引
•ColumnFamily
:列族,用于将列进行分组,底层用于区分存储不同的列,提高查询性能
•多版本
:Hbase中允许一列存储多个版本的值,并通过数据写入的时间戳来区分不同版本
面试题04、请简述Hbase的分布式主从架构
•主节点:HMaster
:管理节点、负责管理集群的从节点、元数据以及所有Region的分配
•从节点:HRegionServer
:存储节点,负责实现所有数据的存储,管理Region,构建分布式内存
面试题05、请简述Table表与RegionServer的关系
•Table
是Hbase中的表对象,一张表可以划分为多个Region分区
•RegionServer
是Hbase中实现数据存储的节点,负责存储每个Region
总结
今天我们复习了面试中常考的Hbase相关的五个问题,你做到心中有数了么?
相关文章
- 直接在代码里面对list集合进行分页
- .NET Framework 4.5新特性详解
- 大数据的简要介绍
- 大数据的由来
- 高斯混合模型的自然梯度变量推理
- timing-wheel 仿Kafka实现的时间轮算法
- 使用Navicat软件连接自建数据库(Linux系统)
- 那一天,我被Redis主从架构支配的恐惧
- Redis 深入了解键的过期时间
- C#使用委托调用实现用户端等待闪屏
- 基于流计算 Oceanus 和 Elasticsearch Service 构建百亿级实时监控系统
- GRAND | 转录调控网络预测数据库
- JFreeChart API中文文档
- 临床相关突变查询数据库
- TIGER | 人类胰岛基因变化查询数据库
- 视频边缘计算网关EasyNVR在视频整体监控解决方案中的应用分析
- Apache Arrow - 大数据在数据湖后的下一个风向标
- 常见的电商数据指标体系
- AKShare-艺人数据-艺人流量价值
- MySQL中多表联合查询与子查询的这些区别,你可能不知道!