大数据开发岗面试复习30天冲刺 - 日积月累,每日五题【Day08】——Hbase2

2021-12-07 11:05:18 浏览数 (1)

本栏目大数据开发岗高频面试题主要出自大数据技术专栏的各个小专栏,由于个别笔记上传太早,排版杂乱,后面会进行原文美化、增加。

文章目录

    • 前言
    • 面试题 01、Hbase与Hive的区别是什么?
    • 面试题02、Hbase的按列存储是什么?
    • 面试题 03、请简述Namespace、Rowkey、ColumnFamily及多版本的功能及含义
    • 面试题04、请简述Hbase的分布式主从架构
    • 面试题05、请简述Table表与RegionServer的关系

停 不要往下滑了,

默默想5min,

看看这5道面试题你都会吗?

代码语言:javascript复制
面试题 01、Hbase与Hive的区别是什么?
面试题02、Hbase的按列存储是什么?
面试题 03、请简述Namespace、Rowkey、ColumnFamily及多版本的功能及含义
面试题04、请简述Hbase的分布式主从架构
面试题05、请简述Table表与RegionServer的关系

以下答案仅供参考:

面试题 01、Hbase与Hive的区别是什么?

•Hive是通过构建元数据,映射HDFS文件构建成表,本质还是HDFS,实现离线大数据仓库 •Hbase是通过构建上层分布式内存,底层HDFS,实现大数据实时存储的NoSQL数据库

面试题02、Hbase的按列存储是什么?

•Hbase按列存储的设计是指Hbase中的最小操作单元是列,可以实现对每一行的每一列进行读写 •每一行的列都是动态的,每一行可以拥有不同的列

面试题 03、请简述Namespace、Rowkey、ColumnFamily及多版本的功能及含义

Namespace:命名空间,类似于数据库的设计,用于区分不同的业务表 •Rowkey:行健,类似于主键的设计,唯一标识一条数据并且作为Hbase中的唯一索引 •ColumnFamily:列族,用于将列进行分组,底层用于区分存储不同的列,提高查询性能 •多版本:Hbase中允许一列存储多个版本的值,并通过数据写入的时间戳来区分不同版本

面试题04、请简述Hbase的分布式主从架构

•主节点:HMaster:管理节点、负责管理集群的从节点、元数据以及所有Region的分配 •从节点:HRegionServer:存储节点,负责实现所有数据的存储,管理Region,构建分布式内存

面试题05、请简述Table表与RegionServer的关系

Table是Hbase中的表对象,一张表可以划分为多个Region分区 •RegionServer是Hbase中实现数据存储的节点,负责存储每个Region

总结

今天我们复习了面试中常考的Hbase相关的五个问题,你做到心中有数了么?

0 人点赞