⭐⭐欢迎关注博客主页:https://blog.csdn.net/u013411339
⭐⭐欢迎点赞 👍 收藏 ⭐留言 📝 ,欢迎留言交流!
⭐⭐本文由【王知无】原创,首发于 CSDN博客!
⭐⭐本文首发CSDN论坛,未经过官方和本人允许,严禁转载!
技术背景
起源于谷歌旧三篇论文中bigtable。
设计目的
为了解决大数据环境中海量结构化数据的实时读写问题。为了弥补hadoop生态中没有实时存储的缺陷。
设计思想
分布式
技术本质
-
概念:分布式列存储nosql数据库
-
解释:
列存储:底层数据文件存储格式是列式存储
nosql:非关系型,可以存储结构化和半结构化数据
数据库:符合数据库的特征
核心特性
大表: 为存储海量数据而生,亿级别的行和百万级别的列
分
本文深入探讨了HBase的设计背景、核心特性和技术本质,包括分布式、列存储和NoSQL数据库的特点。详细阐述了HBase的内存管理、多版本机制、随机实时读写、Zookeeper的角色、数据存储结构如Region、Store、MemStore和HFile等。此外,还分析了热点问题、数据倾斜的解决办法,以及预分区和RowKey设计的重要性。文章最后提到了HBase的优化策略,如Flush、Compaction和Split的控制,以及列簇属性的调整。通过对HBase的全面解析,为大数据面试提供了宝贵的参考资料。
订阅专栏 解锁全文
1203

被折叠的 条评论
为什么被折叠?



