【HBase】(4)-HBase写数据流程

2023-01-18 158

版权

本文内容由阿里云实名注册用户自发贡献，版权归原作者所有，阿里云开发者社区不拥有其著作权，亦不承担相应法律责任。具体规则请查看《阿里云开发者社区用户服务协议》和《阿里云开发者社区知识产权保护指引》。如果您发现本社区中有涉嫌抄袭的内容，填写侵权投诉表单进行举报，一经查实，本社区将立刻删除涉嫌侵权内容。

简介： 【HBase】(4)-HBase写数据流程

简介：HBase是谷歌BigData论文的一个代码实现，在大数据处理领域应用广泛。本文意在记录自己近期学习过程中的所学所得，如有错误，欢迎大家指正。

关键词：大数据组件、HBase、NoSQL

一、HBase的写流程

客户端向HBase写入数据分为几个流程：

获取meta表所在的的RegionServer，也就是说客户端需要访问Zookeeper获得meta表所在的服务器，meta表中维护者我们HBase中所有表的位置，我们要获得我们要写的表的所在位置
向维护meta表的RegionServer访问，获得meta表
从meta表中获得我们目标写入数据的表所在的RegionServer
向目标表所在的RegionServer进行发送请求
向memstore进行写入数据
然后向wal中写入预写日志，记录数据操作
向客户端发送ack，证明put成功，此时客户端就不用管任何事了，之后的flush刷写操作就全部交给RegionServer来进行管理。

有个地方需要注意就是当我们向memstore写入数据时，如果发生异常，就是触发回滚机制，将刚才写入的数据进行清空，如果写入成功，我们再次向wal中写入日志。

我们看到zookeeper目录下有个hbase，hbase下面有个meta-region-server，查看后可以发现它是存在hadoop103上面，我们访问下16010端口查看一下是不是

用命令行扫描一下这个表，看一下这个表中到底存在着什么数据

我们可以看到有一列就是info:server,它的值就存着该表所在的RegionServer，每个rowkey就是表名加上切分该表的rowkey范围

rver，每个rowkey就是表名加上切分该表的rowkey范围

现在看上面是每一张表只对应一个RegionServer，原因是表现在比较小，还没有达到切分条件，如果达到一定阈值就会进行切分，再次扫描该表就会看到每张表对应不同的RegionServer。

相关实践学习

lindorm多模间数据无缝流转

展现了Lindorm多模融合能力——用kafka API写入，无缝流转在各引擎内进行数据存储和计算的实验。

云数据库HBase版使用教程

  相关的阿里云产品：云数据库 HBase 版面向大数据领域的一站式NoSQL服务，100%兼容开源HBase并深度扩展，支持海量数据下的实时存储、高并发吞吐、轻SQL分析、全文检索、时序时空查询等能力，是风控、推荐、广告、物联网、车联网、Feeds流、数据大屏等场景首选数据库，是为淘宝、支付宝、菜鸟等众多阿里核心业务提供关键支撑的数据库。了解产品详情: https://cn.aliyun.com/product/hbase   ------------------------------------------------------------------------- 阿里云数据库体验：数据库上云实战开发者云会免费提供一台带自建MySQL的源数据库 ECS 实例和一台目标数据库 RDS实例。跟着指引，您可以一步步实现将ECS自建数据库迁移到目标数据库RDS。点击下方链接，领取免费ECS&RDS资源，30分钟完成数据库上云实战！https://developer.aliyun.com/adc/scenario/51eefbd1894e42f6bb9acacadd3f9121?spm=a2c6h.13788135.J_3257954370.9.4ba85f24utseFl

【HBase】(4)-HBase写数据流程

一、HBase的写流程

热门文章

最新文章

相关课程

相关电子书

相关实验场景

热门

活动广场

任务中心

开发者评测

高校计划

乘风者计划

训练营

阿里云MVP

话题

直播

下载

镜像站

技术资料

插件

【HBase】(4)-HBase写数据流程

一、HBase的写流程

热门文章

最新文章

相关课程

相关电子书

相关实验场景