《CDP企业数据云平台从入门到实践》——CDP之操作型数据库(1)

简介: 《CDP企业数据云平台从入门到实践》——CDP之操作型数据库(1)


CDP 之操作型数据库


一、 什么是操作型数据库(OPDB)


1. 操作型数据库(OPDB)定义


Cloudera 操作型数据库(Operational Database)由 Apache HBase 和 Apache Phoenix 提供支持。Apache HBase 是一个 NoSQL 数据库,提供对大型数据集的实时读/写访问。Apache Phoenix 提供了一个 SQL 接口来管理 Apache HBase 中的数据。由Apache Accumulo 提供支持的操作数据库是 Apache Accumulo 的 Cloudera软件包。


Cloudera 操作型数据库提供实时、始终可用、可扩展的操作数据库,在统一的操作和仓储平台内为传统结构化数据和非结构化数据提供服务。


Cloudera 操作型数据库在企业数据生命周期中扮演着数据存储的关键角色。下图显示了典型的操作型数据库部署中的一些关键元素。

image.png

操作数据库具有以下组件:


• Apache Phoenix 提供了一个在 Apache HBase 之上运行的 SQL 接口。

• Apache HBase 为键值存储提供了巨大的可扩展性,因此您可以在单一平台中存储无限量的数据,并满足不断增长的数据服务需求。

• Apache ZooKeeper 提供分布式配置服务、同步服务和命名注册表。

• Apache Knox Gateway 提供外围安全性,以便企业可以放心地将访问权限扩展到新用户。

• Apache HDFS 用于编写 Apache HBase WAL。

• Hue 提供了一个基于 Web 的编辑器来创建和浏览 Apache HBase 表。

• Amazon S3和Microsoft ADLS Gen2等对象存储用于存储Apache HBase HFiles。

• CLoudera Shared Data Experience(SDX)用于安全和治理功能。安全和治理策略设置一次并应用于所有数据和工作负载。

• IDBroker 提供作为 Apache Knox 身份验证服务的一部分构建的身份验证机制。


它允许经过身份验证和授权的用户交换一组凭据或令牌以获取云供应商访问令牌。

操作型数据库的两个主要特性:


1) 快速灵活


Not-only-SQL 数据库能够每秒处理数百万个事务,支持:

• Schema 演变

• 多行事务

• 二级索引

• 时间旅行查询


2) 企业就绪


容错、开源、分布式数据库,可扩展到 PB 级,具有:


• 高可用性

• 批量加载、快照和复制

• 安全和角色管理

• 资源分配

• 混合部署


2. OPDB 应用场景


OPDB 支持的场景涉及制造、医疗保健、金融服务和其他行业,用户包括 Cerner、

智能手机制造商、财经媒体之家、保险供应商、图书馆服务供应商等。

image.png


3. OPDB 的组成


OPDB 由两部分组成:APACHE HBASE 和 PHOENIX。


1) APACHE HBASE:低成本、高扩展、云智能的大数据 NoSQL。

Apache HBase 数据库提供对数据的随机、持久访问。Apache HBase 非常适合需要为最终用户应用程序提供实时分析和表格数据的场景。


作为一个原生的非关系数据库,Apache HBase 可以组合使用各种结构和模式的数据源。HBase 专为弹性数据存储而设计,旨在托管具有稀疏数据的非常大的表。Apache HBase 可以托管大数据表,因为它可以线性扩展以处理非常大(PB 级)、面向列的数据集。数据存储基于支持分布式环境中低延迟读取、写入和更新的键值模型。


特性:


• 可靠、成熟的存储引擎

• 高扩展性:扩展到 PB

• 容错和弹性

• 支持快照和复制

• 带配额的资源管理

• 基于 Kerberos 和 Ranger 的安全性

• 时间旅行查询


缺点:


• 提供低级编程接口,对用户编程能力要求较高。

• 开发人员需要管理数据序列化,操作复杂度高。


2) PHOENIX:在 HBase 之上的一个 SQL 关系层


Apache Phoenix 是 Apache HBase 的 SQL 层,它提供了一个程序化的 ANSI SQL 接

口。


Apache Phoenix 实施最佳实践优化,使软件工程师能够开发基于 HBase 的下一代应用程序来操作大数据。使用 Phoenix,您可以使用 Phoenix 标准 JDBC API 以典型DDL/DML 语句的形式创建表并与之交互。


可以使用 Apache Phoenix SQL 命令来创建、删除或修改 Apache HBase 表。您还可以创建 Apache Phoenix 视图,这些视图是共享同一个 Apache HBase 表的虚拟表。


特性:

• 熟悉的 SQL 接口

• 支持类型的标准编码

• Schema 演变

• 多行事务

• 二级索引


《CDP企业数据云平台从入门到实践》——CDP之数据储存(2) https://developer.aliyun.com/article/1226409?spm=a2c6h.13148508.setting.14.12f54f0eNj6eW1



目录
相关文章
|
1天前
|
关系型数据库 MySQL 数据库
关系型数据库mysql数据增量恢复
【7月更文挑战第3天】
10 2
|
1天前
|
关系型数据库 MySQL Shell
关系型数据库mysql数据完全恢复
【7月更文挑战第3天】
10 2
|
1天前
|
数据处理 数据库 索引
数据库索引策略如何影响数据的读取效率?
【7月更文挑战第3天】数据库索引策略如何影响数据的读取效率?
7 2
|
1天前
|
前端开发 数据库
文本----富文本数据如何存入到数据库当中,解决方法,看其他大佬写的文章
文本----富文本数据如何存入到数据库当中,解决方法,看其他大佬写的文章
文本----富文本数据如何存入到数据库当中,解决方法,看其他大佬写的文章
|
2天前
|
存储 关系型数据库 MySQL
|
3天前
|
SQL 关系型数据库 MySQL
MySQL数据库—DQL查询语句(一篇教会你快速找到想要的数据)
MySQL数据库—DQL查询语句(一篇教会你快速找到想要的数据)
|
7天前
|
文字识别 负载均衡 算法
视觉智能开放平台产品使用合集之人脸数据库已创建超过1000个人脸数据,怎么开通更多人脸数据库
视觉智能开放平台是指提供一系列基于视觉识别技术的API和服务的平台,这些服务通常包括图像识别、人脸识别、物体检测、文字识别、场景理解等。企业或开发者可以通过调用这些API,快速将视觉智能功能集成到自己的应用或服务中,而无需从零开始研发相关算法和技术。以下是一些常见的视觉智能开放平台产品及其应用场景的概览。
|
6天前
|
SQL 关系型数据库 数据管理
数据管理DMS产品使用合集之归档数据至其它MySQL数据库时,如何指定目的库
阿里云数据管理DMS提供了全面的数据管理、数据库运维、数据安全、数据迁移与同步等功能,助力企业高效、安全地进行数据库管理和运维工作。以下是DMS产品使用合集的详细介绍。
20 1
|
6天前
|
Java Devops API
阿里云云效操作报错合集之云效页面提示数据库保存不进去,该怎么办
本合集将整理呈现用户在使用过程中遇到的报错及其对应的解决办法,包括但不限于账户权限设置错误、项目配置不正确、代码提交冲突、构建任务执行失败、测试环境异常、需求流转阻塞等问题。阿里云云效是一站式企业级研发协同和DevOps平台,为企业提供从需求规划、开发、测试、发布到运维、运营的全流程端到端服务和工具支撑,致力于提升企业的研发效能和创新能力。
|
1天前
|
SQL 安全 关系型数据库
Kingbase(人大金仓数据库)(总结全网精华,虚拟机:从安装到操作数据库一条龙)
KingbaseES 是一款由中国人大金仓信息技术股份有限公司自主研发的通用关系型数据库管理系统(RDBMS),专为中国市场设计,广泛应用于政府、金融、能源、电信等多个关键行业。它是国产数据库的代表之一,以其高安全性、高可用性和高性能著称,符合中国信息技术领域的自主可控要求。以下是关于KingbaseES的一些关键特点和功能: