智能分析的所见即所得——基于Lambda架构的实时数据引擎

简介: 在刚刚结束的“2019智能决策峰会”上,观远数据重磅发布了观远智能分析平台2.0版本。高性能实时数据引擎作为备受瞩目的功能,得到了大家的广泛认可。下面就让我们一起来了解下基于Lambda架构的观远实时数据解决方案。

在刚刚结束的“2019智能决策峰会”上,观远数据重磅发布了观远智能分析平台2.0版本。高性能实时数据引擎作为备受瞩目的功能,得到了大家的广泛认可。下面就让我们一起来了解下基于Lambda架构的观远实时数据解决方案

BI与实时数据

随着商业领域中的业务场景越来越复杂,更实时、更大量的数据正在被不断生产出来,如何将这些实时的海量数据高效的进行处理就变成了一个挑战。一般而言,传统BI只能支持T+1天时效延迟的数据决策,数据处理过程以ETL为主,实时数据处理存在天然缺陷;但新一代BI增加了更多样化数据源的导入存储,支持了更灵活的数据处理方式与更敏捷的数据处理时效,在合理规划服务器计算资源的前提下,新一代BI可以支持准实时、甚至分钟级实时数据的更新展示。可见,数据实时化已成为新一代BI的显著优势。

Lambda架构

作为新一代BI的典型代表,观远数据基于Lambda架构设计了一套高性能的实时数据引擎,那么什么是Lambda架构呢?

Lambda架构是一套通用的的实时大数据处理框架,其作者Nathan Marz基于对数据和查询的本质认识,整合了离线计算与实时计算,融合了不可变性、读写分离和复杂性隔离等一系列架构原则,从而设计出能满足实时大数据系统关键特性(如高容错、低延时、可扩展等)的Lambda架构。

Lambda架构的核心思想是将大数据处理系统划分为三层:Batch Layer、 Real-Time(Speed) Layer以及Serving Layer,从而将实时任务与批处理任务很好地结合起来,最终实现对大数据的实时处理。

  • Batch Layer:批处理层。该层可以很好的处理离线数据,在数据集上预先聚合好实时查询所需要数据的历史部分,从而得到Batch View。
  • Real-Time(Speed) Layer:加速层。该层可以处理最新的增量数据流,不断将数据以时间维度增量聚合到Real-Time View。
  • Serving Layer :服务层。用于响应用户的查询请求,可以合并Batch View和Real-time View中的数据到最终的展示结果。

_jpeg

Guandata实时引擎

在观远智能分析平台1.0时代,观远数据可以提供两种准实时数据解决方案,但他们都存在一些不足。

用户在创建直连数据库的数据集时,可选择“支持实时卡片数据”。数据集版本有效时间将会缩小为10分钟,用户基于该数据集进行数据查询展示时,可达到准实时的效果。但这种处理方式对业务库会造成较大压力,且无法实现多源数据融合。

_

Guan-Index类型的数据集可支持最高每天四次的更新频率,按此频率抽取到观远平台上来的数据,通过ETL可以实现与其他数据源的融合。相比于上一种方案,这种方案虽然突破了对于数据来源的限制,但一方面数据更新频率受到限制,另一方面ETL运行也会占掉大量的计算资源从而导致系统性能受到影响。

_

在观远智能分析平台2.0版本中,观远数据推出了最新一代的实时数据引擎,通过汲取Lambda架构的精髓,将历史数据与实时数据进行分开处理,既能够实现多源数据的融合,又可以支持增量更新且占用较少的计算资源。该方案最终不仅可以进行简单的数据实时更新与展示,还可以支持复杂的计算与分析(比如零售场景中常用的同环比指标以及累计指标的实时运算)。

_

下面以门店维度的销售指标监控为例,列举了实时数据分析的典型场景:

  • 门店经理通常需要关注当日每时每刻的业务KPI,但他关注的实时指标很有可能分散在不同的数据来源中(比如销售额、客流量);
  • 除了实时销售额以外,门店经理还会关注销售额的实时累计值,用来衡量本周累计完成的营业额是否已经达标,甚至会关心当前门店在整个区域乃至整个公司目前的销售额排名是什么水平,更复杂一点,如果能随时了解当前销售额到与昨天/上周同一时段相比的同环比变化,那就最好了;
  • 当然,门店经理关注的数据并非都是需要实时更新的,还会有一些相对静态的附加信息,例如门店基础信息、门店当天的目标营业额等。

实时数据的展示与融合

在观远实时数据解决方案中,通过多数据源的融合,对于门店经理关注的销售额以及客流量,都可以实现高频次的聚合与实时展示。

_

实时数据的复杂计算

零售行业中比较关注的累计值、排名、同环比,这些基于实时指标的二次分析与计算,在观远实时数据解决方案中也都可以得到完满的解决。


_
_2
_VS_

附加信息的展示

观远实时引擎同样可以通过数据融合的方式将附加信息添加为实时数据集的静态数据来源,从而进一步在可视化时进行展示。

_

Guandata实时数据引擎突破了观远1.0时代数据更新频率以及运算能力的限制,显著降低了数据从产生到消费的端到端时延,最终完美支持了实时的数据更新响应与极高频次的数据运算。

作为区别于传统BI的一大亮点,观远实时数据解决方案的应用场景还有很多,我们致力于把实时数据对于数据分析的价值发挥到极致。您在使用过程中遇到什么问题、有什么好的想法和建议,也欢迎留言来跟我们沟通探讨!

作者:观远产品部
产品咨询:shopbi2018
免费试用请戳

相关文章
|
4月前
|
机器学习/深度学习 数据采集 人工智能
揭秘!47页文档拆解苹果智能,从架构、数据到训练和优化
【8月更文挑战第23天】苹果公司发布了一份47页的研究文档,深入解析了其在智能基础语言模型领域的探索与突破。文档揭示了苹果在此领域的雄厚实力,并分享了其独特的混合架构设计,该设计融合了Transformer与RNN的优势,显著提高了模型处理序列数据的效能与表现力。然而,这种架构也带来了诸如权重平衡与资源消耗等挑战。苹果利用海量、多样的高质量数据集训练模型,但确保数据质量及处理噪声仍需克服。此外,苹果采取了自监督与无监督学习相结合的高效训练策略,以增强模型的泛化与稳健性,但仍需解决预训练任务选择及超参数调优等问题。
155 66
|
3月前
|
安全 数据处理 数据安全/隐私保护
C/S架构与B/S架构的适用场景分析
C/S架构(客户端/服务器架构)与B/S架构(浏览器/服务器架构)在适用场景上各有特点,主要取决于应用的具体需求、用户群体、系统维护成本、跨平台需求等因素。
259 6
|
4月前
|
存储 边缘计算 运维
实时数仓Hologres发展问题之实时数仓对Lambda架构的问题如何解决
实时数仓Hologres发展问题之实时数仓对Lambda架构的问题如何解决
68 2
|
1月前
|
存储 SQL Apache
Apache Doris 开源最顶级基于MPP架构的高性能实时分析数据库
Apache Doris 是一个基于 MPP 架构的高性能实时分析数据库,以其极高的速度和易用性著称。它支持高并发点查询和复杂分析场景,适用于报表分析、即席查询、数据仓库和数据湖查询加速等。最新发布的 2.0.2 版本在性能、稳定性和多租户支持方面有显著提升。社区活跃,已广泛应用于电商、广告、用户行为分析等领域。
Apache Doris 开源最顶级基于MPP架构的高性能实时分析数据库
|
25天前
|
传感器 算法 物联网
智能停车解决方案之停车场室内导航系统(二):核心技术与系统架构构建
随着城市化进程的加速,停车难问题日益凸显。本文深入剖析智能停车系统的关键技术,包括停车场电子地图编辑绘制、物联网与传感器技术、大数据与云计算的应用、定位技术及车辆导航路径规划,为读者提供全面的技术解决方案。系统架构分为应用层、业务层、数据层和运行环境,涵盖停车场室内导航、车位占用检测、动态更新、精准导航和路径规划等方面。
91 4
|
1月前
|
运维 NoSQL Java
后端架构演进:微服务架构的优缺点与实战案例分析
【10月更文挑战第28天】本文探讨了微服务架构与单体架构的优缺点,并通过实战案例分析了微服务架构在实际应用中的表现。微服务架构具有高内聚、低耦合、独立部署等优势,但也面临分布式系统的复杂性和较高的运维成本。通过某电商平台的实际案例,展示了微服务架构在提升系统性能和团队协作效率方面的显著效果,同时也指出了其带来的挑战。
72 4
|
17天前
|
机器学习/深度学习 存储 人工智能
政务部门人工智能OCR智能化升级:3大技术架构与4项核心功能解析
本项目针对政务服务数字化需求,建设智能文档处理平台,利用OCR、信息抽取和深度学习技术,实现文件自动解析、分类、比对与审核,提升效率与准确性。平台强调本地部署,确保数据安全,解决低质量扫描件、复杂表格等痛点,降低人工成本与错误率,助力智慧政务发展。
|
29天前
|
机器学习/深度学习 运维 监控
智能运维在现代IT架构中的转型之路####
【10月更文挑战第29天】 本文旨在探讨智能运维(AIOps)如何成为现代IT架构不可或缺的一部分,通过分析其核心价值、关键技术及实践案例,揭示AIOps在提升系统稳定性、优化资源配置及加速故障响应中的关键作用。不同于传统运维模式的被动响应,智能运维强调预测性维护与自动化处理,为企业数字化转型提供强有力的技术支撑。 ####
69 0
|
2月前
|
存储 SQL 分布式计算
湖仓一体架构深度解析:构建企业级数据管理与分析的新基石
【10月更文挑战第7天】湖仓一体架构深度解析:构建企业级数据管理与分析的新基石
129 1
|
3月前
|
存储 监控 安全
SaaS业务架构:业务能力分析
【9月更文挑战第20天】在数字化时代,软件即服务(SaaS)模式逐渐成为企业软件解决方案的首选。SaaS 业务架构设计对于提供高效、可靠的服务至关重要。其核心业务能力包括:用户管理(注册登录、角色权限)、数据管理(存储备份、安全共享)、业务流程管理(设计定制、工作流自动化)、应用集成(第三方应用、移动应用)及客户服务(支持培训、反馈改进)。通过优化这些能力,可为企业提供更高效、可靠的 SaaS 服务。
64 11