511.关于数据分析的步骤,以下( D )是在进行数据分析时首先要做的事情。
A:数据收集
B:数据处理
C:数据展现
D:明确目的
解析:数据分析流程首先确定目的,按照选项的顺序应该是明确目的、数据收集、数据处理、数据展现
512.以下图表中,适合展现层次关系的图表有哪些?( A C )(正确2个)
A:树图
B:来源去向
C:矩阵树图
D:气泡地图
E:仪表盘
解析:树图是一种利用包含关系表达层次化数据的可视化方法。 矩形树图适合展现具有层级关系的数据,能够直观体现同级之间的比较。
513.以下图表中,和业务流程相关的有哪些?( AB )(正确2个)
A:来源去向
B:漏斗图
C:条形图
D:散点图
E:树图
解析:来源去向图可以展示一组数据的来源、过程、去向和占比情况,进而体现业务各个环节的数据表现 漏斗图适用于业务流程比较规范、周期长、环节多的单流程单向分析,通过漏斗各环节业务数据的比较能够直观地发现和说明问题所在的环节,进而做出决策
514.DataWorks 数据同步支持的数据类型有( AB )。
A:结构化数据
B:实时业务数据
C:非结构化数据
D:半结构化数据
解析:DataWorks同步过程支持的数据: 仅支持结构化的数据; 支持单地域内及部分跨地域的相互同步、交换 完成数据同步,数据同步都是将业务系统中产生的业务数据定期导入到工作区,通过工作流任务的加工处理后,再将计算结果定期导入到指定的数据源中,供进一步展示或者使用。
515.Hive的SQL执行流程中,步骤Physical Plan Optimizer有什么作用?( B )
A:将逻辑查询计划转成物理计划
B:选择最佳的优化查询策略
C:将SQL转换成抽象语法树
D:将查询块转换成逻辑查询计划
解析:物理计划优化器:选择最佳的join策略(physical optimizer)
516.Spark最早是源于加州大学伯克利分校的Matei Zaharia等人发表的一篇论文。论文提出了一种( C )的概念。
A:分布式并行计算
B:分布式文件系统
C:分布式弹性数据集(RDD)
D:分布式微服务
解析:Spark 最早源于一篇论文 Resilient Distributed Datasets: A Fault-Tolerant Abstraction for In-Memory Cluster Computing, 该论文是由加州大学柏克莱分校的 Matei Zaharia 等人发表的。论文中提出了一种弹性分布式数据集(即 RDD)的概念。
517.下面属于查询分析计算技术的是?( C )
A:Spark
B:Storm
C:Hive
D:Pregel
解析:查询分析计算技术:Hive、Impala
518.关于云计算在许多领域有诸多应用,如政务、教育、各种产业、医疗等有明显的表现,描述正确的是( AD )
A:政务云,部署公共安全管理、容灾备份、城市管理、应急管理、智能交通、社会保障等应用,通过集约化建设、管理和运行,可以实现信息资源整合和政务资源共享,推动政务管理创新,加快向服务型政府转型
B:医疗云,实现远程医疗,电子病历,专家会诊等
C:企业以低廉的成本建立财务、供应链、客户关系等管理应用系统,大大降低企业信息化门槛,加速提升企业信息化水平,对企业市场竞争力没有明显增加
D:教育云,整合教育资源,实现教育资源共享
解析:医疗云可以推动医院与医院、医院与社区、医院与急救中心、医院与家庭之间的服务共享,并形成一套全新的医疗健康服务系统,从而有效地提高医疗保健的质量。
519.某数据集包含以下项(时间,区域,销售金额),想通过一张图表把上述信息全部展示出来,适合使用( A )。
A:气泡图
B:树图
C:饼图
D:雷达图
解析:根据题意,数据集有三个变量。气泡图是可用于展示三个变量之间的关系;树图适合展示层次结构,不是展示数量关系;饼图适合展示各部分占比情况,不适合展示形象之间的数量关系;雷达图适合展示3个以上数字类型的指标,主要展示综合分布情况,而题中“地区”不是数量指标
520.QuickBI中的是通过菜单形式组织的仪表板的集合,可以制作复杂的带导航菜单的专题类分析。( B )
A:仪表板
B:数据门户
C:IFrame
D:工作表
解析:数据门户也叫数据产品,可以通过菜单形式将仪表板组织成复杂的带导航菜单,常用于专题类分析。