SaaS模式云数据仓库 MaxCompute 问答整理之2020-07~08月

简介: 飞天大数据平台计算引擎MaxCompute成为全球首个TPCx-BB认证的公共云产品,是除Hive、Spark以外TPCx-BB第三个标准支持的大数据引擎。

本文是基于本人对MaxCompute产品的学习进度,再结合开发者社区钉群里的一些问题,进而整理成文。希望对大家有所帮助。

问题一、一般都是子账号登录使用MaxCompute,是否有工具可以查到用户行为,如对表的增、删、改、查等操作?
可以通过审计日志功能和元数据功能配合使用,查到用户行为记录。可以参考下面这篇文章:
https://developer.aliyun.com/article/771413

问题二、odpscmd可以通过什么命令导出数据?
可以使用Tunnel download。可以参考下面这篇文档:
https://help.aliyun.com/document_detail/143537.html

问题三、请问MaxCompute 的DataFrame拿到某一列的值转换成list应该如何操作?
print iris['sepallength'].tolist().execute()[0:5]

问题四、pyodps如何获取表的元数据?
直接查询Information_Schema表就可以。可以参考元数据使用说明文档:
https://help.aliyun.com/document_detail/135432.html

问题五、MaxCompute是否有函数能把日期转换成周几?
可以使用WEEKDAY内建函数。可以参考官方文档:
https://help.aliyun.com/document_detail/48974.html

问题六、创建外部表报错,<Code>AccessDenied</Code> <Message>The bucket you access does not belong to you.</Message>
需要授权,参考一下官方文档:
https://help.aliyun.com/document_detail/72777.html

问题七、MaxCompute 有无一些类似数据库的内置函数,可以将3条记录变成1条,之后逗号隔开。
可以使用WM_CONCAT内建函数。可以参考官方文档:
https://help.aliyun.com/document_detail/48975.html

问题八、在odps sql计算比例时,分母为0时怎么处理,有相应的函数吗?
可以使用DECODE内建函数。可以参考官方文档:
https://help.aliyun.com/document_detail/48976.html

问题九、MaxCompute SQL报错Invalid arguments - format string has second part, but doesn't have minute part : yyyy-mm-dd hh:mm:ss
可以做一下类型转换to_date('20181030 15-13-12.345','yyyymmdd hh-mi-ss.ff3')=2018-10-30 15:13:12

问题十、MaxCompute SQL 去重ID怎么做?
可以使用group或者distinct去重。

问题十一、MaxCompute删除表数据如何恢复?
可以使用备份与恢复功能。可以参考官网文档:
https://help.aliyun.com/document_detail/172397.html

问题十二、MaxCompute查询加速MCQA只能支持标准模式吗?
可以支持简单模式哈。MCQA功能不支持包年包月计费模式。可以参考官网文档:
https://help.aliyun.com/document_detail/180701.html

问题十三、MaxCompute中string 转array 有啥好的方法没? 类似这样select cast('["a","b","c"]' as array);
直接用split切分就行。

问题十四、MaxCompute可以对单个表授权吗?
可以使用ACL授权,参考官网文档:
https://help.aliyun.com/document_detail/27935.html

问题十五、如何评估MaxCompute存储资源和计算资源?
可以参考一下这篇文章:https://developer.aliyun.com/article/771967

相关实践学习
基于MaxCompute的热门话题分析
Apsara Clouder大数据专项技能认证配套课程:基于MaxCompute的热门话题分析
目录
相关文章
|
存储 自然语言处理 Cloud Native
云数据仓库ADB问题之全文索引检索字段过长时条件会失效如何解决
云数据仓库AnalyticDB是阿里云提供的一种高性能、弹性扩展的云原生数据仓库解决方案;本合集将深入探讨ADB的架构、性能调优、数据管理和应用场景等,以及如何解决在使用过程中可能出现的问题,提高数据仓库的使用效率。
368 4
|
SQL 运维 Cloud Native
云数据仓库ADB问题之数据导出失败如何解决
云数据仓库AnalyticDB是阿里云提供的一种高性能、弹性扩展的云原生数据仓库解决方案;本合集将深入探讨ADB的架构、性能调优、数据管理和应用场景等,以及如何解决在使用过程中可能出现的问题,提高数据仓库的使用效率。
390 2
|
分布式计算 运维 数据挖掘
MaxCompute是一个强大的云数据仓库服务
【4月更文挑战第1天】MaxCompute是一个强大的云数据仓库服务
305 1
|
10月前
|
存储 SQL 机器学习/深度学习
一文辨析:数据仓库、数据湖、湖仓一体
本文深入解析数据仓库、数据湖与湖仓一体的技术原理与适用场景。数据仓库结构严谨、查询高效,适合处理结构化数据;数据湖灵活开放,支持多模态数据,但治理难度高;湖仓一体融合两者优势,实现低成本存储与高效分析,适合大规模数据场景。文章结合企业实际需求,探讨如何选择合适的数据架构,并提供湖仓一体的落地迁移策略,助力企业提升数据价值。
一文辨析:数据仓库、数据湖、湖仓一体
|
SQL 分布式计算 大数据
大数据新视界 --大数据大厂之Hive与大数据融合:构建强大数据仓库实战指南
本文深入介绍 Hive 与大数据融合构建强大数据仓库的实战指南。涵盖 Hive 简介、优势、安装配置、数据处理、性能优化及安全管理等内容,并通过互联网广告和物流行业案例分析,展示其实际应用。具有专业性、可操作性和参考价值。
大数据新视界 --大数据大厂之Hive与大数据融合:构建强大数据仓库实战指南
|
存储 分布式计算 大数据
数据仓库与数据湖在大数据架构中的角色与应用
在大数据时代,数据仓库和数据湖分别以结构化数据管理和原始数据存储见长,共同助力企业数据分析。数据仓库通过ETL处理支持OLAP查询,适用于历史分析、BI报表和预测分析;而数据湖则存储多样化的原始数据,便于数据探索和实验。随着技术发展,湖仓一体成为趋势,融合两者的优点,如Delta Lake和Hudi,实现数据全生命周期管理。企业应根据自身需求选择合适的数据架构,以释放数据潜力。【6月更文挑战第12天】
772 5
|
存储 人工智能 分布式计算
阿里云云数据仓库:助力企业构建智能数据基石的云端利器 。阿里云云数据仓库优势与选型指南
阿里云数据仓库体系基于MaxCompute、AnalyticDB等核心产品,提供弹性敏捷的PB级数据处理能力,支持实时分析与智能决策。其六大优势包括无限弹性伸缩、极致性能表现、智能成本优化、全栈安全体系、生态无缝对接和AI增强分析,助力企业在数字经济时代应对数据爆发式增长的挑战。灵活透明的定价体系和行业实践案例展示了其在证券、新零售、物联网等领域的成功应用,为企业构建智能数据基座提供了清晰路径。
635 6
|
存储 分布式计算 大数据
大数据揭秘:从数据湖到数据仓库的全面解析
大数据揭秘:从数据湖到数据仓库的全面解析
497 19
|
存储 机器学习/深度学习 数据采集
深入解析大数据核心概念:数据平台、数据中台、数据湖与数据仓库的异同与应用
深入解析大数据核心概念:数据平台、数据中台、数据湖与数据仓库的异同与应用
|
消息中间件 存储 大数据
大数据-数据仓库-实时数仓架构分析
大数据-数据仓库-实时数仓架构分析
938 1

热门文章

最新文章

相关产品

  • 云原生大数据计算服务 MaxCompute