MaxCompute问答整理之2020-06月

简介: 飞天大数据平台计算引擎MaxCompute成为全球首个TPCx-BB认证的公共云产品,是除Hive、Spark以外TPCx-BB第三个标准支持的大数据引擎。

问题一、MaxCompute的表有无索引?
没有索引,不过Hash Clustering可以提供类似数据库里cluster index的效果。
具体可参考:https://help.aliyun.com/document_detail/73768.html

问题二、DataWorks调度依赖关系中,两个不同业务流程的节点如何依赖?
比如我们有两个业务流程A和B,可以让B业务流程首个节点依赖A业务流程的最后一个节点。
具体可参考:https://developer.aliyun.com/article/759463

问题三、MaxCompute时间类型字段能不能不带时分秒?
可以使用date数据类型。开启MaxCompute2.0可以使用date类型。
具体可参考:
https://help.aliyun.com/document_detail/159541.html

问题四、请问删除表的所有数据sql怎么写?
可以通过删除(DROP)表达到数据删除目的。
非分区表可以通过TRUNCATE TABLE table_name;语句清空表数据。
分区表可以通过ALTER TABLE table_name DROP IF EXISTS PARTITION(分区名=‘具体分区值’)删除分区达到删除整个分区数据的目的。

问题五、请问有什么办法快速查看项目空间下哪些表是分区表?

select table_name  from information_schema.columns where is_partition_key = true group by table_name;

问题六、新创建的工作空间。怎么不支持数据类型自动隐式转换呢?
看下是否开启了MaxCompute2.0,可以关闭2.0之后可进行隐式转换。
具体可参考:https://help.aliyun.com/document_detail/57792.html

问题七、spark odps流式读取datahub数据,写到odps有没有参考文档或者代码?
可参考:https://github.com/aliyun/MaxCompute-Spark/tree/master/spark-2.x/src/main/scala/com/aliyun/odps/spark/examples/streaming/datahub

问题八、怎么将开发环境的表数据同步到生成环境的表中?

insert into project.table  select * from project_dev.table;

如果没有对生产环境表读写权限,对子账户需要授权grant role to $RAM:User;

问题九、可以使用tableau连接MaxCompute吗?
可以。具体可参考:
https://help.aliyun.com/document_detail/115493.html

问题十、 查询一个分区表 where条件是add_months('2020-06-01',-1) ,报错:is full scan with all partitions, please specify partition predicates. 怎么解决呢?
可以通过explain命令查看SQL中的分区剪裁是否生效。
具体可参考:https://help.aliyun.com/document_detail/58679.html

欢迎扫码加入 MaxCompute开发者社区钉钉群,或点击 申请加入。

image.png

相关实践学习
基于MaxCompute的热门话题分析
Apsara Clouder大数据专项技能认证配套课程:基于MaxCompute的热门话题分析
目录
相关文章
|
4月前
|
前端开发 Java Maven
MinIO的预签名直传机制
我们传统使用MinIo做OSS对象存储的应用方式往往都是在后端配置与MinIO的连接和文件上传下载的相关接口,然后我们在前端调用这些接口完成文件的上传下载机制,但是,当并发量过大,频繁访问会对后端的并发往往会对服务器造成极大的压力,大文件传输场景下,服务器被迫承担数据中转的角色,既消耗大量带宽资源,又形成单点性能瓶颈。这时,我们引入了MinIO的一种预签名机制。
MinIO的预签名直传机制
|
缓存 负载均衡 网络协议
DNSSEC
【10月更文挑战第17天】
1244 1
|
分布式计算 DataWorks 搜索推荐
DataWorks 产品评测与最佳实践探索!
DataWorks 是阿里巴巴推出的一站式智能大数据开发治理平台,内置15年实践经验,集成多种大数据与AI服务。本文通过实际使用角度,探讨其优势、潜力及改进建议。评测涵盖用户画像分析、数据治理、功能表现等方面,适合数字化转型企业参考。
433 1
|
SQL 关系型数据库 MySQL
|
SQL 分布式计算 资源调度
一文解析 ODPS SQL 任务优化方法原理
本文重点尝试从ODPS SQL的逻辑执行计划和Logview中的执行计划出发,分析日常数据研发过程中各种优化方法背后的原理,覆盖了部分调优方法的分析,从知道怎么优化,到为什么这样优化,以及还能怎样优化。
105191 1
|
存储 SQL 分布式计算
MaxCompute湖仓一体近实时增量处理技术架构揭秘
本文将介绍阿里云云原生大数据计算服务MaxCompute湖仓一体近实时增量处理技术架构的核心设计和应用场景。
10961 8
|
SQL 存储 自然语言处理
阿里云 DataWorks 智能数据建模(二)| 学习笔记
快速学习阿里云 DataWorks 智能数据建模
阿里云 DataWorks 智能数据建模(二)| 学习笔记
|
数据建模
《全链路数据治理-智能数据建模 》——数仓建模理论与规范(5)
《全链路数据治理-智能数据建模 》——数仓建模理论与规范(5)
785 0
《全链路数据治理-智能数据建模 》——数仓建模理论与规范(5)
|
存储 SQL 自然语言处理
阿里云云原生一体化数仓 — 数据建模新能力解读
本文主要介绍DataWorks智能数据建模的核心产品能力。
2162 0
阿里云云原生一体化数仓 — 数据建模新能力解读
|
SQL 分布式计算 大数据
MaxCompute元数据使用实践 -- 数据下载审计
通过MaxCompute租户级别Information Schema的“TUNNELS_HISTORY”视图可以统计查看通过Tunnel通道进行数据上传下载的相关详细信息,方便您进行数据流转的审计排查。
1304 0

热门文章

最新文章

相关产品

  • 云原生大数据计算服务 MaxCompute