MaxCompute应用限制整理-阿里云开发者社区

MaxCompute应用限制整理

2016-11-01 4205

版权

本文内容由阿里云实名注册用户自发贡献，版权归原作者所有，阿里云开发者社区不拥有其著作权，亦不承担相应法律责任。具体规则请查看《阿里云开发者社区用户服务协议》和《阿里云开发者社区知识产权保护指引》。如果您发现本社区中有涉嫌抄袭的内容，填写侵权投诉表单进行举报，一经查实，本社区将立刻删除涉嫌侵权内容。

本文涉及的产品

云原生大数据计算服务 MaxCompute，5000CU*H 100GB 3个月

云原生大数据计算服务MaxCompute，500CU*H 100GB 3个月

简介： 好多同学在使用MaxCompute时，对产品的应用限制并不了解。这里，我们将给出MaxCompute产品的详细应用限制列表。如有遗漏，还请大家补充：命名规范：原则上，项目(Project)，表(Table)，函数(Function)，资源(Resource)，分区(Partition

好多同学在使用MaxCompute时，对产品的应用限制并不了解。这里，我们将给出MaxCompute产品的详细应用限制列表。如有遗漏，还请大家补充：

命名规范：原则上，项目(Project)，表(Table)，函数(Function)，资源(Resource)，分区(Partition)，列的名称都不能有特殊字符，只能用英文的a-z，A-Z及数字和下划线_，且以字母开头，名称的长度不超过128字节。实际情况可能会略有不同，但我们仍然建议您遵循这个原则进行命名。
Task并发度控制：通常情况下，MaxCompute会在项目级别做Task并发度控制，任意项目下，用户在同一时刻最多只能提交1000个Task。对于Graph及部分MPI类型的PAI作业，最大只允许1000个进程的作业。
列限制：表string列内容长度不允许超过8MB；
SQL：
- 多路输出限制：单个SQL里最多可以写128路输出，超过128路报语法错误；
- 动态输出分区限制：任意动态分区SQL不允许生成超过2000个动态分区，否则引发运行时异常；
- Select屏显限制：Select屏显结果最多只有10000条输出；
- Order by语句后必须接Limit；
- Sort By必须与Distribute By配合使用；
- 最多允许128路union all，超过此限制报语法错误；
- MaxCompute 的JOIN支持多路间接，但不支持笛卡尔积，即无on条件的链接；
- MaxCompute中的Join连接条件，只允许and连接的等值条件，并且最多支持16路join操作。只有在MAPJOIN中，可以使用不等值连接或者使用or连接多个条件；
- 目前MaxCompute 在mapjoin中最多支持指定6张小表，否则报语法错误；
- 如果使用mapjoin，则所有小表占用的内存总和不得超过512MB。请注意由于MaxCompute 是压缩存储，因此小表在被加载到内存后，数据大小会急剧膨胀。此处的512MB限制是加载到内存后的空间大小；
- 多个表join时，最左边的两个表不能同时是mapjoin的表；
MapReduce限制：
- 单个任务引用的资源数量不超过512个，分区表按照一个单位计算。
- 单个任务引用的资源总计字节数大小不超过64MB。
- 单个任务的输入路数不能超过128，单个任务的输出路数不能超过128路。
- 单个任务中自定义Counter的数量不能超过64。
- 单个Map或Reduce Worker占用memory默认为2048MB，范围[256MB, 12GB]。
- 单个Map或Reduce Worker重复读一个资源次数限制 <=64次。
- 本地运行模式下，Map Worker个数不能超过100；Reduce Worker个数不能超过100；默认一路输入下载记录数100。
Graph应用限制：
- 单个job引用的resource数量不超过256个，Table、Archive按照一个单位计算；
- 单个job引用的resource总计字节数大小不超过512M；
- 单个job的输入路数不能超过1024(输入表的个数不能超过64)，单个job的输出路数不能超过256；
- 多路输出中指定的label不能为null或者为空字符串，长度不能超过256，只能包括A-Z，a-z，0-9，_，#，.，-等；
- 单个job中自定义counter的数量不能超过64，counter的group name和counter name中不能带有#，两者长度和不能超过100；
- 单个job的worker数由框架计算得出，最大为 1000，超过抛异常；
- 单个worker占用cpu默认为200，范围[50, 800]；
- 单个worker占用memory默认为4096，范围[256M, 12G]；
- 单个worker重复读一个resource次数限制不大于64次；
- split size默认为64M，用户可设置，范围：0 < split_size <= (9223372036854775807 >> 20)；
Java沙箱限制请参考这里；

了解更多信息，请加入 MaxCompute产品钉钉咨询群：

22b57910b48c9c05356eae7bfe98969732eb3549

相关实践学习

基于MaxCompute的热门话题分析

本实验围绕社交用户发布的文章做了详尽的分析，通过分析能得到用户群体年龄分布，性别分布，地理位置分布，以及热门话题的热度。

SaaS 模式云数据仓库必修课

本课程由阿里云开发者社区和阿里云大数据团队共同出品，是SaaS模式云原生数据仓库领导者MaxCompute核心课程。本课程由阿里云资深产品和技术专家们从概念到方法，从场景到实践，体系化的将阿里巴巴飞天大数据平台10多年的经过验证的方法与实践深入浅出的讲给开发者们。帮助大数据开发者快速了解并掌握SaaS模式的云原生的数据仓库，助力开发者学习了解先进的技术栈，并能在实际业务中敏捷的进行大数据分析，赋能企业业务。通过本课程可以了解SaaS模式云原生数据仓库领导者MaxCompute核心功能及典型适用场景，可应用MaxCompute实现数仓搭建，快速进行大数据分析。适合大数据工程师、大数据分析师大量数据需要处理、存储和管理，需要搭建数据仓库？学它！没有足够人员和经验来运维大数据平台，不想自建IDC买机器，需要免运维的大数据平台？会SQL就等于会大数据？学它！想知道大数据用得对不对，想用更少的钱得到持续演进的数仓能力？获得极致弹性的计算资源和更好的性能，以及持续保护数据安全的生产环境？学它！想要获得灵活的分析能力，快速洞察数据规律特征？想要兼得数据湖的灵活性与数据仓库的成长性？学它！出品人：阿里云大数据产品及研发团队专家产品 MaxCompute 官网 https://www.aliyun.com/product/odps 

MaxCompute应用限制整理

大数据计算 MaxCompute

热门文章

最新文章

相关产品

相关课程

相关电子书

相关实验场景