dataworks的并发设置多少比较合适?

dataworks的并发设置多少比较合适?

展开
收起
真的很搞笑 2023-09-12 16:24:13 185 分享 版权
1 条回答
写回答
取消 提交回答
  • Q:并发设置多少比较合适?速度慢时增加并发有用吗?A:数据导入进程默认JVM的堆大小是2GB,并发(channel数)是通过多线程实现的,开过多的线程有时并不能提高导入速度,反而可能因为过于频繁的GC导致性能下降。一般建议并发数(channel)为5-10。Q:batchSize设置多少比较合适?A:默认是256,但应根据每行的大小来计算最合适的batchSize。通常一次操作的数据量在2MB~4MB左右,用该值除以行大小,即可得到batchSize。
    https://help.aliyun.com/document_detail/137758.html
    ,此回答整理自钉群“DataWorks交流群(答疑@机器人)”

    2023-09-12 22:19:21
    赞同 展开评论

DataWorks基于MaxCompute/Hologres/EMR/CDP等大数据引擎,为数据仓库/数据湖/湖仓一体等解决方案提供统一的全链路大数据开发治理平台。

还有其他疑问?
咨询AI助理