开发者社区 问答 正文

Shuffle后续优化方向是什么?

Shuffle后续优化方向是什么?

展开
收起
芯在这 2021-12-07 17:39:28 290 分享 版权
1 条回答
写回答
取消 提交回答
  • Shuffle过程的主要存储介质是磁盘,尽量的减少IO是Shuffle的主要优化方向。我们脑海中都有那个经典的存储金字塔体系,Shuffle过程为什么把结果都放在磁盘上,那是因为现在内存再大也大不过磁盘,内存就那么大,还这么多张嘴吃,当然是分配给最需要的了。如果具有“土豪”内存节点,减少Shuffle IO的最有效方式无疑是尽量把数据放在内存中。下面列举一些现在看可以优化的方面,期待经过我们不断的努力,TDW计算引擎运行地更好。

    2021-12-07 17:39:47
    赞同 展开评论
问答地址: