开发者社区> 问答> 正文

Shuffle后续优化方向是什么?

Shuffle后续优化方向是什么?

展开
收起
芯在这 2021-12-07 17:39:28 266 0
1 条回答
写回答
取消 提交回答
  • Shuffle过程的主要存储介质是磁盘,尽量的减少IO是Shuffle的主要优化方向。我们脑海中都有那个经典的存储金字塔体系,Shuffle过程为什么把结果都放在磁盘上,那是因为现在内存再大也大不过磁盘,内存就那么大,还这么多张嘴吃,当然是分配给最需要的了。如果具有“土豪”内存节点,减少Shuffle IO的最有效方式无疑是尽量把数据放在内存中。下面列举一些现在看可以优化的方面,期待经过我们不断的努力,TDW计算引擎运行地更好。

    2021-12-07 17:39:47
    赞同 展开评论 打赏
问答地址:
问答排行榜
最热
最新

相关电子书

更多
图计算优化技术探索 立即下载
数据带来无限可能 立即下载
Blade优化技术在广告计算中的应用优化 立即下载