开发者社区 问答 正文

RSS在小米的落地过程中,小米是如何做的?

RSS在小米的落地过程中,小米是如何做的?

展开
收起
游客tbwjb5xynyh2u 2022-05-08 17:34:56 421 分享 版权
来自: 阿里技术
1 条回答
写回答
取消 提交回答
  • 在落地的过程,小米主导了磁盘容错的开发,大大提高了RSS的服务稳定性,在前期RSS还未完全稳定阶段,小米在多个环节对RSS的作业进行了容错。在调度端,若开启RSS的Spark作业因Shuffle报错,则Yarn的下次重试会回退到ESS。在ShuffleWriter初始化阶段,小米主导了自适应Fallback机制,根据当前RSS集群的负载和作业的特征(如Reducer并发是否过大)自动选择RSS或ESS,从而提升稳定性。

    2022-05-09 16:43:24
    赞同 展开评论
问答地址: