开发者社区> 问答> 正文

为了应对当前分布式训练的挑战,阿里云机器学习PAI团队自主研发了什么训练框架?

为了应对当前分布式训练的挑战,阿里云机器学习PAI团队自主研发了什么训练框架?

展开
收起
罗鹏大佬 2022-04-20 10:44:56 3265 0
来自:阿里技术
1 条回答
写回答
取消 提交回答
  • 阿里云机器学习PAI团队自主研发了分布式训练框架EPL,将不同并行化策略进行统一抽象、封装,在一套分布式训练框架中支持多种并行策略。同时,EPL提供简洁易用的接口,用户只需添加几行annotation(注释)即可完成并行策略的配置,不需要改动模型代码。EPL也可以在用户无感的情况下,通过进行显存、计算、通信等全方位优化,打造高效的分布式训练框架。

    2022-04-20 13:26:45
    赞同 展开评论 打赏
来源圈子
更多
收录在圈子:
+ 订阅
问答排行榜
最热
最新

相关电子书

更多
我看分布式系统架构设计和阿里实践 立即下载
PAI分布式机器学习平台 立即下载
银行分布式核心系统建设实践 立即下载