文档备案控制台

开发者社区问答正文

Spark的SparkContext中执行了哪些子任务呢？

已解决

Spark的SparkContext中执行了哪些子任务呢？

展开

收起

每天一个小bug 2022-08-03 08:51:02 484 版权

版权声明：本文内容由阿里云实名注册用户自发贡献，版权归原作者所有，阿里云开发者社区不拥有其著作权，亦不承担相应法律责任。具体规则请查看《阿里云开发者社区用户服务协议》和《阿里云开发者社区知识产权保护指引》。如果您发现本社区中有涉嫌抄袭的内容，填写侵权投诉表单进行举报，一经查实，本社区将立刻删除涉嫌侵权内容。

1 条回答

写回答

取消提交回答

游客v3kglkpz4ap4i

推荐回答

当客户端向Spark提交一个请求完成某个计算时D river首先创建了一个SparkContext，此时SparkContext还会向CluserManager申请到计算结点Worker ,当得到相关的计算结点后， SparkContext的子任务如下：

1.首先为任务创建一个RDD DAG，即RDD的一个抽象数据集而数据集的转换抽象的依赖关系就在此创建。

2.为DAG安排一个DAGScheduler，负责如何执行一个个DAG任务

3.创建TaskScheduler通过TaskScheduler来将任务交给结点具体的Excutor来完成。

2022-08-03 13:03:56

赞同展开评论

问答分类：

分布式计算 Spark

问答标签：

apache spark执行 apache spark Sparkcontext apache spark sparkcontext子任务

问答地址：

开发者社区 > 大数据 > 问答

相关问答

spark 执行RDD操作中的Lazy Calculate有什么好处吗？

2505

1

0

spark 执行RDD操作的过程要注意什么吗？

2478

1

0

spark 架构在执行时是怎么做并行的？

2559

1

0

spark任务想完整的部署，发布，执行调度，仅仅maxcompute组件权限够么，还需要datawo

998

1

0

spark连接odps，执行insert overwrite报错

1166

1

0

Spark架构的SparkContext有什么用吗？

625

1

0

Spark架构的SparkContext是什么呢？

654

1

0

Spark的SparkContext子任务DAGScheduler做了些什么呢？

467

1

0

Spark架构中的SparkContext是怎么知晓任务完成的呢？

674

1

0

Spark架构的SparkContext里的TaskSchduler是由什么创建的呀？

584

1

0

问答排行榜

最热

最新

【大咖问答】对话PostgreSQL 中国社区发起人之一，阿里云数据库高级专家德哥

据说在家办公的程序员是这样写代码的？

如何升级配置

【藏经阁一起读（27）】本周推荐《Apache Flink案例集（2022版）》，你有哪些心得？

【精品问答】python技术1000问(1)

阿里云服务器多少钱一年？价格贵不贵？有优惠吗？

阿里云服务器问题解答，你关心的问题都在这！

阿里云 ECS 公网 IP有什么更换技巧？

idea 插件，更新记忆规则，经常死机

总是提示您已达到配额使用上限，请升级订阅计划，以获得更多使用资源。问题反馈。但已经购买了资源

相关文章

阿里云EMR大数据集群网站运营数据统计完全实战指南

GPT-5.6 Sol & Subagent 不但聪明，更会分工

AI Slop 图鉴来了，TypeScript 7 快了 10 倍，MiniMax 市值蒸发近四分之三

阿里云大数据 AI 产品月刊-2026年6月

阿里云MaxCompute海量数据离线分析完全指南：从架构原理到性能调优

还有其他疑问?