开发者社区 问答 正文

Map端和reduce端主要是干什么的?

Map端和reduce端主要是干什么的?

展开
收起
游客ysk6odvtzspxs 2021-12-04 21:01:35 1124 分享 版权
1 条回答
写回答
取消 提交回答
  • Map端的主要工作:为来自不同表(文件)的key/value对打标签以区别不同来源的记录。然后用连接字段(两张表中相同的列)作为key,其余部分和新加的标志作为value,最后进行输出。 reduce端的主要工作:在reduce端以连接字段作为key的分组已经完成,我们只需要在每一个分组当中将那些来源于不同文件的记录(在map阶段已经打标志)分开,最后进行合并就ok了

    2021-12-04 21:02:03
    赞同 展开评论
问答标签:
问答地址: