开发者社区 问答 正文

hadoop怎么样实现二级排序?

hadoop怎么样实现二级排序?

展开
收起
芯在这 2021-12-06 00:02:18 407 分享 版权
1 条回答
写回答
取消 提交回答
  • 在MapReduce中本身就会对我们key进行排序,所以我们要对value进行排序,主要思想为将key和部分value拼接成一个组合key(实现WritableComparable接口或者调用 setSortComparatorClass函数),这样reduce获取的结果便是先按key排序,后按value排序的结果,在这个方法中,用户需 要自己实现Paritioner,继承Partitioner<>,以便只按照key进行数据划分。Hadoop显式的支持二次排序,在Configuration类中有个 setGroupingComparatorClass()方法,可用于设置排序group的key值。

    2021-12-06 00:02:46
    赞同 展开评论
问答分类:
问答标签:
问答地址: