请简述hadoop怎么样实现二级排序？

i52500 • 2022-11-11 • 随笔 • 阅读 16

请简述hadoop怎么样实现二级排序？

在MapReduce中本身就会对我们key进行排序，所以我们要对value进行排序，主要思想为将key和部分value拼接成一个组合key（实现WritableComparable接口或者调用 setSortComparatorClass函数），这样reduce获取的结果便是先按key排序，后按value排序的结果，在这个方法中，用户需要自己实现Paritioner，继承Partitioner<>,以便只按照key进行数据划分。Hadoop显式的支持二次排序，在Configuration类中有个 setGroupingComparatorClass()方法，可用于设置排序group的key值。

欢迎分享，转载请注明来源：内存溢出

原文地址: http://outofmemory.cn/zaji/4878423.html

排序方法拼接简述调用

打赏

微信扫一扫

支付宝扫一扫

i52500 一级用户组

知道哪些ES6，ES7的语法？

上一篇 2022-11-11

下一篇 2022-11-11

发表评论

登录后才能评论

评论列表（0条）