標籤:spark用java實現二次排序的自訂key
本人在研究Spak,最近看了很多網上的對於SPARK用Java實現二次排序的方法,對於自訂key的做法 基本上都是實現Ordered<>介面,重寫$greater、$greater$eq、$less、$less$eq、compare、compareTo方法,定義hashCode、equals·····
感覺好麻煩,其實我們自訂key只是用了裡面的compareTo方法,其他的$greater、$greater$eq、$less、$less$eq、compare 不用做任何改動,hashCode、equals方法也是不需要的,不知道為什麼大家都喜歡寫的那麼複雜,而且其實我們根本不用實現Ordered<>介面,只要實現Comparable<T>介面重寫compareTo方法就行了,很簡潔,以下是我的自訂key:
import java.io.Serializable;
import scala.math.Ordered;
/**
* 自訂的二次排序key
*/
public class SecondarySortKey implements Comparable<SecondarySortKey>,Serializable {
private static final long serialVersionUID = -2366006422945129991L;
private int first;
private int second;
public SecondarySortKey(int first, int second) {
this.first = first;
this.second = second;
}
@Override
public int compareTo(SecondarySortKey other) {
if(this.first - other.getFirst() != 0) {
return this.first - other.getFirst();
} else {
return this.second - other.getSecond();
}
}
public int getFirst() {
return first;
}
public void setFirst(int first) {
this.first = first;
}
public int getSecond() {
return second;
}
public void setSecond(int second) {
this.second = second;
}
}
測試過沒有問題。我不知道是我理解不夠深徹還是大家故意把Java自訂key的方法寫複雜點以體現出scala的簡潔和優美(哈哈哈),如果有沒考慮到的地方敬請指教!!!
本文出自 “小淩的世界” 部落格,請務必保留此出處http://beyond520.blog.51cto.com/10540356/1920267
Spark用Java實現二次排序的自訂key