hadoop复合键排序使用方法

在hadoop中处理复杂业务时，需要用到复合键，复合不同于单纯的继承Writable接口，而是继承了 WritableComparable<T>接口，而实际上，WritableComparable<T>接口继承了 Writable和Comparable<T>接口，如果只需要使用某一个类作为传值对象而不是作为key，继承Writable接口即可。

上源码：

    public interface WritableComparable<T> extends Writable, Comparable<T> {

    }

public interface Writable {  

  void write(DataOutput out) throws IOException;  

  void readFields(DataInput in) throws IOException;

}

    public interface Comparable<T> {  

        public int compareTo(T o);

    }

以下是实现复合key的实例：

public class SortKey implements WritableComparable<SortKey>{  

    private Text name;

    private IntWritable right;  

    public SortKey() {

        set(new Text(), new IntWritable());

    }  

    public SortKey(Text name, IntWritable right) {

        set(name, right);

    }  

    private void set(Text name,IntWritable right){

        this.name = name;

        this.right = right;

    }  

    /**

     * @return the name

     */

    public Text getName() {

        return name;

    }  

    /**

     * @param name the name to set

     */

    public void setName(Text name) {

        this.name = name;

    }  

    /**

     * @return the right

     */

    public IntWritable getRight() {

        return right;

    }  

    /**

     * @param right the right to set

     */

    public void setRight(IntWritable right) {

        this.right = right;

    }  

    @Override

    public void write(DataOutput out) throws IOException {

        name.write(out);

        right.write(out);

    }  

    @Override

    public void readFields(DataInput in) throws IOException {

        name.readFields(in);

        right.readFields(in);

    }  

    @Override

    public int compareTo(SortKey o) {

        int cmp = name.compareTo(o.name);

        if(cmp != 0){

            return cmp;

        }else{

            return right.compareTo(o.right);

        }

    }

    <span style="white-space:pre">    </span>//到目前为止，你只能将其作为key来使用，但是如果你需要按照key的某一个值来排序，以下是重点

static{

        WritableComparator.define(SortKey.class, new Comparator());

    }  

    public static class Comparator extends WritableComparator{  

        private static final Text.Comparator TEXT_COMPARATOR = new Text.Comparator();  

        protected Comparator() {

            super(SortKey.class);

        }  

        /* (non-Javadoc)

         * @see org.apache.hadoop.io.WritableComparator#compare(byte[], int, int, byte[], int, int)

         */

        @Override

        public int compare(byte[] b1, int s1, int l1, byte[] b2, int s2, int l2) {

            try{

                int firstL1 = WritableUtils.decodeVIntSize(b1[s1]) + readVInt(b1, s1);

                int firstL2 = WritableUtils.decodeVIntSize(b2[s2]) + readVInt(b2, s2);

                return TEXT_COMPARATOR.compare(b1, s1, firstL1, b2, s2, firstL2);

            }catch(Exception e){

                throw new IllegalArgumentException(e);

            }

        }

    }  

}

hadoop复合键排序使用方法的更多相关文章

python 字典分别根据值或键进行排序的方法
最近经常遇到根据字母出现的频率进行排序的题目我的思路一般是借用字典统计字母出现的频率然后对字典按照值进行排序但是每次按照值进行排序时都会忘记排序方法在此记录一下,以加深印象字典原始值如下: ...
一起学Hadoop——二次排序算法的实现
二次排序,从字面上可以理解为在对key排序的基础上对key所对应的值value排序,也叫辅助排序.一般情况下,MapReduce框架只对key排序,而不对key所对应的值排序,因此value的排序经常 ...
hadoop MapReduce辅助排序解析
1.数据样本,w1.csv到w5.csv,每个文件数据样本2000条,第一列是年份从1990到2000随机,第二列数据从1-100随机,本例辅助排序目标是找出每年最大值,实际上结果每年最大就是100, ...
Hadoop之WritableComprale 排序
Hadoop之WritableComprale 排序 Hadoop只对key进行排序排序是 MapReduce 框架中最重要的操作之一.Map Task 和 Reduce Task 均会对数据(按照 ...
使 SortList 实现重复键排序
SortList 默认对按Key来排序,且Key值不能重复,但有时可能需要用有重复值的Key来排序,以下是实现方式: 1.对强类型:以float为例 #region 使SortList能对重复键排序 ...
2 weekend110的hadoop的自定义排序实现 + mr程序中自定义分组的实现
我想得到按流量来排序,而且还是倒序,怎么达到实现呢? 达到下面这种效果, 默认是根据key来排, 我想根据value里的某个排, 解决思路:将value里的某个,放到key里去,然后来排下面,开始w ...
MySQL删除外键定义的方法
MySQL外键在定以后,如果我们不再需要这个外键,可以进行删除操作,下面就为您介绍MySQL删除外键定义的方法,供您参考. 不知道大家有没有发现,在定义外键的时候articles.member_id外 ...
discuz x2 个人资料项排序问题解决方法、添加自定义字段、修改栏目名称和介绍
第一次写文章,希望与人提供方便同时,别误人子弟,自己研究的,大家看不懂只改文件就可以了,如果发现不对的地方请回复或直接通知我,谢谢,本来想在discuz论坛上发的,不懂版规也没时间看版规,怕发错,隔小 ...
Oracle中中文、数字,英文混杂形式的字段进行排序的方法
http://blog.csdn.net/p451933505/article/details/9272257 对Oracle中中文.数字.英文混杂形式的字段进行排序的方法: 例如: order by ...

随机推荐

iOS字符串处理
拼接字符串 NSString* string; NSString* string1, string2; //方法1. string = [NSString initWithFormat:@" ...
Centos6.5安装python2.7与pip
安装Python2.7 安装环境 [root@localhost1 ~]# cat /etc/redhat-release CentOS release 6.5 (Final) [root@local ...
Linux之Shell 脚本加密工具-shc
Much effort, much prosperity. 为什么要加密Shell脚本呢?当然是为了安全! 可能脚本里面涉及到密码之类的就需要进行加密了一.下载安装shc工具要保护自己编写的she ...
ubuntu16.04的anacoda内置的spyder不支持中文【学习笔记】
执行下面的语句:将libfcitxplatforminputcontextplugin.so复制到anaconda2的安装目录下的platforminputcontexts目录重启生效 cp /usr ...
AtCoder Regular Contest 102
AtCoder Regular Contest 102 C - Triangular Relationship 题意: 给出n,k求有多少个不大于n的三元组,使其中两两数字的和都是k的倍数,数字可以重 ...
EF Code-First 学习之旅配置一对一的关系
1对1.1对0 的关系例如:Entity1与零个或一个Entity2的实例有关系 public class Student { public Student() { } public int Stu ...
报错HTTP Status 500 - Unable to instantiate Action
报错如下: HTTP Status 500 - Unable to instantiate Action, visitAction, defined for 'visit_toAddPage' in ...
入门教程：.NET开源OpenID Connect 和OAuth解决方案IdentityServer v3 创建简单的OAuth2.0服务器，客户端和API（三）
本教程的目的在于创造尽可能简单的identityserver安装作为一个oauth2授权服务器.这应该能够让你了解一些基本功能和配置选项(完整的源代码可以发现在这里).在后面的文档中会介绍更多的高级功 ...
Isilon
Isilon编辑本词条缺少信息栏,补充相关内容使词条更完整,还能快速升级,赶紧来编辑吧! 美国Isilon公司是全球群集存储系统的主要供应商,是该领域的领导者.总部位于美国华盛顿州的西雅图.创建于2 ...
redis memcache rabbitMQ
Python之路[第九篇]:Python操作 RabbitMQ.Redis.Memcache.SQLAlchemy Memcached Memcached 是一个高性能的分布式内存对象缓存系统,用于动 ...

hadoop复合键排序使用方法

hadoop复合键排序使用方法的更多相关文章

随机推荐

热门专题