hbase 从hbase上读取数据写入到hdfs

Mapper

 package cn.hbase.mapreduce.hb2hdfs;

 import java.io.IOException;

 import org.apache.hadoop.hbase.client.Result;

 import org.apache.hadoop.hbase.io.ImmutableBytesWritable;

 import org.apache.hadoop.hbase.mapreduce.TableMapper;

 /**

  *

  * @author Tele

  *

  * 输出key 行键 输出out 读出的一行数据

  */

 public class ReadFruitFromHbMapper extends TableMapper<ImmutableBytesWritable, Result> {

     @Override

     protected void map(ImmutableBytesWritable key, Result value, Context context)

             throws IOException, InterruptedException {

         context.write(key, value);

     }

 }

Reducer

 package cn.hbase.mapreduce.hb2hdfs;

 import java.io.IOException;

 import org.apache.hadoop.hbase.Cell;

 import org.apache.hadoop.hbase.CellScanner;

 import org.apache.hadoop.hbase.CellUtil;

 import org.apache.hadoop.hbase.client.Result;

 import org.apache.hadoop.hbase.io.ImmutableBytesWritable;

 import org.apache.hadoop.hbase.util.Bytes;

 import org.apache.hadoop.io.NullWritable;

 import org.apache.hadoop.io.Text;

 import org.apache.hadoop.mapreduce.Reducer;

 /**

  *

  * @author Tele

  *

  */

 public class WriteFruit2HdfsReducer extends Reducer<ImmutableBytesWritable, Result, NullWritable, Text> {

     @Override

     protected void reduce(ImmutableBytesWritable key, Iterable<Result> values, Context context)

             throws IOException, InterruptedException {

         for (Result result : values) {

             CellScanner scanner = result.cellScanner();

             while (scanner.advance()) {

                 Cell cell = scanner.current();

                 Text text = new Text();

                 // 封装数据

                 String row = Bytes.toString(CellUtil.cloneRow(cell)) + "\t";

                 String cf = Bytes.toString(CellUtil.cloneFamily(cell)) + "\t";

                 String cn = Bytes.toString(CellUtil.cloneQualifier(cell)) + "\t";

                 String value = Bytes.toString(CellUtil.cloneValue(cell)) + "\t";

                 StringBuffer buffer = new StringBuffer();

                 buffer.append(row).append(cf).append(cn).append(value);

                 text.set(buffer.toString());

                 // 写出

                 context.write(NullWritable.get(), text);

             }

         }

     }

 }

Runner

 package cn.hbase.mapreduce.hb2hdfs;

 import org.apache.hadoop.conf.Configuration;

 import org.apache.hadoop.conf.Configured;

 import org.apache.hadoop.fs.Path;

 import org.apache.hadoop.hbase.HBaseConfiguration;

 import org.apache.hadoop.hbase.client.Result;

 import org.apache.hadoop.hbase.client.Scan;

 import org.apache.hadoop.hbase.io.ImmutableBytesWritable;

 import org.apache.hadoop.hbase.mapreduce.TableMapReduceUtil;

 import org.apache.hadoop.io.NullWritable;

 import org.apache.hadoop.io.Text;

 import org.apache.hadoop.mapreduce.Job;

 import org.apache.hadoop.mapreduce.lib.output.FileOutputFormat;

 import org.apache.hadoop.util.Tool;

 import org.apache.hadoop.util.ToolRunner;

 /**

  *

  * @author Tele

  *

  */

 public class FruitRunner extends Configured implements Tool {

     public int run(String[] args) throws Exception {

         System.setProperty("HADOOP_USER_NAME", "tele");

         // 实例化job

         Job job = Job.getInstance(this.getConf());

         // 设置jar

         job.setJarByClass(FruitRunner.class);

         // 设置缓存行键

         Scan scan = new Scan();

         scan.setCaching(300);

 　　　　　　

         // 组装mapper

         TableMapReduceUtil.initTableMapperJob("fruit", scan, ReadFruitFromHbMapper.class, ImmutableBytesWritable.class,

                 Result.class, job);

         // 组装reuder

         job.setReducerClass(WriteFruit2HdfsReducer.class);

         job.setOutputKeyClass(NullWritable.class);

         job.setOutputValueClass(Text.class);

         FileOutputFormat.setOutputPath(job, new Path("/outputfruit"));

         // reduce个数

         job.setNumReduceTasks(1);

         // 提交

         return job.waitForCompletion(true) ? 0 : 1;

     }

     public static void main(String[] args) throws Exception {

         Configuration conf = HBaseConfiguration.create();

         ToolRunner.run(conf, new FruitRunner(), args);

     }

 }

hbase 从hbase上读取数据写入到hdfs的更多相关文章

从PCI上读取数据线程和定时器效率
从PCI上读取数据线程和定时器效率线程: mythread=AfxBeginThread(StartContinuous,(LPVOID)1,THREAD_PRIORITY_NORMAL,0,CR ...
flume学习（三）：flume将log4j日志数据写入到hdfs（转）
原文链接:flume学习(三):flume将log4j日志数据写入到hdfs 在第一篇文章中我们是将log4j的日志输出到了agent的日志文件当中.配置文件如下: tier1.sources=sou ...
Flink 使用（一）——从kafka中读取数据写入到HBASE中
1.前言本文是在<如何计算实时热门商品>[1]一文上做的扩展,仅在功能上验证了利用Flink消费Kafka数据,把处理后的数据写入到HBase的流程,其具体性能未做调优.此外,文中并未就 ...
Redis 中文入库成功，读取数据写入文件乱码问题
近期须要用到redis ,可是在编码这个问题上,纠结了非常久. 需求 :每天一个进程将中文文件入库到redis中(不定时更新) ,另外几个进程读取redis中的信息 ,并处理数据结果.使 ...
《程序实现》从xml、txt文件里读取数据写入excel表格
直接上码 import java.io.BufferedReader; import java.io.DataInputStream; import java.io.File; import java ...
hbase 从hdfs上读取数据到hbase中
<dependencies> <dependency> <groupId>org.apache.hbase</groupId> <artifact ...
通过POI实现上传EXCEL的批量读取数据写入数据库
最近公司新增功能要求导入excel,并读取其中数据批量写入数据库.于是就开始了这个事情,之前的文章,记录了上传文件,本篇记录如何通过POI读取excel数据并封装为对象上传. 上代码: 1.首先这是一 ...
java读取数据写入txt文件并将读取txt文件写入另外一个表
package com.xsw.test; import java.io.BufferedReader; import java.io.BufferedWriter; import java.io.F ...
用kettle从mysql中使用存储过程读取数据写入到sqlserver数据库
1.mysql存储过程,可以实现动态表读取,满足较为复杂的业务逻辑 DROP PROCEDURE if exists p_get_car_trace; delimiter // CREATE PROC ...

随机推荐

oracle-function 练习
/* *scm_iss.test_imti_fun2 *带有输入參数的Function */ CREATE OR REPLACE FUNCTION TEST_IMTI_FUN2(P_NO IN NUM ...
配置PL/SQL Developer连接server数据库
配置PL/SQL Developer连接server数据库远程应用server上安装client客户端软件,可在oracle官网上下载. 举例: 环境应用server操作系统 WIN 7 本地地址 ...
从大整数乘法的实现到 Karatsuba 快速算法
Karatsuba 快速乘积算法是具有独特合并过程(combine/merge)的分治算法(Karatsuba 是俄罗斯人).此算法主要是对两个整数进行相乘,并不适用于低位数(如 int 的 32 位 ...
css结构设计思想
本文摘自博客园-予沁安的文章:结构化CSS设计思维,作为学习笔记记录一下 1.LESS.SASS等预处理器给CSS开发带来了语法的灵活和便利,其本身却没有给我们带来结构化设计思维.很少有人讨论CSS的 ...
【例题 6-11 UVA-297】Quadtrees
[链接] 我是链接,点我呀:) [题意] 在这里输入题意 [题解] 发现根本不用存节点信息. 遇到了叶子节点且为黑色,就直接覆盖矩阵就好(因为是并集); [代码] #include <bits/ ...
php课程 10-34 目录遍历中的注意事项是什么
php课程 10-34 目录遍历中的注意事项是什么一.总结一句话总结:用scandir,会把目录和文件放到一个数组中. 1.移动文件怎么实现,php里面没有移动文件这个函数? 先复制,再删除 2 ...
[TypeScript] The Basics of Generics in TypeScript
It can be painful to write the same function repeatedly with different types. Typescript generics al ...
WindowImplBase::OnSysCommand-------duilib在最大化和还原间切换
virtual LRESULT OnSysCommand(UINT uMsg, WPARAM wParam, LPARAM lParam, BOOL& bHandled) { if( wPar ...
embed-it_Integrator memory compile工具使用之二
embed-it_Integrator memory compile工具使用之二主要内容使用ish接口自动加载memory的cfg文件运行生成memory 脚本内容打开Integrate &am ...
Go语言实战_自己定义OrderedMap
一. 自己定义OrderedMap 在Go语言中.字典类型的元素值的迭代顺序是不确定的.想要实现有固定顺序的Map就须要让自己定义的 OrderedMap 实现 sort.Interface 接口类型 ...

hbase 从hbase上读取数据写入到hdfs

hbase 从hbase上读取数据写入到hdfs的更多相关文章

随机推荐

热门专题