Ubuntu环境下eclipse的hadoop开发

在安装好hadoop伪分布式后，开始搭建eclipse的hadoop开发环境

我的版本信息如下：

Ubuntu 版本 12.10

Hadoop版本 1.2.1

Java版本 1.6.0_31（命令java -version）

于2014年8月1日安装成功

1.安装Eclipse

调用我写的这篇博客点击打开链接

2.复制eclipse_hadoop插件

在网上下载hadoop-1.2.1-eclipse-plugin.jar插件（插件版本一定要与hadoop的版本匹配,否则无法成功启动）后复制到eclipse/plugins目录下，重启eclipse

3.安装成功的表现

第一在open perspective >other里

有mapreduce

第二在 windows -> preferences里面会多一个hadoop
map/reduce的选项，

4.在终端（terminal）启动hadoop

先切换用户

naomi@ubuntu:~$ su hadoop

输入密码

Password:

转到hadoop目录下

hadoop@ubuntu:/home/naomi$ cd /usr/local/hadoop

启动所有东东

hadoop@ubuntu:/usr/local/hadoop$bin/start-all.sh

这一步不做就无法连接到hadoop

5.配置参数

点击这个蓝大象就会new hadoop location

可以发现很多都是默认填好的，不需要去改，更不需要去查安装时的配置文件，在这个设置页面中，你只需要填两项

1.location name 随便取名字

2.确认user name一定是hadoop(安装hadoop时的用户),如果不是hadoop,而是root或其他用户，必须退出以hadoop用户的身份启动eclipse（若此时启动eclipse出错参见我的另一篇博客 http://blog.csdn.net/unflynaomi/article/details/38340383 ），否则出错

然后选择上面的advanced parameter选项卡

改这两项即可，其他不动这两个参数在“hadoop/conf/core-site.xml”进行了配置,可以查看

点击ok

6.加载hdfs文件系统

配置完后，就在左面有了hdfs文件系统了

如果没有出来那么一定参数配置错误选择

edit hadoop location即可重新编辑

7.创建工程

File
-> New -> Project 选择“Map/Reduce Project”，然后输入项目名称，创建项目。插件会自动把hadoop根目录和lib目录下的所有jar包导入。

8.添加wordcount class

在工程上右键，new class即可，class名字为wordcount

9.运行mapreduce

源代码为：

package com.baison.action;

import org.apache.hadoop.fs.Path;

import org.apache.hadoop.io.Text;

import org.apache.hadoop.io.LongWritable;

import org.apache.hadoop.mapred.FileInputFormat;

import org.apache.hadoop.mapred.FileOutputFormat;

import org.apache.hadoop.mapred.JobClient;

import org.apache.hadoop.mapred.JobConf;

import org.apache.hadoop.mapred.lib.TokenCountMapper;

import org.apache.hadoop.mapred.lib.LongSumReducer;

public class WordCount {

    public static void main(String[] args) {

        JobClient client = new JobClient();

        JobConf conf = new JobConf(WordCount.class);

        String[] arg = { "hdfs://localhost:9000/user/hadoop/input",  

                "hdfs://localhost:9000/user/hadoop/output3" };  //这句指明了输入输出文件，input文件夹下所有文件都是输入文件，输出目录不可重复

        FileInputFormat.addInputPath(conf, new Path(arg[0]));

        FileOutputFormat.setOutputPath(conf, new Path(arg[1]));

        conf.setOutputKeyClass(Text.class);

        conf.setOutputValueClass(LongWritable.class);

        conf.setMapperClass(TokenCountMapper.class);

        conf.setCombinerClass(LongSumReducer.class);

        conf.setReducerClass(LongSumReducer.class);

        client.setConf(conf);

        try {

            JobClient.runJob(conf);

        } catch (Exception e) {

            e.printStackTrace();

        }

    }

}

Run As -> Run on Hadoop

部分运行过程如下

14/08/01 10:36:27 INFO mapred.JobClient: Total committed heap usage (bytes)=3001692160

14/08/01 10:36:27 INFO mapred.JobClient: CPU time spent (ms)=0

14/08/01 10:36:27 INFO mapred.JobClient: Map input bytes=34768

14/08/01 10:36:27 INFO mapred.JobClient: SPLIT_RAW_BYTES=2074

14/08/01 10:36:27 INFO mapred.JobClient: Combine input records=3452

14/08/01 10:36:27 INFO mapred.JobClient: Reduce input records=1654

14/08/01 10:36:27 INFO mapred.JobClient: Reduce input groups=871

14/08/01 10:36:27 INFO mapred.JobClient: Combine output records=1654

14/08/01 10:36:27 INFO mapred.JobClient: Physical memory (bytes) snapshot=0

14/08/01 10:36:27 INFO mapred.JobClient: Reduce output records=871

14/08/01 10:36:27 INFO mapred.JobClient: Virtual memory (bytes) snapshot=0

14/08/01 10:36:27 INFO mapred.JobClient: Map output records=3452

部分运行结果如下：（可以直接在eclipse中查看）

"". 4

"*" 10

"AS 6

"License"); 6

"alice,bob 10

"console" 2

"hadoop.root.logger". 2

"jks". 4

圆满成功

本文部分参考http://blog.csdn.net/xiaotom5/article/details/8080595#

Ubuntu环境下eclipse的hadoop开发的更多相关文章

ubuntu环境下eclipse的安装以及hadoop插件的配置
ubuntu环境下eclipse的安装以及hadoop插件的配置一.eclipse的安装在ubuntu桌面模式下,点击任务栏中的ubuntu软件中心,在搜索栏搜索eclipse 注意:安装过程需要 ...
在windows环境中用eclipse搭建hadoop开发环境
1. 整体环境和设置 1.1 hadoo1.0.4集群部署在4台VMWare虚拟机中,这四台虚拟机都是通过NAT模式连接主机集群中/etc/hosts文件配置 #本机127.0.0.1 localh ...
在ubuntu下使用Eclipse搭建Hadoop开发环境
一.安装准备1.JDK版本:jdk1.7.0(jdk-7-linux-i586.tar.gz)2.hadoop版本:hadoop-1.1.1(hadoop-1.1.1.tar.gz)3.eclipse ...
Windows下搭建Spark+Hadoop开发环境
Windows下搭建Spark+Hadoop开发环境需要一些工具支持. 只需要确保您的电脑已装好Java环境,那么就可以开始了. 一. 准备工作 1. 下载Hadoop2.7.1版本(写Spark和H ...
mac10.9下eclipse的storm开发环境搭建
--------------------------------------- 博文作者:迦壹博客地址:http://idoall.org/home.php?mod=space&uid=1& ...
windows环境下Eclipse开发MapReduce程序遇到的四个问题及解决办法
按此文章<Hadoop集群(第7期)_Eclipse开发环境设置>进行MapReduce开发环境搭建的过程中遇到一些问题,饶了一些弯路,解决办法记录在此: 文档目的: 记录windows环 ...
ubuntu环境配置eclipse+opencv
blockquote { direction: ltr; color: rgb(0, 0, 0) } blockquote.western { font-family: "Liberatio ...
Ubuntu环境下配置Android Studio【转】
本文转载自:https://www.jianshu.com/p/1f6295f9c955 之前学习Android开发的时候,一直跟各种教程一样,使用的是Eclipse+ADT,主要是比较方便,容易上手 ...
Linux(Ubuntu)环境下使用Fiddler
自己的开发环境是Ubuntu, 对于很多优秀的软件但是又没有Linux版本这件事,还是有点遗憾的.比如最近遇到一个问题,在分析某个网站的请求路径和cookie时就遇到了问题.本来Chome浏览器自带的 ...

随机推荐

apache与tomcat负载集群的3种方法
花了两天时间学习apache与tomcat的集成方法,现在把学习成果记录下来. apache与tomcat负载集群集成方法有3种jk.jk_proxy.http_proxy 本次集成使用的软件版本: ...
xcode 运行报错 Command /usr/bin/codesign failed with exit code 1
因为更换了证书,导致在运行时报错 Command /usr/bin/codesign failed with exit code 1,查看了网上各种方法,最后发现以下两个值没有同步更新
对git的初步认识
虽然经常听说博客,但是却是第一次用.就像,虽然经常见电脑,但是却第一次接触软件.对于git也是一样,从来没听过,更不了解. 因为自己私下也没有去过多的了解,所以对于git只有一些有关书面资料的很片面的 ...
bzoj 2761 平衡树
裸地平衡树,只需要用到find操作 /************************************************************** Problem: U ...
【BZOJ】【3522】【POI2014】Hotel
暴力/树形DP 要求在树上找出等距三点,求方案数,那么用类似Free Tour2那样的合并方法,可以写出: f[i][j]表示以 i 为根的子树中,距离 i 为 j 的点有多少个: g[i][j]表示 ...
浅谈KL散度
一.第一种理解相对熵(relative entropy)又称为KL散度(Kullback–Leibler divergence,简称KLD),信息散度(information divergence) ...
mongo 1067错误
对mongo进行错误的操作导致mongo服务异常关闭,当重启mongo服务时出现1067错误此时在data目录下产生mongod.lock文件,可以讲此文件删除,然后重启就可以了 Please mak ...
TestDriven.Net
转: http://www.cnblogs.com/AlexLiu/archive/2008/12/01/1345002.html
[转载]Thread.Sleep(0)妙用
原文地址:http://blog.csdn.net/lgstudyvc/article/details/9337063 来自本论坛: 我们可能经常会用到 Thread.Sleep 函数来使线程挂起一段 ...
oom日志查看
这通常会触发 Linux 内核里的 Out of Memory (OOM) killer,OOM killer 会杀掉某个进程以腾出内存留给系统用,不致于让系统立刻崩溃.如果检查相关的日志文件(/va ...

Ubuntu环境下eclipse的hadoop开发

Ubuntu环境下eclipse的hadoop开发的更多相关文章

随机推荐

热门专题