一、系统环境:

  1. 我使用的Ubuntu版本是:ubuntu-12.04-desktop-i386.iso
  2. jdk版本:jdk1.7.0_67
  3. hadoop版本:hadoop-2.5.0

二、下载jdk和hadoop,并上传到Ubuntu系统中

Vmware中的Linux与主机系统Windows交互文件的方法请参考:http://blog.chinaunix.net/uid-27717694-id-3834143.html

三、设置hadoop用户:

sudo addgroup hadoop #创建hadoop用户组

sudo adduser -ingroup hadoop hadoop #添加hadoop用户到hadoop组中

sudo gedit /etc/sudoers #为hadoop用户添加权限

在root设置权限的代码下添加一行:

hadoopALL=(ALL:ALL) ALL

四、安装ssh,配置无密码登录

  1. 安装ssh-server:sudo apt-get install openssh-server
  2. 配置无密码登录:
ssh-keygen -t ras -P ""
sudo cat ~/.ssh/id_rsa.pub >> authorized_keys
chmod authorized_keys
sudo gedit /etc/ssh/sshd_config
把AuthroziedKeysFile %h/.ssh/authorized_keys这一行注释取消

3. ssh localhost 成功!

五、安装jdk

  1. 在usr/local目录下新建java文件夹,命令行:sudo mkdir /usr/local/java
  2. 把下载到的jdk压缩包拷贝到java文件夹下,命令行:sudo cp ***.tar.gz /usr/local/java
  3. 进入java目录,命令行:cd /usr/local/java
  4. 解压压缩包,命令行:sudo tar -xvf ***.tar.gz
  5. 删除压缩包,命令行:sudo rm ***.tar.gz
  6. 设置jdk环境变量
这里采用全局设置方法,就是修改etc/profile,它是所有用户的共用的环境变量
sudo gedit /etc/profile 打开之后在末尾添加
export JAVA_HOME=/usr/local/java/jdk1..0_67
export JRE_HOME=/usr/local/java/jdk1..0_67/jre
export CLASSPATH=.:$JAVA_HOME/lib/dt.jar:$JAVA_HOME/lib/tools.jar:$JRE_HOME/lib:$CLASSPATH
export PATH=$JAVA_HOME/bin:$PATH source /etc/profile  使profile生效

7. 检验是否安装成功

java -version

成功则显示如下

java version "1.7.0_67"
Java(TM) SE Runtime Environment (build 1.7.0_67-b18)
Java HotSpot(TM) -Bit Server VM (build 24.45-b08, mixed mode)

六、安装Hadoop

  1. 把hadoop源码包拷贝到/home/hadoop目录下,命令行:sudo cp hadoop-2.5.0.tar.gz /home/hadoop
  2. 解压,命令行:sudo tar -xvf hadoop-2.5.0.tar.gz
  3. 配置hadoop环境变量
配置:
sudo gedit /etc/profile 添加:
#HADOOP VARIABLES START
export HADOOP_INSTALL=/home/hadoop/hadoop-2.5.
export PATH=$PATH:$HADOOP_INSTALL/bin
export PATH=$PATH:$HADOOP_INSTALL/sbin
export HADOOP_MAPRED_HOME=$HADOOP_INSTALL
export HADOOP_COMMON_HOME=$HADOOP_INSTALL
export HADOOP_HDFS_HOME=$HADOOP_INSTALL
export YARN_HOME=$HADOOP_INSTALL
export HADOOP_COMMON_LIB_NATIVE_DIR=$HADOOP_INSTALL/lib/native
export HADOOP_OPTS="-Djava.library.path=$HADOOP_INSTALL/lib"
#HADOOP VARIABLES END

4. 配置core-site.xml,包含了Hadoop启动时的配置信息

sudo gedit /etc/hadoop/core-site.xml

<configuration>
<property>
<name>fs.default.name</name>
<value>hdfs://localhost:9000</value>
</property>
</configuration>

5. 配置yarn-site.xml,包含了MapReduce启动时的配置信息

sudo gedit /etc/hadoop/yarn-site.xml

<configuration>
<!-- Site specific YARN configuration properties -->
<property>
<name>yarn.nodemanager.aux-services</name>
<value>mapreduce_shuffle</value>
</property>
<property>
<name>yarn.nodemanager.aux-services.mapreduce.shuffle.class</name>
<value>org.apache.hadoop.mapred.ShuffleHandler</value>
</property>
</configuration>

6. 创建和配置mapred-site.xml

cd /etc/hadoop
cp mapred-site.xml.template mapred-site.xml <configuration>
<property>
<name>mapreduce.framework.name</name>
<value>yarn</value>
</property>
</configuration>

7. 配置hdfs-site.xml

sudo gedit /etc/hadoop/hdfs-site.xml

<configuration>
<property>
<name>dfs.replication</name>
<value></value>
</property>
<property>
<name>dfs.namenode.name.dir</name>
<value>file:/home/hadoop/software/hadoop-2.4./hdfs/name</value>
</property>
<property>
<name>dfs.datanode.data.dir</name>
<value>file:/home/hadoop/software/hadoop-2.4./hdfs/data</value>
</property>
</configuration>

  

  8. 格式化hdfs,命令行:hdfs namenode -format

  9. 启动hadoop

start-dfs.sh:启动NameNode,DataNode,SecondaryNameNode

start-yarn.sh:启动NodeManager,Resourcemanager

七、安装Eclipse

  1. 下载Lunix,下载地址:http://www.eclipse.org/downloads/packages/eclipse-standard-44/lunar
  2. 拷贝Eclipse安装包到/usr/local目录下,命令行:sudo cp eclipse-standard-luna-R-linux-gtk.tar.gz /usr/local
  3. 解压Eclipse安装包,命令行:sudo tar -xvf eclipse-standard-luna-R-linux-gtk.tar.gz
  4. 运行eclipse,命令行:./eclipse

八、配置Eclipse上的hadoop插件:

  1. 下载插件:hadoop-eclipse-kepler-plugin-2.2.0.jar
  2. 拷贝插件到eclipse的plugins目录下,命令行:sudo cp hadoop-eclipse-kepler-plugin-2.2.0.jar /usr/local/eclipse/plugins
  3. 重启eclipse,配置Hadoop installation directory:打开Windows—Preferences,选择Hadoop Map/Reduce选项,设置Hadoop安装路径

九、关闭hadoop环境:

stop-dfs.sh

stop-yarn.sh

在虚拟机VM中安装的Ubuntu上安装和配置Hadoop的更多相关文章

  1. 转载 :Linux有问必答:如何在Debian或Ubuntu上安装完整的内核源码

    http://linux.cn/article-5015-1.html 问题:我需要为我的Debian或Ubuntu下载并安装完整树结构的内核源码以供编译一个定制的内核.那么在Debian或Ubunt ...

  2. [异常解决] ubuntu上安装JLink驱动遇到的坑及给后来者的建议

    一.前言 最近将整个电脑格式化,改成了linux操作系统 希望这样能让自己在一个新的世界探索技术.提升自己吧- win上的工具用多了,就不想变化了- 继上一篇<ubuntu上安装虚拟机遇到的问题 ...

  3. 在Ubuntu上安装JDK、Ant、Jmeter和Jenkins

    一.前期准备 1. 在win7下载VMware.Ubuntu(用迅雷下比较快) 2. 安装完VMware后新建虚拟机,选择iso: 3. 具体配置参考如下,至此Ubantu安装完成 二.在Ubuntu ...

  4. 如何在ubuntu上安装 搜狗输入法(已经成功)

    转自:https://blog.csdn.net/qq_37589838/article/details/81208409 本文链接:https://blog.csdn.net/qq_37589838 ...

  5. 在 Ubuntu 上安装 Android Studio

    在 Ubuntu 上安装 Android Studio http://www.linuxidc.com/Linux/2013-05/84812.htm 打开terminal,输入以下命令 sudo a ...

  6. 在Ubuntu上安装LAMP服务器

    1.安装Ubuntu上安装LAMP apt-get install lamp-server^ 2.安装过程中设置MySql密码 3.测试 创建index.php var/www/html/index. ...

  7. [译]How to Setup Sync Gateway on Ubuntu如何在ubuntu上安装sync-gateway

    参考文章https://hidekiitakura.com/2015/03/21/how-to-setup-sync-gateway-on-ubuntudigitalocean/ 在此对作者表示感谢 ...

  8. Ubuntu上安装MongoDB(译)

    add by zhj:直接从第四步开始就可以了,而且安装好MongoDB后会自动启动的,不必自己去执行启动命令 原文:https://docs.mongodb.com/manual/tutorial/ ...

  9. Ubuntu上安装ns2-2.34

    Ubuntu上安装ns2-2.34 步骤1 下载ns-allinone-2.34 $ tar zxf ns-allinone-2.34.tar.gz 步骤2 sudo apt-get install ...

随机推荐

  1. 纯后台生成highcharts图片有哪些方法?

    比如说,领导抛给你一个需求,把一些数据做成图表,每天通过邮件发送,让领导能在邮件中就看到图片,你会有什么思路呢?本人使用的是phantomjs这个神器,它的内核是WebKit引擎,不提供图形界面,只能 ...

  2. netty httpserver

    netty也可以作为一个小巧的http服务器使用. package com.ming.netty.http.httpserver; import java.net.InetSocketAddress; ...

  3. orzdba在5.6安装

    前言:淘宝的orzdba查看MySQL服务器当前QPS,TPS很方便,但是不少人反应,在5.6原本好用的工具不好用了,频繁出现这样警告: Warning: Using a password on th ...

  4. android4.4.2内核移植3.4.1

    01◑ 内核源码总目录下Makefile文件修改: 195行: ARCH ?= $(SUBARCH)替换成: ARCH ?= arm 02◑ arch/arm下makefile: ①差7行 # tes ...

  5. oracle .bash_profile

    [oracle@redhat4 ~]$ vi .bash_profile # .bash_profile # Get the aliases and functionsif [ -f ~/.bashr ...

  6. 信号量及PV原语

    操作系统中进程互斥和同步的实现的一个最基本的方方是使用信号量和PV原语. 信号量S的物理意义:当S≥0的时候表示,某个资源可以使用的数量,当S<0的时候,其绝对值表示等待某个资源的进程数. 一般 ...

  7. oracle视图总结(转)

    视图简介: 视图是基于一个表或多个表或视图的逻辑表,本身不包含数据,通过它可以对表里面的数据进行查询和修改.视图基于的表称为基表.视图是存储在数据字典里的一条select语句. 通过创建视图可以提取数 ...

  8. 1218. Episode N-th: The Jedi Tournament(bfs)

    1218 简答题 对于当前点 判断每个点是否可达 #include <iostream> #include<cstdio> #include<cstring> #i ...

  9. LinuxShell算术运算

    Bash shell 的算术运算有四种方式:1:使用 expr 外部程式 加法 r=`expr 4 + 5`echo $r注意! '4' '+' '5' 这三者之间要有空白r=`expr 4 * 5` ...

  10. 函数buf_page_init_for_read

    /********************************************************************//** Function which inits a pag ...