Hadoop分布式安装

一、安装准备

1、下载hadoop，地址：http://hadoop.apache.org/,下载相应版本

2、下载JDK版本：Hadoop只支持1.6以上，地址：http://www.oracle.com/technetwork/java/javase/downloads/index.html

3、操作系统：Linux

4、四台机器，192.168.1.211（master）， 192.168.1.212（slave），192.168.1.213（slave），192.168.1.214（slave）

二、安装操作

1、在所有机器安装jdk

2、在所有机器创建Hadoop用户及用户组

groupadd -g 55 hadoop

useradd -g 55 hadoop

3、上传解压Hadoop包，对Hadoop文件的拥有者改为hadoop用户和组

tar -zxvf hadoop-1.0.1.tar.gz

sudo chown -R hadoop:hadoop hadoop-1.0.1

4、配置SSH无密码登陆

ssh-keygen -t rsa

生成的密钥对id_rsa，id_rsa.pub，默认存储在.ssh目录下

然后将id_rsa.pub的内容复制到每个机器(也包括本机)的.ssh/authorized_keys文件中，

如果机器上已经有authorized_keys这个文件了，就在文件末尾加上id_rsa.pub中的内容，

如果没有authorized_keys这个文件，直接cp或者scp就好了，

下面的操作假设各个机器上都没有authorized_keys文件。

scp hadoop@192.168.1.211:/home/hadoop/.ssh/authorized_keys ./

5、修改conf/目录下的master文件，内容如下：

192.168.1.211

6、修改conf/目录下的slaves文件，内容如下：

192.168.1.212

192.168.1.213

192.168.1.214



7、修改$HADOOP_HOME/conf/hadoop-env.sh文件的环境变量：

# The java implementation to use. Required.

export JAVA_HOME=/usr/java/jdk1.6.0_27

8、修改$HADOOP_HOME/conf/core-site.xml配置文件，内容如下：

<?xml version="1.0"?>

<?xml-stylesheet type="text/xsl" href="configuration.xsl"?>



<configuration>

<property>

<name>hadoop.tmp.dir</name>

<value>/hadoopdata</value>

<description>A base for other temporary directories.</description>

</property>



<property>

<name>fs.default.name</name>

<value>hdfs://192.168.1.211:9000</value>

<description>The name of the default file system. A URI whose

scheme and authority determine the FileSystem implementation. The

uri's scheme determines the config property (fs.SCHEME.impl) naming

the FileSystem implementation class. The uri's authority is used to

determine the host, port, etc. for a filesystem.</description>

</property>



<property>

<name>dfs.hosts.exclude</name>

<value>excludes</value>

</property>

</configuration>

9、修改$HADOOP_HOME/conf/hdfs-site.xml配置文件，内容如下：

<?xml version="1.0"?>

<?xml-stylesheet type="text/xsl" href="configuration.xsl"?>



<configuration>

<property>

<name>dfs.replication</name>

<value>1</value>

</property>

</configuration>

10、修改$HADOOP_HOME/conf/mapred-site.xml配置文件，内容如下：

<?xml version="1.0"?>

<?xml-stylesheet type="text/xsl" href="configuration.xsl"?>



<configuration>

<property>

<name>mapred.job.tracker</name>

<value>192.168.1.211:9001</value>

<description>The host and port that the MapReduce job tracker runs

at. If "local", then jobs are run in-process as a single map

and reduce task.

</description>

</property>

</configuration>

11、修改/ect/profile配置文件，在末尾追加以下内容，并输入source/etc/profile使之生效：

export JAVA_HOME=/usr/java/jdk1.6.0_27

export JRE_HOME=/usr/java/jdk1.6.0_27/jre

export CLASSPATH=.:$JAVA_HOME/lib:$JRE_HOME/lib:$CLASSPATH

export PATH=$JAVA_HOME/bin:$PATH

export HADOOP_HOME=/home/hadoop/hadoop-1.0.1

export PATH=$HADOOP_HOME/bin:$PATH

export PATH=$PATH:$HIVE_HOME/bin

12、将主控机器上Hadoop分别给节点机器复制一份。

将/ect/profile拷贝到132、133和134机器上。注意profile需要做生效操作。

三、启动/停止hadoop

1、通过shell脚本启动hadoop，可以通过jps命令查看是否启动NameNode、DataNode、secondaryNameNode、JobTracker、TaskTracher

注意：先要进行格式化HDFS文件系统，才能启动NameNode

$HADOOP_HOME/bin/start-all.sh

2、停止hadoop

$HADOOP_HOME/bin/stop-all.sh

四、初始配置

1、格式化HDFS文件系统。进入$HADOOP_HOME/bin目录。执行:hadoop namenode –format

2、在$HADOOP_HOME/bin目录下，执行:hadoop fs -ls /

如果控制台返回结果，表示初始化成功。可以向里面录入数据。

3、通过WEB查看hadoop

查看集群状态 http://192.168.1.211:50070/dfshealth.jsp

查看JOB状态 http://192.168.1.211:50030/jobtracker.jsp

Hadoop分布式安装的更多相关文章

hadoop分布式安装教程（转）
from:http://www.cnblogs.com/xia520pi/archive/2012/05/16/2503949.html 1.集群部署介绍 1.1 Hadoop简介 Hadoop是Ap ...
hadoop分布式安装过程
一.安装准备及环境说明 1.下载hadoop-1.2.1,地址:http://apache.spinellicreations.com/hadoop/common/stable/hadoop-1.2. ...
hadoop分布式安装部署详细视频教程(网盘附配好环境的CentOS虚拟机文件/hadoop配置文件)
参考资源下载:http://pan.baidu.com/s/1ntwUij3视频安装教程:hadoop安装.flvVirtualBox虚拟机:hadoop.part1-part5.rarhadoop文 ...
hadoop 分布式安装
一.虚拟机安装centos7需要显示IPv4地址时设置修改ip addr 中显示ipv4 修改 ONBOOT=no 为 ONBOOT=yes, 同时需要添加HWADDR=00:0c:29:c8:b6 ...
hadoop分布式安装及其集群配置笔记
各机器及角色信息: 共10台机器,hostname与ip地址映射在此不做赘述.此为模拟开发环境安装,所以不考虑将NameNode和SecondaryNameNode安装在同一台机器. 节点角色 na ...
hadoop分布式安装部署具体视频教程(网盘附配好环境的CentOS虚拟机文件/hadoop配置文件)
參考资源下载:http://pan.baidu.com/s/1ntwUij3视频安装教程:hadoop安装.flvVirtualBox虚拟机:hadoop.part1-part5.rarhadoop文 ...
CentOS7 分布式安装 Hadoop 2.8
1. 基本环境 1.1 操作系统操作系统:CentOS7.3 1.2 三台虚拟机 172.20.20.100 master 172.20.20.101 slave1 172.20.20.102 sl ...
hadoop 完全分布式安装
一个完全的hadoop分布式安装至少需要3个zookeeper,3个journalnode,3个datanode,2个namenode组成. 也就是说需要11个节点,但是我云主机有限,只有3个,所以把 ...
hadoop生态圈安装详解（hadoop+zookeeper+hbase+pig+hive）
-------------------------------------------------------------------* 目录 * I hadoop分布式安装 * II zoo ...

随机推荐

OpenShare：前所未有的开放性
客户总是面临一个选择:开放的企业门户产品 vs 封闭的企业门户产品市场上大多数企业门户产品是自成一体的其实也就是封闭的,他们不能和企业目录集成,不能和Exchange集成,不能和SAP集成,不能和L ...
EasyPusher推流服务接口的.NET导出
本文是在使用由 EasyDarwin 团队开发的EasyPusher时导出的C++接口的.NET实现 public class EasyPushSDK { public EasyPushSDK() { ...
Oracle学习笔记4 使用Navicat for Oracle 连接Oracle时出现错误：ORA-28547: connection to server failed, probable Oracle Net admin error
出问题到的机器环境: Oracle 11gR2 64bit Navicat for Oracle 11.0.10 根据网上一些大神的做法及个人的一些推测,总结如下: 问题出现的原因:Navicat与O ...
研究validation插件到现在的感受
1.比较累 2.看了几十个页面参考是有的,要抓住问题的实质,实质在于要改插件代码.因为它本身不提供这个方法. 3.对了,还没有描述这个问题,问题就是再次验证时,成功的样式不消失.解决方法如下: 修改了 ...
【学习笔记】【C语言】变量类型
根据变量的作用域,可以分为: 1.局部变量: 1> 定义:在函数(代码块)内部定义的变量(包括函数的形参) 2> 作用域:从定义变量的那一行开始,一直到代码块结束 3> 生命周期:从 ...
【Unity3D实战】摇摆直升机开发实战（一）
[Unity3D实战]摇摆直升机开发实战(一) 1.点击[Assets],创建[Sprites]和[Resources]文件夹,然后将所需要的素材导入[Sprites]文件夹中. 2.找到[Sprit ...
10 个非常有用的 AngularJS 框架
AngularJS是最流行的开源web app框架.AngularJS被用于解决阻碍单页应用程序开发的各种挑战. 你作为一个AngularJS用户,却不知道一些可以帮助你美化编码的资源?那么一定不能错 ...
javaweb毕业设计
javaweb毕业设计,管理系统设计,Strut2项目,Springmvc项目,javaweb项目学习. 都是可以运行的,(配数据库和论文),都能提供技术咨询,可以修改.欢迎+扣扣396058587咨 ...
《C++Primer中文版》读书笔记——第1章开始
istream对象:cin(标准输入对象); ostream对象:cout(标准输出对象) cerr(输出错误和警告) clog(输出一般性信息) 读取数量不定的输入数据,eg , sum=; whi ...
Winfrom皮肤样式的使用
IrisSkin类库提供了可供我们使用的设置窗体皮肤的类,简单地说,就是给我们提供了一个皮肤引擎,通过设置皮肤引擎来达到我们想要的窗体界面. 具体的开发步骤: (1)引入IrisSkin.dll文件 ...

Hadoop分布式安装

Hadoop分布式安装的更多相关文章

随机推荐

热门专题