一个4节点Hadoop集群的配置示例

环境：

操作系统：CentOS 6.5 64bit

Hadoop：Version 1.2.1

Servers：hadoopnamenode，hadoop2ndnamenode，hadoopdatanode1，hadoopdatanode2

注：为方便起见，在这4台server上，我都直接使用root账户进行操作

下载及环境变量设置：

在所有4台server上：

从Apache网站下载hadoop-1.2.1-bin.tar.gz，解压后放置在某个目录下，我放在了/usr/local下，为方便起见，我把目录hadoop-1.2.1改名为hadoop。

修改.bashrc，添加下面的环境变量：

export HADOOP_PREFIX=/usr/local/hadoop

export PATH=$PATH:$HADOOP_PREFIX/bin

配置hosts文件：

在/etc/hosts中添加：

153.65.170.11 hadoopnamenode

153.65.170.45 hadoop2ndnamenode

153.65.171.174 hadoopdatanode1

153.65.171.24 hadoopdatanode2

配置ssh：

在hadoopnamenode上执行：

ssh-keygen//生成公钥、私钥

ssh-copy-id   –i   ~/.ssh/id_rsa.pub   root@hadoop2ndnamenode//将hadoopnamenode的公钥copy到其它三台server上

ssh-copy-id   –i   ~/.ssh/id_rsa.pub   root@hadoopdatanode1

ssh-copy-id   –i   ~/.ssh/id_rsa.pub   root@hadoopdatanode2

这么做的目的是可以不需要密码从hadoopnamenode上ssh到其它三台server上。经过ssh-copy-id后，这个公钥实际上会被添加到其它三台server的~/.ssh/authorized_keys文件中。

例如要从hadoopnamenode登录hadoop2ndnamenode，其流程大概是：hadoop2ndnamenode向hadoopnamenode发送一段随机字符串，hadoopnamenode用自己的私钥加密后，再发回来。hadoop2ndnamenode用事先储存的hadoopnamenode公钥进行解密，如果成功，就证明用户是可信的，直接允许登录shell，不再要求密码。

配置Hadoop：

一般地，我们将使用下面的命令启动hdfs（即name node, secondary name node, data node）及MapReduce：

/usr/local/hadoop/bin/start-dfs.sh

/usr/local/hadoop/bin/start-mapred.sh

start-dfs.sh的流程大概是这样：

执行该命令的机器自动成为name node(以及job tracker)，
启动/usr/local/hadoop/conf /slaves中列出的所有机器并作为data node(以及task tracker)，
启动/usr/local/hadoop/conf /masters中列出的所有机器并作为secondary name node。

start-mapred.sh的流程类似：

执行该命令的机器自动成为job tracker，
启动/usr/local/hadoop/conf /slaves中列出的所有机器并作为task tracker

注：conf/masters文件往往给人带来困惑，直观上让人觉得它是为配置name node所用，但是因为(1)的原因，name node是不需要特别配置到conf/masters中，需要配置的只有secondary name node。

根据以上描述，我们可以开始修改hadoopnamenode上的masters文件，删除原内容，添加一行：

hadoop2ndnamenode

修改hadoopnamenode上的slaves文件，删除原内容，添加两行：

hadoopdatanode1

hadoopdatanode2

除此之外，需要在hadoopdatanode1与hadoopdatanode2上作出配置，使得data node知道name node，task tracker知道job tracker。所以分别修改hadoopdatanode1与hadoopdatanode2上的conf/core-site.xml：

<configuration>

<property>

<name>fs.default.name</name>

<value>hdfs://hadoopnamenode:10001</value>

</property>

</configuration>

及conf/mapred-site.xml：

<configuration>

<property>

<name>mapred.job.tracker</name>

<value>hadoopnamenode:10002</value>

</property>

</configuration>

格式化name node：

在hadoopnamenode上执行：

hadoop namenode -format

启动Hadoop：

首先，在hadoopnamenode上执行下面命令来启动所有name node, secondary name node, data node：

start-dfs.sh

可以使用jps命令在4台server上查看当前运行的java进程，正常情况你会看到：

hadoopnamenode上有进程：NameNode

hadoop2ndnamenode上有进程：SecondaryNameNode

hadoopdatanode1/hadoopdatanode2上有进程：DataNode

其次，在hadoopnamenode上执行下面命令来启动所有job tracker, task tracker：

start-mapred.sh

继续使用jps命令在4台server上查看当前运行的java进程，正常情况你会看到：

hadoopnamenode上有进程：NameNode, JobTracker

hadoop2ndnamenode上有进程：SecondaryNameNode

hadoopdatanode1/hadoopdatanode2上有进程：DataNode, TaskTracker

关闭Hadoop：

在hadoopnamenode上：

stop-mapred.sh

stop-dfs.sh

其它：

Name node管理界面：http://hadoopnamenode:50070/

Job tracker 管理界面：http://hadoopnamenode:50030/

一个4节点Hadoop集群的配置示例的更多相关文章

【Big Data】HADOOP集群的配置（一）
Hadoop集群的配置(一) 摘要: hadoop集群配置系列文档,是笔者在实验室真机环境实验后整理而得.以便随后工作所需,做以知识整理,另则与博客园朋友分享实验成果,因为笔者在学习初期,也遇到不少问 ...
【Big Data】HADOOP集群的配置（二）
Hadoop集群的配置(二) 摘要: hadoop集群配置系列文档,是笔者在实验室真机环境实验后整理而得.以便随后工作所需,做以知识整理,另则与博客园朋友分享实验成果,因为笔者在学习初期,也遇到不少问 ...
基于Docker快速搭建多节点Hadoop集群--已验证
Docker最核心的特性之一,就是能够将任何应用包括Hadoop打包到Docker镜像中.这篇教程介绍了利用Docker在单机上快速搭建多节点 Hadoop集群的详细步骤.作者在发现目前的Hadoop ...
Hadoop集群的配置（一）
摘要: hadoop集群配置系列文档,是笔者在实验室真机环境实验后整理而得.以便随后工作所需,做以知识整理,另则与博客园朋友分享实验成果,因为笔者在学习初期,也遇到不少问题.但是网上一些文档大多互相抄 ...
Hadoop的学习前奏（二）——Hadoop集群的配置
前言: Hadoop集群的配置即全然分布式Hadoop配置. 笔者的环境: Linux: CentOS 6.6(Final) x64 JDK: java version "1.7 ...
hadoop 集群的配置
在经过几天折腾,终于将hadoop环境搭建成功,整个过程中遇到各种坑,反复了很多遍,光虚拟机就重新安装了4.5次,接下来就把搭建的过程详细叙述一下 0.相关工具: 1,系统环境说明: 我这边给出我的集 ...
Hadoop集群安装配置教程_Hadoop2.6.0_Ubuntu/CentOS
摘自:http://www.powerxing.com/install-hadoop-cluster/ 本教程讲述如何配置 Hadoop 集群,默认读者已经掌握了 Hadoop 的单机伪分布式配置,否 ...
从VMware虚拟机安装到hadoop集群环境配置详细说明（第一期）
http://blog.csdn.net/whaoxysh/article/details/17755555 虚拟机安装我安装的虚拟机版本是VMware Workstation 8.04,自己电脑上 ...
三节点Hadoop集群搭建
1. 基础环境搭建新建3个CentOS6.5操作系统的虚拟机,命名(可自定)为masternode.slavenode1和slavenode2.该过程参考上一篇博文CentOS6.5安装配置详解 2 ...

随机推荐

深入理解C语言的函数调用过程
本文主要从进程栈空间的层面复习一下C语言中函数调用的具体过程,以加深对一些基础知识的理解. 先看一个最简单的程序: 点击(此处)折叠或打开 /*test.c*/ #include stdio. ...
HTML之表单元素
A.表单元素都是放在<form></form>标签内的.来看看表单的属性属性值描述 accept MIME_type 规定通过文件上传来提交的文件的类型 accept- ...
【半平面交】bzoj1038 [ZJOI2008]瞭望塔
http://m.blog.csdn.net/blog/qpswwww/44105605 #include<cstdio> #include<cmath> #include&l ...
mfc/格式转换
1.int型转为字符串型 int s = 123; CString str; str.Format("%d",s);
SQL到NOSQL的思维转变
NOSQL系统一般都会宣传一个特性,那就是性能好,然后为什么呢?关系型数据库发展了这么多年,各种优化工作已经做得很深了,NOSQL系统一般都是吸收关系型数据库的技术,然后,到底是什么因素束缚了关系型数 ...
codeforces 424D
题意:给定n,m<=300的矩阵,然后求一个长宽大于2的矩形,使得是从左上角位置开始逆时针绕边框一圈的时间最少.时间的计算是:给定3个数tu,tp, td,路径上数字增加为tu,相等为tp否则为 ...
h5专题应该兼容那些浏览器？
本人做专题还不算很多,但是也很腻烦了.一般一个专题制作也就3天,可是调试得4/5天.除了销售客户各种无休止的改改改.还有一点很重要就是浏览器的兼容性.刚开始做专题的时候天真的以为苹果只要兼容到ipho ...
Redis使用总结之与Memcached异同
Redis是什么?两句话可以做下概括: 1. 是一个完全开源免费的key-value内存数据库 2. 通常被认为是一个数据结构服务器,主要是因为其有着丰富的数据结构 strings.map. list ...
[游戏模版8] Win32 透明贴图
>_<:The same with previous introduction. In the InitInstance fanction make a little change: &g ...
Java经典类库-Guava中的函数式编程讲解
如果我要新建一个java的项目,那么有两个类库是必备的,一个是junit,另一个是Guava.选择junit,因为我喜欢TDD,喜欢自动化测试.而是用Guava,是因为我喜欢简洁的API.Guava提 ...

一个4节点Hadoop集群的配置示例

一个4节点Hadoop集群的配置示例的更多相关文章

随机推荐

热门专题