hadoop2.7.1 HA安装部署（转）

酸甜的果汁 2024-10-12 03:22:40 原文

hadoop集群规划

目标：创建2个NameNode，做高可用，一个NameNode挂掉，另一个能够启动；一个运行Yarn，3台DataNode，3台Zookeeper集群，做高可用。

在
hadoop2中通常由两个NameNode组成，一个处于active状态，另一个处于standby状态。Active
NameNode对外提供服务，而Standby NameNode则不对外提供服务，仅同步active
namenode的状态，以便能够在它失败时快速进行切换。

这里还配置了一个zookeeper集群，用于ZKFC（DFSZKFailoverController）故障转移，当Active NameNode挂掉了，会自动切换Standby NameNode为standby状态

安装我都把hadoop和Zookeeper放到了/soft/下面；

http://www.apache.org/dyn/closer.cgi/hadoop/common/hadoop-2.7.1/hadoop-2.7.1.tar.gz

http://mirror.bit.edu.cn/apache/zookeeper/zookeeper-3.4.6/zookeeper-3.4.6.tar.gz

0、系统环境安装

操作系统CentOS6.5,64位操作系统，采用最小化安装，为了能够实现目标，采用VMware 虚拟机来搭建6台服务器，所以建议服务器至少有8G内存；vmware使用的是VMware® Workstation 11.0.0 build-2305329；

网络配置如下：

虚拟机配置如下：

1、同步机器时间

yum install -y ntp #安装时间服务
ntpdate us.pool.ntp.org #同步时间

2、设置主机IP

vi /etc/sysconfig/network-scripts/ifcfg-eth0

DEVICE=eth0
IPADDR=192.168.8.101
NETMASK=255.255.255.0
GATEWAY=192.168.8.2
HWADDR=00:0C:29:56:63:A1
TYPE=Ethernet
UUID=ecb7f947-8a93-488c-a118-ffb011421cac
ONBOOT=yes
NM_CONTROLLED=yes
BOOTPROTO=none

然后重启网络服务

service network restart

查看ip配置

ifconfig eth0

eth0 Link encap:Ethernet HWaddr 00:0C:29:6C:20:2B
inet addr:192.168.8.101 Bcast:192.168.8.255 Mask:255.255.255.0
inet6 addr: fe80::20c:29ff:fe6c:202b/64 Scope:Link
UP BROADCAST RUNNING MULTICAST MTU:1500 Metric:1
RX packets:777 errors:0 dropped:0 overruns:0 frame:0
TX packets:316 errors:0 dropped:0 overruns:0 carrier:0
collisions:0 txqueuelen:1000
RX bytes:70611 (68.9 KiB) TX bytes:49955 (48.7 KiB)

这就说明我们配置的IP地址是成功的

注意：

使用vmware克隆了5台虚拟机，配置网卡的时候出现报错：”Bring up interface eth0：Device eth0 does not seem to be present，delaying initialization”

解决步骤：

第一步删除文件70-persistent-net.rules

rm -f /etc/udev/rules.d/70-persistent-net.rule

第二步修改ifcfg-eth0

vim /etc/sysconfig/network-scripts/ifcfg-eth0

删除或者注释MAC地址的配置

第三步：重启服务器

reboot

这样就可以设置新的ip地址了

3、设置主机名

把一台主机的名称改为：hadoop01

vi /etc/sysconfig/network

修改hostname就可以了：

NETWORKING=yes
HOSTNAME=hadoop01
NETWORKING_IPV6=no

要修改hosts

vi /etc/hosts

127.0.0.1 localhost
192.168.8.101 hadoop01 192.168.8.102 hadoop02 192.168.8.103 hadoop03 192.168.8.104 hadoop04 192.168.8.105 hadoop05 192.168.8.106 hadoop06

关闭ipv6

1、查看系统是否开启ipv6

a）通过网卡属性查看

命令：ifconfig

注释：有 “inet6 addr：。。。。。。。“ 的表示开启了ipv6功能

b）通过内核模块加载信息查看

命令：lsmod | grep ipv6

2、ipv6关闭方法

在/etc/modprobe.d/dist.conf结尾添加

alias net-pf-10 off
alias ipv6 off

可用vi等编辑器，也可以通过命令：

cat <<EOF>>/etc/modprobe.d/dist.conf

alias net-pf-10 off

alias ipv6 off

EOF

关闭防火墙

chkconfig iptables stop
chkconfig iptables off

改好后重启服务器：

reboot

hadoop02-hadoop06都需要设置

4、安装JDK

将压缩包解压到指定目录，然后编辑环境变量

vi /etc/proflie

在文件后面追加环境变量

export JAVA_HOME=/soft/jdk1.7.0_80/
export PATH=$JAVA_HOME/bin:$JAVA_HOME/jre/bin:$PATH

刷新

source /etc/profile

可以用java -version测试安装是否正确

5、SSH免密码登录

对于需要远程管理其它机器，一般使用远程桌面或者telnet。linux一般只能是telnet。但是telnet的缺点是通信不加密，存在不安全因素，只适合内网访问。为

解决这个问题，推出了通信加密通信协议，即SSH（Secure Shell）。使用非对称加密方式，传输内容使用rsa或者dsa加密，可以避免网络窃听。

hadoop的进程之间同信使用ssh方式，需要每次都要输入密码。为了实现自动化操作，需要配置ssh免密码登陆方式。

hadoop01\hadoop02做为NameNode，要访问到其他的节点，我们要在hadoop01可以访问到hadoop01-hadoop06（记住hadoop01也需要免登陆自己），hadoop02可以访问到hadoop01，hadoop03是yarn服务，要可以访问到datanode，所以hadoop03要免登陆到hadoop04-hadoop06；

首先要在hadoop01上生成ssh私钥和公钥

cd /root/.ssh
ssh-keygen -t rsa #4个回车

上面的命令会在.ssh目录生成一个私钥和一个公钥

id_rsa id_rsa.pub

然后将hadoop01的公钥复制到hadoop02-hadoop06，用以下命令执行

ssh-copy-id -i hadoop01
ssh-copy-id -i hadoop02
ssh-copy-id -i hadoop03
ssh-copy-id -i hadoop04
ssh-copy-id -i hadoop05
ssh-copy-id -i hadoop06

上面的命令一行一行执行，先输入yes，再输入机器的密码就可以了；

现在我们来检验以一下hadoop01到hadoop05的免登陆

我们在hadoop01中无密码登录hadoop05输入：

[root@hadoop01 .ssh]# ssh hadoop05
Last login: Tue Nov 10 17:43:41 2015 from 192.168.8.1
[root@hadoop05 ~]#

可以看到已经可以从hadoop01到hadoop05免登陆了；输入exit退出

接下来设置hadoop02到hadoop01的免登陆

在hadoop02的/root/.ssh中执行

ssh-keygen -t rsa #4个回车

ssh-copy-id -i hadoop01

如果出现以上信息就表示配置成功了。用exit退出；

那现在就很方便了，不用打开多个ssh，用一个就全搞定了；也可以配置一个hadoop用户，我现在都是使用root用户。

同里也要配置hadoop03到hadoop04-hadoop06的免登陆，这里就不列出了。

6、安装zookeeper

要将zookeeper集群部署到hadoop04、hadoop05、hadoop06上，先来设置hadoop04，操作如下

解压zookeeper到指定目录

tar -zxvf zookeeper-3.4.6.tar.gz -C /root/soft

切换到zookeeper目录的conf目录，修改zoo.sample.cfg为zoo.cfg

mv zoo.sample.cfg zoo.cfg

配置zoo.cfg

vi zoo.cfg

[root@hadoop04 conf]# vi zoo.cfg
# The number of milliseconds of each tick
tickTime=2000
# The number of ticks that the initial
# synchronization phase can take
initLimit=10
# The number of ticks that can pass between
# sending a request and getting an acknowledgement
syncLimit=5
# the directory where the snapshot is stored.
# do not use /tmp for storage, /tmp here is just
# example sakes.
dataDir=/soft/zookeeper-3.4.6/data
# the port at which the clients will connect
clientPort=2181
# the maximum number of client connections.
# increase this if you need to handle more clients
#maxClientCnxns=60
#
# Be sure to read the maintenance section of the
# administrator guide before turning on autopurge.
#
# http://zookeeper.apache.org/doc/current/zookeeperAdmin.html#sc_maintenance
#
# The number of snapshots to retain in dataDir
#autopurge.snapRetainCount=3
# Purge task interval in hours
# Set to "0" to disable auto purge feature
#autopurge.purgeInterval=1
server.1=192.168.8.104:2888:3888
server.2=192.168.8.105:2888:3888
server.3=192.168.8.106:2888:3888

保存zoo.cfg

server.1=192.168.8.104:2888:3888

2888是通信端口，3888是zookeeper选举端口，这里用ip也可以，用主机名也可以。

注意配置文件中的datadir

dataDir=/soft/zookeeper-3.4.6/data

这个目录要真实存在才可以；

接下来要在/soft/zookeeper-3.4.6/data目录中增加一个文件"myid"

vi myid

文件里面写入1，然后保存，这表示是server.1;

好了，这样就配置好了，将配置好的拷贝到hadoop05、hadoop06，注意要修改data目录中myid的内容为响应的2和3

启动hadoop04、hadoop05、hadoop06的zookeeper服务

zookeeper-3.4.6目录执行以下命令

bin/zkServer.sh start #启动
bin/zkServer.sh status #查看状态

hadoop04的结果：

[root@hadoop04 zookeeper-3.4.6]# bin/zkServer.sh status
JMX enabled by default
Using config: /soft/zookeeper-3.4.6/bin/../conf/zoo.cfg
Mode: leader

hadoop05的结果：

[root@hadoop05 zookeeper-3.4.6]# bin/zkServer.sh status
JMX enabled by default
Using config: /soft/zookeeper-3.4.6/bin/../conf/zoo.cfg
Mode: follower

hadoop06的结果：

[root@hadoop06 zookeeper-3.4.6]# bin/zkServer.sh status
JMX enabled by default
Using config: /soft/zookeeper-3.4.6/bin/../conf/zoo.cfg
Mode: follower

接下来测试以下zookeeper集群，在hadoop04上关闭zookeeper

bin/zkServer.sh stop

hadoop04的结果：

[root@hadoop04 zookeeper-3.4.6]# bin/zkServer.sh status
JMX enabled by default
Using config: /soft/zookeeper-3.4.6/bin/../conf/zoo.cfg
Error contacting service. It is probably not running.
[root@hadoop04 zookeeper-3.4.6]#

hadoop05的结果：

[root@hadoop05 zookeeper-3.4.6]# bin/zkServer.sh status
JMX enabled by default
Using config: /soft/zookeeper-3.4.6/bin/../conf/zoo.cfg
Mode: follower

hadoop06的结果：

[root@hadoop06 zookeeper-3.4.6]# bin/zkServer.sh status
JMX enabled by default
Using config: /soft/zookeeper-3.4.6/bin/../conf/zoo.cfg
Mode: leader

从上面结果可以看出，zookeeper集群是没有问题的，hadoop04挂掉，hadoop06就变成了leader，这说明zookeeper集群已经部署好了。

7、hadoop安装

现在hadoop01上面配置好，然后再拷贝到其他机器上；

先解压hadoop-2.7.1.tar.gz到soft，查看hadoop目录文件如下：

[root@hadoop01 hadoop-2.7.1]# ls
bin etc include journal lib libexec LICENSE.txt logs NOTICE.txt README.txt sbin share

所有的配置文件都存放在etc/hadoop/文件夹里面

7.1、添加hadoop目录到环境变量

在/etc/profile文件中增加HADOOP_HOME，如下所示

export JAVA_HOME=/soft/jdk1.7.0_80/
export HADOOP_HOME=/soft/hadoop-2.7.1
export PATH=$PATH:$JAVA_HOME/bin:$HADOOP_HOME/bin

应用环境变量

source /etc/profile

可以用方法测试是否正确

[root@hadoop01 hadoop-2.7.1]# which hadoop
/soft/hadoop-2.7.1/bin/hadoop

7.2、配置hadoop-env.sh

vim hadoop-env.sh

修改一个地方就可以，找到JAVA_HOME，改成第4章中jdk的路径就可以了

export JAVA_HOME=/soft/jdk1.7.0_80/

保存即可。

7.3、配置core-site.xml

这一步是配置nameservice，hadoop 文件存储位置和Zookeeper集群来确保多个namenode之间的切换，修改后内容如下：

<configuration>

<property>
<name>fs.defaultFS</name>
<value>hdfs://ns1</value>
</property>

<property>
<name>hadoop.tmp.dir</name>
<value>/soft/hadoop-2.7.1/tmp</value>
</property>

<property>
<name>ha.zookeeper.quorum</name>
<value>hadoop04:2181,hadoop05:2181,hadoop06:2181</value>
</property>
</configuration>

7.4、配置hdfs-site.xml

hdfs-site.xml主要配置namenode的高可用；

内容如下：

<configuration>

<property>
<name>dfs.nameservices</name>
<value>ns1</value>
</property>

<property>
<name>dfs.ha.namenodes.ns1</name>
<value>nn1,nn2</value>
</property>

<property>
<name>dfs.namenode.rpc-address.ns1.nn1</name>
<value>hadoop01:9000</value>
</property>

<property>
<name>dfs.namenode.http-address.ns1.nn1</name>
<value>hadoop01:50070</value>
</property>

<property>
<name>dfs.namenode.rpc-address.ns1.nn2</name>
<value>hadoop02:9000</value>
</property>

<property>
<name>dfs.namenode.http-address.ns1.nn2</name>
<value>hadoop02:50070</value>
</property>

<property>
<name>dfs.namenode.shared.edits.dir</name>
<value>qjournal://hadoop04:8485;hadoop05:8485;hadoop06:8485/ns1</value>
</property>

<property>
<name>dfs.journalnode.edits.dir</name>
<value>/soft/hadoop-2.7.1/journal</value>
</property>

<property>
<name>dfs.ha.automatic-failover.enabled</name>
<value>true</value>
</property>

<property>
<name>dfs.client.failover.proxy.provider.ns1</name>
<value>org.apache.hadoop.hdfs.server.namenode.ha.ConfiguredFailoverProxyProvider</value>
</property>

<property>
<name>dfs.ha.fencing.methods</name>
<value>sshfence</value>
</property>

<property>
<name>dfs.ha.fencing.ssh.private-key-files</name>
<value>/root/.ssh/id_rsa</value>
</property>
</configuration>

保存即可。

7.4、配置datanode的配置文件slaves

vi slaves

修改datanode节点如下：

hadoop04
hadoop05
hadoop06

保存即可。

7.5、配置mapreduce文件mapred-site.xml

默认是没有mapred-site.xml文件的，里面有一个mapred-site.xml.example,重命名为mapred-site.xml

mv mapred-site.xml.example mapred-site.xml

配置内容如下，这里就是指明mapreduce是用在YARN之上来执行的。

<configuration>

<property>
<name>mapreduce.framework.name</name>
<value>yarn</value>
</property>
</configuration>

7.6、配置yarn-site.xml

做规划的时候就是配置hadoop03来运行yarn，配置如下：

<configuration>

<property>
<name>yarn.resourcemanager.hostname</name>
<value>hadoop03</value>
</property>

<property>
<name>yarn.nodemanager.aux-services</name>
<value>mapreduce_shuffle</value>
</property>
</configuration>

到目前为止就已经配置好hadoop01了，要将配置好的hadoop文件拷贝到hadoop02-hadoop06上，cd到soft目录

scp -r hadoop2.7.1 hadoop02:/soft/
scp -r hadoop2.7.1 hadoop03:/soft/
scp -r hadoop2.7.1 hadoop04:/soft/
scp -r hadoop2.7.1 hadoop05:/soft/
scp -r hadoop2.7.1 hadoop06:/soft/

7.7、启动Zookeeper服务

在hadoop04、hadoop05、hadoop06上启动Zookeeper，下面以hadoop04为例

[root@hadoop04 zookeeper-3.4.6]# bin/zkServer.sh start
JMX enabled by default
Using config: /soft/zookeeper-3.4.6/bin/../conf/zoo.cfg
Starting zookeeper ... STARTED

确保这三台服务器上有一个leader，两个follower

7.8、在hadoop01上启动journalnode

[root@hadoop01 hadoop-2.7.1]# sbin/hadoop-daemons.sh start journalnode

在7.4中配置了journalnode的节点是hadoop04、hadoop05、hadoop06，这三台机器上会出现JournalNode，以下是hadoop04上的进程

[root@hadoop04 zookeeper-3.4.6]# jps
1532 JournalNode
1796 Jps
1470 QuorumPeerMain

7.9、在hadoop01上格式化hadoop

hadoop namenode -format

格式化后会在根据7.3中core-site.xml中的hadoop.tmp.dir配置生成个文件，在hadoop01中会出现一个tmp文件夹，/soft/hadoop-2.7.1/tmp，现在规划的是hadoop01和hadoop02是NameNode，然后将/soft/hadoop-2.7.1/tmp拷贝到hadoop02:/soft/hadoop-2.7.1/下，这样hadoop02就不用格式化了。

scp -r tmp/ hadoop02:/soft/hadoop-2.7.1/

7.10、在hadoop01上格式化ZK

hdfs zkfc -formatZK

7.11、在hadoop01上启动HDFS

sbin/start-dfs.sh

7.12 在hadoop01上启动YARN

sbin/start-yarn.sh

如果没有出错，hadoop的高可用就配置完成了；

8、使用hadoop集群测试

在本机中配置hosts文件（不是VMware虚拟机）

文件路径：C:\Windows\System32\drivers\etc\hosts

内容如下：

192.168.8.101 hadoop01
192.168.8.102 hadoop02
192.168.8.103 hadoop03
192.168.8.104 hadoop04
192.168.8.105 hadoop05
192.168.8.106 hadoop06

在浏览器中输入：http://hadoop01:50070/，就可以看到如下界面

查看hadoop02：http://hadoop02:50070/

上面可以看到hadoop01是处于active状态，hadoop02是初一standby，接下来测试以下namenode的高可用，当hadoop01挂掉时hadoop02是否能够自动切换；

在hadoop01中kill掉NameNode进程

[root@hadoop01 hadoop-2.7.1]# jps
1614 NameNode
2500 Jps
1929 DFSZKFailoverController
[root@hadoop01 hadoop-2.7.1]# kill -9 1614

刷新http://hadoop01:50070/，无法访问，

刷新http://hadoop02:50070/

这是hadoop02已经处于active状态了，这说明我们的切换是没有问题的，现在已经完成了hadoop集群的高可用的搭建；

hadoop2.7.1 HA安装部署（转）的更多相关文章

hadoop入门（3）——hadoop2.0理论基础：安装部署方法
一.hadoop2.0安装部署流程 1.自动安装部署:Ambari.Minos(小米).Cloudera Manager(收费) 2.使用RPM包安装部署:Apache ...
史上最完整Hadoop2.x完全分布式安装部署-小白也能学会
一.环境要求: 1. 虚拟机安装并设置网络: 2. 修改主机地址映射: 3. 必备软件:Jdk.Development Tools Development ...
spark-2.4.0-hadoop2.7-高可用(HA)安装部署
1. 主机规划主机名称 IP地址操作系统部署软件运行进程备注 mini01 172.16.1.11[内网] 10.0.0.11 [外网] CentOS 7.5 Jdk-8.zookeepe ...
3_HA介绍和安装部署
一.hadoop 2.x产生背景 1.hadoop 1.x中hdfs和mr在高可用和扩展性等方面存在问题.2.hdfs存在的问题:NN单点故障,难以应用于在线场景:NN压力过大,内存受限,影响系统扩展 ...
Hadoop分布式HA的安装部署
Hadoop分布式HA的安装部署前言单机版的Hadoop环境只有一个namenode,一般namenode出现问题,整个系统也就无法使用,所以高可用主要指的是namenode的高可用,即存在两个n ...
第06讲：Flink 集群安装部署和 HA 配置
Flink系列文章第01讲:Flink 的应用场景和架构模型第02讲:Flink 入门程序 WordCount 和 SQL 实现第03讲:Flink 的编程模型与其他框架比较第04讲:Flin ...
Hadoop 学习笔记（九） hadoop2.2.0 生产环境部署 HDFS HA部署方法
step1:将安装包hadoop-2.2.0.tar.gz存放到某一个目录下,并解压 step2:修改解压后的目录中的文件夹/etc/hadoop下的xml配置文件(如果文件不存在,则自己创建) 包括 ...
CentOS下SparkR安装部署：hadoop2.7.3+spark2.0.0+scale2.11.8+hive2.1.0
注:之前本人写了一篇SparkR的安装部署文章:SparkR安装部署及数据分析实例,当时SparkR项目还没正式入主Spark,需要自己下载SparkR安装包,但现在spark已经支持R接口,so更新 ...
【原创 Hadoop&Spark 动手实践 1】Hadoop2.7.3 安装部署实践
目录: 第一部分:操作系统准备工作: 1. 安装部署CentOS7.3 1611 2. CentOS7软件安装(net-tools, wget, vim等) 3. 更新CentOS7的Yum源,更新软 ...

随机推荐

Jade模板引擎让你飞
写在前面:现在jade改名成pug了一.安装 npm install jade 二.基本使用 1.简单使用 p hello jade! 渲染后: <p>hello jade!</p ...
【原】AFNetworking源码阅读（一）
[原]AFNetworking源码阅读(一) 本文转载请注明出处 —— polobymulberry-博客园 1. 前言 AFNetworking版本:3.0.4 由于我平常并没有经常使用AFNetw ...
EventBus实现activity跟fragment交互数据
最近老是听到技术群里面有人提出需求,activity跟fragment交互数据,或者从一个activity跳转到另外一个activity的fragment,所以我给大家介绍一个开源项目,EventBu ...
Hawk 7. 常见问题
本页面您可以通过关键字搜索来获取信息. 理性使用爬虫爬虫是一种灰色的应用,虽然作为Hawk的设计者,但我依然不得不这么说. 各大网站都在收集和整理数据上花费了大量的精力,因此抓取的数据应当仅仅作为科 ...
Http请求
HTTP报文是面向文本的,报文中的每一个字段都是一些ASCII码串,各个字段的长度是不确定的.HTTP有两类报文:请求报文和响应报文. 请求报文一个HTTP请求报文由请求行(request line ...
JQuery实现表格的增加行和删除行
利用JQuery实现datatables插件的增加和删除行操作在学习过程中遇到了这个利用JQuery对表格行的增加和删除,特记录下来以供初学者参考. 下面是主要的代码: <meta http- ...
Oracle-BPM安装详解
H3 BPM安装包括两个部分,基础工作包括安装IIS..net Freamwork基础框架.安装完成之后,主要配置安装包括数据库,H3 BPM 程序.下面详细介绍Oracle与H3 BPM对接安装的整 ...
【腾讯Bugly干货分享】聊聊苹果的Bug - iOS 10 nano_free Crash
本文来自于腾讯Bugly公众号(weixinBugly),未经作者同意,请勿转载,原文地址:https://mp.weixin.qq.com/s/hnwj24xqrtOhcjEt_TaQ9w 作者:张 ...
一个标签的72变，打造一个纯CSS图标库
每次要用到图标的时候都会到 icono 去copypaste,但每次用到的时候尺寸都各不一样,总是要调整参数,巨烦.当然你可以会想到用zoom.scale来做缩放,但是这样的缩放会使得线宽也变粗了,不 ...
MySQL8：连接查询
连接查询连接是关系型数据库模型的主要特点. 连接查询是关系型数据库中最主要的查询,主要包括内连接.外连接等通过联结运算符可以实现多个表查询. 在关系型数据库管理系统中,表建立时各种数据之间的关系不必 ...