hadoop namenode HA集群搭建

hadoop集群搭建(namenode是单点的) http://www.cnblogs.com/kisf/p/7456290.html

HA集群需要zk, zk搭建：http://www.cnblogs.com/kisf/p/7357184.html zk可视化管理工具：http://www.cnblogs.com/kisf/p/7365690.html

hostname	ip	安装软件	启动进程
master1	10.112.29.9	jdk,hadoop	NameNode,ResourceManager,JournalNode,DFSZKFailoverController
master2,slave1	10.112.29.10	jdk,hadoop	NameNode,JournalNode,DFSZKFailoverController,DataNode,NodeManager
slave2	10.112.28.237	jdk,hadoop	JournalNode,DataNode,NodeManager

1. 修改/etc/hosts, 三个机器一致。

vim /etc/hosts 

10.112.29.9 master1

10.112.29.10 master2

10.112.29.10 slave1

10.112.28.237 slave2

10.112.28.245 zk1

10.112.28.229 zk2

10.112.28.241 zk3

2. 修改core-site.xml, hdfs-site.xml及yarn-site.xml, mapred-site.xml不变。

core-site.xml

<configuration>

        <!-- 指定hdfs的nameservice为ns -->

        <property>

                <name>fs.defaultFS</name>

                <value>hdfs://ns</value>

        </property>

        <!-- 指定hadoop运行时产生文件的存储路径 -->

        <property>

                <name>hadoop.tmp.dir</name>

                <value>file:/xxx/soft/hadoop-2.7.3/tmp</value>

        </property>

        <property>

                <name>io.file.buffer.size</name>

                <value>4096</value>

        </property>

        <!--指定zookeeper地址-->

        <property>

                <name>ha.zookeeper.quorum</name>

                <value>zk1:2181,zk2:2181,zk3:2181</value>

        </property>

</configuration>

hdfs-site.xml

<configuration>

  <!--指定hdfs的nameservice为ns，需要和core-site.xml中的保持一致 -->

  <property>

        <name>dfs.nameservices</name>

        <value>ns</value>

  </property>

  <!-- ns下面有两个NameNode，分别是nn1，nn2 -->

  <property>

        <name>dfs.ha.namenodes.ns</name>

        <value>nn1,nn2</value>

  </property>

  <!-- nn1的RPC通信地址 -->

  <property>

        <name>dfs.namenode.rpc-address.ns.nn1</name>

        <value>master1:9000</value>

  </property>

  <!-- nn1的http通信地址 -->

  <property>

        <name>dfs.namenode.http-address.ns.nn1</name>

        <value>master1:50070</value>

  </property>

  <!-- nn2的RPC通信地址 -->

  <property>

        <name>dfs.namenode.rpc-address.ns.nn2</name>

        <value>master2:9000</value>

  </property>

  <!-- nn2的http通信地址 -->

  <property>

        <name>dfs.namenode.http-address.ns.nn2</name>

        <value>master2:50070</value>

  </property>

  <!-- 指定NameNode的元数据在JournalNode上的存放位置 -->

  <property>

         <name>dfs.namenode.shared.edits.dir</name>

        <value>qjournal://slave1:8485;slave2:8485/ns</value>

  </property>

  <!-- 指定JournalNode在本地磁盘存放数据的位置 -->

  <property>

        <name>dfs.journalnode.edits.dir</name>

        <value>/xxx/soft/hadoop-2.7.3/journal</value>

  </property>

  <!-- 开启NameNode故障时自动切换 -->

  <property>

        <name>dfs.ha.automatic-failover.enabled</name>

        <value>true</value>

  </property>

  <!-- 配置失败自动切换实现方式 -->

  <property>

        <name>dfs.client.failover.proxy.provider.ns</name>

        <value>org.apache.hadoop.hdfs.server.namenode.ha.ConfiguredFailoverProxyProvider</value>

  </property>

  <!-- 配置隔离机制，如果ssh是默认22端口，value直接写sshfence即可 -->

  <property>

        <name>dfs.ha.fencing.methods</name>

        <value>sshfence</value>

  </property>

  <!-- 使用隔离机制时需要ssh免登陆 -->

  <property>

        <name>dfs.ha.fencing.ssh.private-key-files</name>

        <value>/root/.ssh/id_rsa</value>

  </property>

  <!-- 设置namenode存放的路径 -->

  <property>

        <name>dfs.namenode.name.dir</name>

        <value>file:/xxx/soft/hadoop-2.7.3/tmp/name</value>

  </property>

  <!-- 设置hdfs副本数量 -->

  <property>

        <name>dfs.replication</name>

        <value>2</value>

  </property>

  <!-- 设置datanode存放的路径 -->

  <property>

        <name>dfs.datanode.data.dir</name>

        <value>file:/xxx/soft/hadoop-2.7.3/tmp/data</value>

  </property>

  <!-- 在NN和DN上开启WebHDFS (REST API)功能,不是必须 -->

  <property>

        <name>dfs.webhdfs.enabled</name>

        <value>true</value>

  </property>

</configuration>

yarn-site.xml

<configuration>

    <!-- Site specific YARN configuration properties -->

    <!-- 设置 resourcemanager 在哪个节点-->

    <property>

            <name>yarn.resourcemanager.hostname</name>

            <value>master1</value>

    </property>

    <!-- reducer取数据的方式是mapreduce_shuffle -->

    <property>

            <name>yarn.nodemanager.aux-services</name>

            <value>mapreduce_shuffle</value>

    </property>

    <property>

            <name>yarn.nodemanager.aux-services.mapreduce.shuffle.class</name>

            <value>org.apache.hadoop.mapred.ShuffleHandler</value>

    </property>

</configuration>

3. 将/xxx/soft/hadoop-2.7.3 scp至其他机器。注意清理一下 logs， tmp下文件。

4. 启动

(1)格式化zkfc

./bin/hdfs zkfc -formatZK

(2)格式化namenode，格式化namenode之前需要在master1, slave1, slave2上分别启动journalnode。特别注意，如果不启动，namenode格式化会抛错。

在master1, slave1, slave2上分别启动journalnode。（单独启动进程用hadoop-daemon.sh start xxx）

./sbin/hadoop-daemon.sh start journalnode

在master1上格式化namenode

./bin/hdfs namenode -format　ns

将./tmp 拷贝至master2

scp -r ./tmp/ master2:/xxx/soft/hadoop-2.7.3/

(3)启动namenode和yarn

./sbin/start-dfs.sh 

./sbin/start-yarn.sh

5. 查看进程

[root@vm-10-112-29-9 hadoop-2.7.3]# jps

13349 NameNode

13704 DFSZKFailoverController

13018 JournalNode

14108 Jps

13836 ResourceManager

[root@vm-10-112-29-10 hadoop-2.7.3]# jps

31412 NodeManager

30566 JournalNode

31174 DataNode

31576 Jps

31307 DFSZKFailoverController

31069 NameNode

[root@vm-10-112-28-237 hadoop-2.7.3]# jps

27482 Jps

27338 NodeManager

27180 DataNode

26686 JournalNode

6. 验证HDFS

hadoop fs -put ./NOTICE.txt hdfs://ns/

7. 访问

hadoop namenode HA集群搭建的更多相关文章

hadoop yarn HA集群搭建
可先完成hadoop namenode HA的搭建:http://www.cnblogs.com/kisf/p/7458519.html 搭建yarnde HA只需要在namenode HA配置基础上 ...
hadoop ha集群搭建
集群配置: jdk1.8.0_161 hadoop-2.6.1 zookeeper-3.4.8 linux系统环境:Centos6.5 3台主机:master.slave01.slave02 Hado ...
hadoop2.8 ha 集群搭建
简介: 最近在看hadoop的一些知识,下面搭建一个ha (高可用)的hadoop完整分布式集群: hadoop的单机,伪分布式,分布式安装 hadoop2.8 集群 1 (伪分布式搭建 hadoop ...
Hadoop的HA集群启动和停止流程
假设我们有3台虚拟机,主机名分别是hadoop01.hadoop02和hadoop03. 这3台虚拟机的Hadoop的HA集群部署计划如下: 3台虚拟机的Hadoop的HA集群部署计划 hadoop0 ...
hadoop高可用集群搭建小结
hadoop高可用集群搭建小结1.Zookeeper集群搭建2.格式化Zookeeper集群 (注:在Zookeeper集群建立hadoop-ha,amenode的元数据)3.开启Journalmno ...
ZooKeeper学习之路（九）利用ZooKeeper搭建Hadoop的HA集群
Hadoop HA 原理概述为什么会有 hadoop HA 机制呢? HA:High Available,高可用在Hadoop 2.0之前,在HDFS 集群中NameNode 存在单点故障 (SP ...
hadoop HA集群搭建步骤
NameNode DataNode Zookeeper ZKFC JournalNode ResourceManager NodeManager node1 √ √ √ √ node2 ...
hadoop HA+kerberos HA集群搭建
IP.主机名规划 hadoop集群规划: hostname IP hadoop 备注 hadoop1 110.185.225.158 NameNode,ResourceManager,DFSZKFai ...
Hadoop2.0 HA集群搭建步骤
上一次搭建的Hadoop是一个伪分布式的,这次我们做一个用于个人的Hadoop集群(希望对大家搭建集群有所帮助): 集群节点分配: Park01 Zookeeper NameNode (active) ...

随机推荐

《从零开始学Swift》学习笔记（Day 10）——运算符是“ +、-、*、/ ”吗？
原创文章,欢迎转载.转载请注明:关东升的博客运算符是用于执行程序代码运算,会针对一个或一个以上操作数项目来进行运算.例如:2+3,其操作数是2和3,而运算符则是“+”.那么“+.-.*./”是运算符 ...
Netty 服务端创建
参考:http://blog.csdn.net/suifeng3051/article/details/28861883?utm_source=tuicool&utm_medium=refer ...
innerHTML 延后执行？
时常会觉得 innerHTML 可能有延后执行的情况,比如下面代码: document.body.innerHTML = 'something'; alert('something else'); 明 ...
进击的RecyclerView入门一（简单上手）
虽然RecyclerView面世有一段时间了,但由于它的学习成本相对较高,很多码友只是粗略的认识了一下而没有细致的品味RecyclerView的真谛. 那么从现在开始我将带你装逼带你飞,一起领略Goo ...
使用Servlet3.0新特性asyncSupported=true时抛异常java.lang.IllegalStateException: Not supported
最近在运用Servlet3.0新特性:异步处理功能的时候出现以下了2个问题: 运行时会抛出以下两种异常: 一月 19, 2014 3:07:07 下午 org.apache.catalina.core ...
oracle常用操作命令总结
一. 默认安装带来的用户名/密码:--sys/change_on_install SYSDBA 或 SYSOPER 不能以 NORMAL 登录,可作为默认的系统管理员 --system/安装时输入的密 ...
API网关+Kubernetes集群的架构替代了传统的Nginx(Ecs)+Tomcat(Ecs)
API网关为K8s容器应用集群提供强大的接入能力_最佳实践_API 网关-阿里云 https://help.aliyun.com/document_detail/71623.html 在最后一节,我们 ...
application/x-protobuf payload加密知乎
python基础-第七篇-7.2面向对象（进阶篇）
进入到今天的探索前,我先对上节内容进行一下回顾: 面向对象是一种编程方式,此编程方式的实现是基于对类和对象的使用类是一个模板,模板中包装了多个函数可供使用对象是基于类创建的,实例用于调用被包装在类 ...
Linux上的下载软件uGet
uGet是一款开源下载软件,类似于我们常用的迅雷,不过uGet支持的操作系统非常多,Ubunut,Arch,openSUSE,Windows,MacOS,BSD等. uGet支持两个下载引擎:curl ...

hadoop namenode HA集群搭建

hadoop namenode HA集群搭建的更多相关文章

随机推荐

热门专题