hadoop-ha组态
HADOOP HA组态
hadoop2.x的ha组态。这份文件是在那里的描述中hdfs与yarn的ha组态。
这份文件的假设是zk它已被安装并配置,事实上,任何安装。
hdfs ha组态
首先。配置core-site.xml配置文件:
<property>
在老版本号中使用mr1时,还可能使用fs.default.name来进行配置
<name>fs.defaultFS</name>
此处配置的mycluster眼下还未定义。我们须要记住这个值,
这个表示此namenode的nameServiceId,在hdfs-site中定义,此处进行引用
<value>hdfs://mycluster</value>
</property>
接下来,配置当namenode发生切换时的检查方法。当NAMENODE切换时。
须要检查并确保仅仅有一个active节点。
因此会通过SHELL或SSH的方式过去强制中止或运行检查
<property>
<name>dfs.ha.fencing.methods</name>
此处的可配置值sshfence/shell
<value>sshfence</value>
</property>
<property>
<name>dfs.ha.fencing.ssh.private-key-files</name>
<value>/root/.ssh/id_rsa</value>
</property>
配置ha连接的zk的连接地址,
<property>
<name>ha.zookeeper.quorum</name>
<value>one.cluster:2181,two.cluster:2181,three.cluster:2181</value>
</property>
还能够有例如以下几个配置:
ha.zookeeper.session-timeout.ms,zk的session超时时间,默认是5000ms
ha.zookeeper.parent-znode,hdfs的ha在zk上的存储路径 ,默认是/hadoop-ha
接下来对hdfs-site.xml进行配置
定义上面提到过的nameserviceid的值,
<property>
<name>dfs.nameservices</name>
此处对当前配置的ha的nameserviceid进行定义,此处的mycluster中间不能使用"_"线
<value>mycluster</value>
</property>
接下来定义nameserviceid中须要使用到的namenode的id,
<property>
<name>dfs.ha.namenodes.mycluster</name>
此处定义了两个namenode的id,也就是须要配置两具namenode,id各自是nn1与nn2
<value>nn1,nn2</value>
</property>
在定义完毕须要的namenode id后。
须要针对每个namenode,定义其相关的rpc,http地址。
假设有启用https,还须要设置https-address
此处的配置通过nameserviceid.namenodeid来进行配置。
<property>
<name>dfs.namenode.rpc-address.mycluster.nn1</name>
<value>one.cluster:8020</value>
</property>
<property>
<name>dfs.namenode.rpc-address.mycluster.nn2</name>
<value>two.cluster:8020</value>
</property>
<property>
<name>dfs.namenode.http-address.mycluster.nn1</name>
<value>one.cluster:50070</value>
</property>
<property>
<name>dfs.namenode.http-address.mycluster.nn2</name>
<value>two.cluster:50070</value>
</property>
接下来配置namenode edits的共享存储。在这里使用QJM来进行配置:
qjm是一个非常轻量的进程,能够直接部署到namenode或datanode中。
qjm的默认rpcport是8485,默认httpport是8480,
可通过配置dfs.journalnode.rpc-address。dfs.journalnode.http-address来改动port。
qjm必须配置为单数个(N),可以保证在(N-1)/2个正常执行时,可以正常提供服务。
<property>
<name>dfs.namenode.shared.edits.dir</name>
<value>qjournal://one.cluster:8485;two.cluster:8485;three.cluster:8485/mycluster</value>
</property>
配置QJM的存储路径 :
<property>
<name>dfs.journalnode.edits.dir</name>
<value>/data/1/dfs/jn</value>
</property>
设置针对此nameserviceid的client代理:
client请求时通过nameserviceid来做请求。
nameserviceid解析出相应的active namenode就通过此配置中的java类来完毕。
<property>
<name>dfs.client.failover.proxy.provider.mycluster</name>
<value>org.apache.hadoop.hdfs.server.namenode.ha.ConfiguredFailoverProxyProvider</value>
</property>
接下来配置namenode的自己主动故障转换。
<property>
<name>dfs.ha.automatic-failover.enabled</name>
<value>true</value>
</property>
把配置文件 拷贝到全部的节点中。这个不能忘呀。
在配置有QJM的节点中启动QJM.
进入hadooop_home/sbin文件夹
./hadoop-daemon.sh start journalnode
进入hadoop_home/bin文件夹下,运行./hdfs zkfc -formatZK在zk上进行格式化
对namenode进行format操作:
进入hadoop_home/bin文件夹,并运行例如以下命令
运行./hadoop namenode -format -clusteridhacluster命令。
./hdfs namenode-initializeSharedEdits
接下来启动主的namenode, 进入hadooop_home/sbin文件夹,运行例如以下命令
./hadoop-daemon.sh start namenode
赶往standby的namenode节点。
进入hadoop_home/bin文件夹,运行例如以下命令:
./hdfs namenode -bootstrapStandby
启动standby 的namenode,进入hadooop_home/sbin文件夹,运行例如以下命令
./hadoop-daemon.sh start namenode
接下来启动各个datanode节点。
./hadoop-daemon.sh start datanode
最后一步。启动zkfc,自己主动切换namenode节点的服务。
由于此时两个namenode都是standby的状态,须要启动zkfc来实现切换。
在主namenode与standby的namenode中进行hadoop_home/sbin文件夹。并运行例如以下命令
./hadoop-daemon.sh start zkfc
the end.
YARN RM的HA配置
配置yarn中resourcemanager的HA仅仅有在hadoop2.3.x后才引进,
yarn的ha配置相对简单,直接配置yarn-site.xml文件
<property>
rm连接失败的重试间隔
<name>yarn.resourcemanager.connect.retry-interval.ms</name>
<value>2000</value>
</property>
<property>
是否启用ha配置。默认是false.
<name>yarn.resourcemanager.ha.enabled</name>
<value>true</value>
</property>
<property>
启动自己主动故障转移,默觉得false
<name>yarn.resourcemanager.ha.automatic-failover.enabled</name>
<value>true</value>
</property>
<property>
启用一个内嵌的故障转移,与ZKRMStateStore一起使用。
<name>yarn.resourcemanager.ha.automatic-failover.embedded</name>
<value>true</value>
</property>
<property>
<name>yarn.resourcemanager.cluster-id</name>
<value>rm-cluster</value>
</property>
<property>
<name>yarn.resourcemanager.ha.rm-ids</name>
<value>rm1,rm2</value>
</property>
<property>
配置当前的rm节点。这个地方要注意。在rm1这个机器上时,配置为rm1
在rm2这台机器上时,须要配置为rm2.它们之间通过zk来实现active操作
<name>yarn.resourcemanager.ha.id</name>
<value>rm1</value>
</property>
<property>
<name>yarn.resourcemanager.recovery.enabled</name>
<value>true</value>
</property>
<property>
HA时,RMStateStore须要配置为这个值。
<name>yarn.resourcemanager.store.class</name>
<value>org.apache.hadoop.yarn.server.resourcemanager.recovery.ZKRMStateStore</value>
</property>
<property>
配置与zk的连接地址
<name>yarn.resourcemanager.zk.state-store.address</name>
<value>localhost:2181</value>
</property>
<property>
<name>yarn.resourcemanager.zk-address</name>
<value>localhost:2181</value>
</property>
<!-- RM1 configs -->
<property>
<name>yarn.resourcemanager.address.rm1</name>
<value>host1:23140</value>
</property>
<property>
<name>yarn.resourcemanager.scheduler.address.rm1</name>
<value>host1:23130</value>
</property>
<property>
<name>yarn.resourcemanager.webapp.https.address.rm1</name>
<value>host1:23189</value>
</property>
<property>
<name>yarn.resourcemanager.webapp.address.rm1</name>
<value>host1:23188</value>
</property>
<property>
<name>yarn.resourcemanager.resource-tracker.address.rm1</name>
<value>host1:23125</value>
</property>
<property>
<name>yarn.resourcemanager.admin.address.rm1</name>
<value>host1:23141</value>
</property>
<!-- RM2 configs -->
<property>
<name>yarn.resourcemanager.address.rm2</name>
<value>host2:23140</value>
</property>
<property>
<name>yarn.resourcemanager.scheduler.address.rm2</name>
<value>host2:23130</value>
</property>
<property>
<name>yarn.resourcemanager.webapp.https.address.rm2</name>
<value>host2:23189</value>
</property>
<property>
<name>yarn.resourcemanager.webapp.address.rm2</name>
<value>host2:23188</value>
</property>
<property>
<name>yarn.resourcemanager.resource-tracker.address.rm2</name>
<value>host2:23125</value>
</property>
<property>
<name>yarn.resourcemanager.admin.address.rm2</name>
<value>host2:23141</value>
</property>
启动yarn的各节点,
在主resourcemanager与standby的resourcemanager运行
yarn-daemon.sh start resourcemanager
在nodemanager运行
yarn-daemon.sh start nodemanager
hadoop-ha组态的更多相关文章
- 使用Nginx+Lua代理Hadoop HA
一.Hadoop HA的Web页面访问 Hadoop开启HA后,会同时存在两个Master组件提供服务,其中正在使用的组件称为Active,另一个作为备份称为Standby,例如HDFS的NameNo ...
- Hadoop技术之Hadoop HA 机制学习
欢迎大家前往腾讯云技术社区,获取更多腾讯海量技术实践干货哦~ 作者:温球良 导语 最近分享过一次关于Hadoop技术主题的演讲,由于接触时间不长,很多技术细节认识不够,也没讲清楚,作为一个技术人员,本 ...
- hadoop HA 详解
NameNode 高可用整体架构概述 在 Hadoop 1.0 时代,Hadoop 的两大核心组件 HDFS NameNode 和 JobTracker 都存在着单点问题,这其中以 NameNode ...
- Hadoop HA高可用集群搭建(Hadoop+Zookeeper+HBase)
声明:作者原创,转载注明出处. 作者:帅气陈吃苹果 一.服务器环境 主机名 IP 用户名 密码 安装目录 master188 192.168.29.188 hadoop hadoop /home/ha ...
- hadoop ha zkfc 异常自动切换机制和hdfs 没有空间问题解决
在我搭建hadoop ha 后,我启动了各个功能,但是发现hadoop hdfs 没法使用,在web 页面也显示hdfs 可用空间为零,并且自动备份机制无法使用,本人也不理解,然后就是指定hdfs t ...
- Hadoop ha CDH5.15.1-hadoop集群启动后,集群容量不正确,莫慌,这是正常的表现!
Hadoop ha CDH5.15.1-hadoop集群启动后,集群容量不正确,莫慌,这是正常的表现! 作者:尹正杰 版权声明:原创作品,谢绝转载!否则将追究法律责任. 一.集群启动顺序 1>. ...
- Hadoop ha CDH5.15.1-hadoop集群启动后,两个namenode都是standby模式
Hadoop ha CDH5.15.1-hadoop集群启动后,两个namenode都是standby模式 作者:尹正杰 版权声明:原创作品,谢绝转载!否则将追究法律责任. 一说起周五,想必大家都特别 ...
- 基于zookeeper的高可用Hadoop HA集群安装
(1)hadoop2.7.1源码编译 http://aperise.iteye.com/blog/2246856 (2)hadoop2.7.1安装准备 http://aperise.iteye.com ...
- hadoop ha 读取 activce状态的活动节点
方式一 package com.xxx.hadoop; import com.sun.demo.jvmti.hprof.Tracker; import com.sun.xml.bind.util.Wh ...
- Hadoop HA方案调研
原文成文于去年(2012.7.30),已然过去了一年,很多信息也许已经过时,不保证正确,与Hadoop学习笔记系列一样仅为留做提醒. ----- 针对现有的所有Hadoop HA方案进行调研,以时间为 ...
随机推荐
- Oracle 12C 简介
2013年6月26日,Oracle Database 12c版本正式发布,首先发布的版本号是12.1.0.1.0,率先提供下载的平台有Linux和Solaris: Oracle官方下载地址: http ...
- Java NIO 完全学习笔记(转)
本篇博客依照 Java NIO Tutorial翻译,算是学习 Java NIO 的一个读书笔记.建议大家可以去阅读原文,相信你肯定会受益良多. 1. Java NIO Tutorial Java N ...
- Qt线程同步操作用QWaitCondition QMutex
可以看到Qt提供了一个等待事件发生的类QWaitCondition,当条件满足时可以唤醒其它等待的线程. 写一个类可以在线程间实现同步功能 #ifndef THREADEVENT_H #define ...
- Spring3.0官网文档学习笔记(一)
Part 1 Spring框架概述 Spring是模块化的,在应用中仅仅须要引入你所须要用到的模块的jar包,其余的jar包不用引入. spring框架支持声明式的事务管理,通过RMI或web ser ...
- VMware中linux与window目录共享
在虚拟机下来实如今windows下共享一个目录: (前提已安装完毕vmtools:http://blog.csdn.net/pipisorry/article/details/21318931) 打开 ...
- 物联网操作系统HelloX开发人员入门指南
HelloX开发人员入门指南 HelloX是聚焦于物联网领域的操作系统开发项目,能够通过百度搜索"HelloX".获取具体信息. 当前开发团队正在进一步招募中,欢迎您的了解和添加. ...
- ACdream 1114(莫比乌斯反演)
传送门:Number theory 题意:给n个数,n 和 每个数的范围都是 1---222222,求n个数中互质的对数. 分析:处理出每个数倍数的个数cnt[i],然后进行莫比乌斯反演,只不过这里的 ...
- FZU2176(二维线段树+dfs)
传送门:easy problem 题意:给定一棵n个节点以1为根的树,初始每个节点的值为0,现在我们要在树上进行一些操作,操作有两种类型. 1 x val 表示对以x为根的子树的每个点进行加权操作(我 ...
- 启动和关闭JBoss As 7.1.1脚本
启动和关闭JBoss As 7.1.1,脚本例如以下djboss.sh: #!/bin/sh #JBOSS_HOME JBOSS_HOME=/opt/jboss case "$1" ...
- 谈谈android反编译和防止反编译的方法(转)
谈谈android反编译和防止反编译的方法(转) android基于java的,而java反编译工具很强悍,所以对正常apk应用程序基本上可以做到100%反编译还原. 因此开发人员如果不准备开源自己的 ...