HDFS与YARN HA部署配置文件

core-site.xml

<!--Yarn 需要使用 fs.defaultFS 指定NameNode URI -->

<property>

    <name>fs.defaultFS</name>

    <value>hdfs://ruozeclusterg6</value>

</property>

<!--==============================Trash机制======================================= -->

<property>

    <!--多长时间创建CheckPoint NameNode截点上运行的CheckPointer 从Current文件夹创建CheckPoint;默认：0 由fs.trash.interval项指定 ，fs.trash.checkpoint.interval则是指垃圾回收的检查间隔，应该是小于或者等于fs.trash.interval。如果是0，值等同于fs.trash.interval。每次检查器运行，会创建新的检查点。-->

    <name>fs.trash.checkpoint.interval</name>

    <value>0</value>

</property>

<!--指定hadoop临时目录, hadoop.tmp.dir 是hadoop文件系统依赖的基础配置，很多路径都依赖它。如果hdfs-site.xml中不配 置namenode和datanode的存放位置，默认就放在这>个路径中 -->

<property>

    <name>hadoop.tmp.dir</name>

    <value>/home/hadoop/app/hadoop-2.6.0-cdh5.7.0/tmp</value>

</property>

#hadoop.tmp.dir需要自己创建

[hadoop@hadoop001 hadoop]$ mkdir -p /home/hadoop/app/hadoop-2.6.0-cdh5.7.0/tmp

<!-- 指定zookeeper地址 -->

<property>

    <name>ha.zookeeper.quorum</name>

    <value>hadoop001:2181,hadoop002:2181,hadoop003:2181</value>

</property>

<!--hadoop代理user的host,hadoop进程允许访问的用户机器host或者用户组，proxyuser后面指定的hadoop进程运行的用户，如果改成别的用户，则必须以该用户启动hadoop进程-->

<property>

    <name>hadoop.proxyuser.hadoop.hosts</name>

    <value>*</value>

</property> 

<property>

    <name>hadoop.proxyuser.hadoop.groups</name>

    <value>*</value>

</property>

hdfs-site.xml

<!--dfs的namenode节点的name.dir目录需要自己创建-->

<property>

    <name>dfs.namenode.name.dir</name>

    <value>/home/hadoop/app/hadoop-2.6.0-cdh5.7.0/data/dfs/name</value>

    <description> namenode 存放name table(fsimage)本地目录（需要修改）</description>

</property>

[hadoop@hadoop001 hadoop]$ mkdir -p /home/hadoop/app/hadoop-2.6.0-cdh5.7.0/data/dfs/name

<!--dfs的datanode的data。dir目录，同样需要自己创建-->

<property>

    <name>dfs.datanode.data.dir</name>

    <value>/home/hadoop/app/hadoop-2.6.0-cdh5.7.0/data/dfs/data</value>

    <description>datanode存放block本地目录（需要修改）</description>

</property>

<!--HDFS高可用配置 -->

<!--指定hdfs的nameservice为clustername,需要和core-site.xml中的保持一致 -->

<property>

    <name>dfs.nameservices</name>

    <value>ruozeclusterg6</value>

</property>

<property>

    <!--设置NameNode IDs 此版本最大只支持两个NameNode,nn1,nn2表示的是下面的hadoop001跟hadoop002的映射-->

    <name>dfs.ha.namenodes.ruozeclusterg6</name>

    <value>nn1,nn2</value>

</property>

<!-- Hdfs HA: dfs.namenode.rpc-address.[nameservice ID] rpc 通信地址 -->

<property>

    <name>dfs.namenode.rpc-address.ruozeclusterg6.nn1</name>

    <value>hadoop001:8020</value>

</property>

<property>

    <name>dfs.namenode.rpc-address.ruozeclusterg6.nn2</name>

    <value>hadoop002:8020</value>

</property>

<property>

    <!--JournalNode存放数据地址，同样需要自己创建 -->

    <name>dfs.journalnode.edits.dir</name>

    <value>/home/hadoop/app/hadoop-2.6.0-cdh5.7.0/data/dfs/jn</value>

</property>

[hadoop@hadoop001 hadoop]$ mkdir -p /home/hadoop/app/hadoop-2.6.0-cdh5.7.0/data/dfs/jn

<!--这边配置的是SSH信任关系私钥的配置，前面配置了hadoop的信任关系，这边也配置成hadoop-->

<property>

    <name>dfs.ha.fencing.ssh.private-key-files</name>

    <value>/home/hadoop/.ssh/id_rsa</value>

</property>

<!--动态许可datanode连接namenode列表 -->

<property>

    <name>dfs.hosts</name>

    <value>/home/hadoop/app/hadoop-2.6.0-cdh5.7.0/etc/hadoop/slaves</value>

</property>

mapred-site.xml

<!-- 配置 MapReduce Applications -->

<property>

    <name>mapreduce.framework.name</name>

    <value>yarn</value>

</property>

<!-- JobHistory Server ============================================================== -->

<!-- 配置 MapReduce JobHistory Server 地址 ，默认端口10020 -->

<property>

    <name>mapreduce.jobhistory.address</name>

    <value>hadoop001:10020</value>

</property>

<!-- 配置 MapReduce JobHistory Server web ui 地址， 默认端口19888 -->

<property>

    <name>mapreduce.jobhistory.webapp.address</name>

    <value>hadoop001:19888</value>

</property>

<!-- 配置 Map段输出的压缩,snappy-->

<property>

    <name>mapreduce.map.output.compress</name>

    <value>true</value>

</property>

<property>

    <name>mapreduce.map.output.compress.codec</name>

    <value>org.apache.hadoop.io.compress.SnappyCodec</value>

</property>

yarn-site.xml

<!-- 集群名称，确保HA选举时对应的集群,rm1,rm2代表了hadoop001跟hadoop002的映射 -->

<property>

    <name>yarn.resourcemanager.cluster-id</name>

    <value>yarn-cluster</value>

</property>

<property>

    <name>yarn.resourcemanager.ha.rm-ids</name>

    <value>rm1,rm2</value>

</property>

<!-- Client访问RM的RPC地址 (applications manager interface) -->

<property>

    <name>yarn.resourcemanager.address.rm1</name>

    <value>hadoop001:23140</value>

</property>

<property>

    <name>yarn.resourcemanager.address.rm2</name>

    <value>hadoop002:23140</value>

</property>

<!--yarn的资源配置-->

<property>

    <name>yarn.nodemanager.resource.memory-mb</name>

    <value>2048</value>

</property>

<property>

    <name>yarn.scheduler.minimum-allocation-mb</name>

    <value>1024</value>

    <discription>单个任务可申请最少内存，默认1024MB</discription>

</property>

<property>

    <name>yarn.scheduler.maximum-allocation-mb</name>

    <value>2048</value>

    <discription>单个任务可申请最大内存，默认8192MB</discription>

</property>

<property>

    <name>yarn.nodemanager.resource.cpu-vcores</name>

    <value>2</value>

</property>

启动流程:

1.启动journalnode：hadoop-daemon.sh start journalnode

2.格式化hadoop namenode，同时将namenode1的data文件copy到namenode2，保证一致：

hadoop namenode -format

3.zkfc格式化：hdfs zkfc -formatZK

4.启动集群：start-dfs.sh

5.启动yarn：start-yarn.sh ，手动启动第二台机器的resourcemanager：yarn-daemon.sh start resourcemanager

6.正常启动集群之后，可以通过web页面，访问hdfs端口50070以及yarn端口8088

HDFS与YARN HA部署配置文件的更多相关文章

HDFS 和YARN HA 简介
HDFS: 基础架构 1.NameNode(Master) 1)命名空间管理:命名空间支持对HDFS中的目录.文件和块做类似文件系统的创建.修改.删除.列表文件和目录等基本操作. 2)块存储管理. 使 ...
YARN HA部署架构
hadoop001: zk rm(zkfc线程) nm hadoop002: zk rm(zkfc线程) nm hadoop003: zk nm RMStateStore: 存储在ZK的/rmstor ...
Hadoop 学习笔记（九） hadoop2.2.0 生产环境部署 HDFS HA部署方法
step1:将安装包hadoop-2.2.0.tar.gz存放到某一个目录下,并解压 step2:修改解压后的目录中的文件夹/etc/hadoop下的xml配置文件(如果文件不存在,则自己创建) 包括 ...
HDFS NameNode HA 部署文档
简介: HDFS High Availability Using the Quorum Journal Manager Hadoop 2.x 中,HDFS 组件有三个角色:NameNode.DataN ...
【Hadoop】Hadoop HA 部署详细过程（架构、机器规划、配置文件、部署步骤）
1.概念.架构 2.配置文件示例.部署步骤 hadoop2.0已经发布了稳定版本了,增加了很多特性,比如HDFS HA.YARN等.最新的hadoop-2.4.1又增加了YARN HA 注意:apac ...
[转]HDFS HA 部署安装
1. HDFS 2.0 基本概念相比于 Hadoop 1.0,Hadoop 2.0 中的 HDFS 增加了两个重大特性,HA 和 Federaion.HA 即为 High Availability, ...
Hadoop 2.7.4 HDFS+YRAN HA部署
实验环境主机名称 IP地址角色统一安装目录统一安装用户 sht-sgmhadoopnn-01 172.16.101.55 namenode,resourcemanager /usr/local ...
HDFS 和 YARN 的 HA 故障切换【转】
来源:https://blog.csdn.net/u011414200/article/details/50336735 一非 HDFS HA 集群转换成 HA 集群二 HDFS 的 HA 自动切换 ...
Apache hadoop namenode ha和yarn ha ---HDFS高可用性
HDFS高可用性Hadoop HDFS 的两大问题:NameNode单点:虽然有StandbyNameNode,但是冷备方案,达不到高可用--阶段性的合并edits和fsimage,以缩短集群启动的时 ...

随机推荐

PHP 正则匹配h1的数据报错 preg_match(): Unknown modifier 'h' in
问题: $str = "<h1>this is test msg</h1>"; $ruler = "/^<h1>(.*?)</h ...
.NET 收徒，带你走向架构师。
最近感悟天命,偶有所得,故而打算收徒若干,以继吾之传承. 有缘者,可破瓶颈,走向架构师之峰,指日可待. 入门基本要求: 1.工作经验:1年或以上. 2.入门费用:10000元(RMB). 联系方式(联 ...
Hive concat函数连接后结果为null
Hive concat函数连接后结果为null concat函数是用来连接字符串的使用示例: select concat('Hello','World','Java'); 运行结果: 最近我们在做需 ...
Pick of the Week'19 | 图数据库 Nebula 第 47 周看点-- insert 的二三事
每周五 Nebula 为你播报每周看点,每周看点由本周大事件.用户问答.Nebula 产品动态和推荐阅读构成. 今天是 2019 年第 47 个工作周的周五,来和 Nebula 看看本周有什么图数据库 ...
WPF数据可视化-瀑布图
实现方式一: 将数据(Point[])根据索引沿X轴使用虚拟画布进行绘制,每个数据绘制大小为1px * 1px:最终绘制出的宽度等于数据的总长度.标记并存储当前绘制的图为PreviousBitmap; ...
MongoDB(二)：在Windows环境安装MongoDB
1. 在Windows环境安装 1.1 MongoDB下载要在Windows上安装MongoDB,首先打开MongoDB官网:https://www.mongodb.com/download-cen ...
php5.6 上传图片error代码为6 或者报错“PHP Warning: File upload error - unable to create a temporary file in Unknown on line 0”的解决办法
问题:再利用webuploader上传图片的时候发现,报错,打印了$_FILES["file"]["error"] 发现是6,找不到临时文件夹: $_FILES ...
subprocess之check_out用法
在python3中使用subprocess的check_out方法时,因为该输出为byte类型,所以如果要查看具体的内容时需要进行转码,如果转码不对话,会影响内容输出的可读性,如下: #1,输出解码不 ...
MATLAB小函数：将列向量转化为0-1矩阵
MATLAB小函数:将列向量转化为0-1矩阵作者:凯鲁嘎吉 - 博客园 http://www.cnblogs.com/kailugaji/ 将列向量转化为0-1矩阵,例如 A = 1 2 1 5 3 ...
浅谈python中selenium库调动webdriver驱动浏览器的实现原理
最近学web自动化时用到selenium库,感觉很神奇,遂琢磨了一下,写了点心得. 当我们输入以下三行代码并执行时,会发现新打开了一个浏览器窗口并访问了百度首页,然而这是怎么做到的呢? from se ...

HDFS与YARN HA部署配置文件

HDFS与YARN HA部署配置文件的更多相关文章

随机推荐

热门专题