014 再次整理关于hadoop中yarn的原理及运行

一：对yarn的理解

1.关于yarn的组成

　　大约分成主要的四个。

　　Resourcemanager，Nodemanager，Applicationmaster，container

2.Resourcemanager（RM）的理解

　　RM是全局资源管理器，负责整个系统的资源管理和分配。

　　主要由两个组件组成：调度器和应用程序管理器（ASM）

　　调度器：根据容量，队列等限制条件，将系统中的资源分配给各个正在运行的应用程序，不负责具体应用程序的相关工作，比如监控或跟踪状态

　　应用程序管理器：负责管理整个系统中所有应用程序

3.Applicationmaster(AM)

　　用户提交的每个应用程序均包含一个AM

　　AM的主要功能：

　　　　(1)与RM调度器协商以获取资源（用Container表示）

　　　　(2)将得到的任务进一步分配给内部的任务

　　　　(3)与NM通信以自动/停止任务

　　　　(4)监控所有任务运行状态，并在任务运行失败时重新为任务申请资源以重启任务

　　当前YARN自带了两个AM实现：

　　　　一个用于演示AM编写方法的实例程序distributedshell

　　　　一个用于Mapreduce程序---MRAppMaster

　　其他的计算框架对应的AM正在开发中，比如Spark等

4.Nodemanager

　　NM是每个节点上的资源和任务管理器

　　　　(1)定时向RM汇报本节点上的资源使用情况和各个Container的运行状态

　　　　(2)接收并处理来自AM的Container启动/停止等各种要求

5.container　　

　　Container是YARN中的资源抽象，它封装了某个节点上的多维度资源

YARN会为每个任务分配一个Container，且该任务只能使用该Container中描述的资源

二：mapreduce在yarn上运行

1.流程图

2.流程

　　(1)：由客户端提交一个应用，由RM的ASM接受应用请求

　　提交过来的应用程序包括哪些内容：

　　a:ApplicationMaster

　　b:启动Applicationmaster的命令

　　c:本身应用程序的内容

　　(2):提交了三部分内容给RM，然后RM找NodeManager,然后Nodemanager就启用Applicationmaster，并分配Container

　　　　接下来我们就要执行这个任务了，

　　(3):但是执行任务需要资源，所以我们得向RM的ASM申请执行任务的资源（它会在ＲＭ这儿注册一下，说我已经启动了，注册了以后就可以通过RM的来管理，我们用户也可以通过ＲＭ的ｗｅｂ客户端来监控任务的状态）ＡＳＭ只是负责APplicationMaster的启用

　　(4)我们注册好了后，得申请资源，申请资源是通过第四步，向ResourceScheduler申请的

　　(5)申请并领取资源后，它会找Nodemanager，告诉他我应经申请到了，然后Nodemanager判断一下，

　　(6)知道他申请到了以后就会启动任务，当前启动之前会准备好环境，

　　(7)任务启动以后会跟APplicationmaster进行通信，不断的心跳进行任务的汇报。

　　(8)完成以后会给ＲＭ进行汇报，让RSM撤销注册。然后RSM就会回收资源。当然了，我们是分布式的，所以我们不会只跟自己的Nodemanager通信。也会跟其他的节点通信。

三：参考

1.连接

　　主要参考文章

　　http://blog.csdn.net/wust__wangfan/article/details/48650889

014 再次整理关于hadoop中yarn的原理及运行的更多相关文章

hadoop中yarn
一.yarn的概述 Apache Yarn(Yet Another Resource Negotiator的缩写)是hadoop集群资源管理器系统,Yarn从hadoop 2引入,最初是为了改善Map ...
Hadoop中HDFS工作原理
转自:http://blog.csdn.net/sdlyjzh/article/details/28876385 Hadoop其实并不是一个产品,而是一些独立模块的组合.主要有分布式文件系统HDFS和 ...
浅谈hadoop中mapreduce的文件分发
近期在做数据分析的时候.须要在mapreduce中调用c语言写的接口.此时就须要把动态链接库so文件分发到hadoop的各个节点上,原来想自己来做这个分发,大概过程就是把so文件放在hdfs上面,然后 ...
centos中-hadoop单机安装及伪分布式运行实例
创建用户并加入授权 1,创建hadoop用户 sudo useradd -m hadoop -s /bin/bash 2,修改sudo的配置文件,位于/etc/sudoers,需要root权限才可以读 ...
Hadoop和YARN :map+shuffle+reduce走读
今天做了一个hadoop分享,总结下来,包括mapreduce,及shuffle深度讲解,还有YARN框架的详细说明等. v\:* {behavior:url(#default#VML);} o\:* ...
hadoop MapReduce Yarn运行机制
原 Hadoop MapReduce 框架的问题原hadoop的MapReduce框架图从上图中可以清楚的看出原 MapReduce 程序的流程及设计思路: 首先用户程序 (JobClient) ...
Hadoop MapReduceV2(Yarn) 框架简介[转]
对于业界的大数据存储及分布式处理系统来说,Hadoop 是耳熟能详的卓越开源分布式文件存储及处理框架,对于 Hadoop 框架的介绍在此不再累述,读者可参考 Hadoop 官方简介.使用和学习过老 H ...
Hadoop中两表JOIN的处理方法(转)
1. 概述在传统数据库(如:MYSQL)中,JOIN操作是非常常见且非常耗时的.而在HADOOP中进行JOIN操作,同样常见且耗时,由于Hadoop的独特设计思想,当进行JOIN操作时,有一些特殊的 ...
Hadoop 中疑问解析
Hadoop 中疑问解析 FAQ问题剖析一.HDFS 文件备份与数据安全性分析1 HDFS 原理分析1.1 Hdfs master/slave模型 hdfs采用的是master/slave模型,一个 ...

随机推荐

CentOS安装git及使用Gitolite来管理版本库
首先吐槽一下网上的各种教程,大部分都扯蛋,估计都是些所谓的"编辑"在网上瞎抄来的-- 以下内容都是基于CentOS的服务器端,Mac OS X的客户端. 如果是使用的Windows ...
【转】四款经典3.7v锂电池充电电路图详解
3.7v锂电池充电电路图(一) 1.锂电池的充电: 根据锂电池的结构特性,最高充电终止电压应为4.2V,不能过充,否则会因正极的锂离子拿走太多,而使电池报废.其充放电要求较高,可采用专用的恒流.恒压充 ...
bzoj1013/luogu4035 球形空间生成器 (高斯消元)
根据各点到圆心的距离相等,可以列出有N个等号的方程假设圆心坐标是(x,y,z,...)的话,$x^2,y^2,z^2$等是可以消掉的于是整理一下,就变成了N元1次方程组,有N个方程.而且保证是相容 ...
UDP ------ UDP 和 TCP 的对比
UDP是无连接协议,客户端和服务器通信之前不需要建立握手连接: UDP没有应答机制,所以也没有重发机制,很大的可能会造成丢包.收到重复包.乱序的情况: UDP可以实现局域网广播功能,即某个主机可以向所 ...
Scala进阶之路-Scala特征类与unapply反向抽取
Scala进阶之路-Scala特征类与unapply反向抽取作者:尹正杰版权声明:原创作品,谢绝转载!否则将追究法律责任. 一.Scala特征类分析 1>.Unit 答:用于定义返回值类型, ...
python操作txt文件中数据教程[1]-使用python读写txt文件
python操作txt文件中数据教程[1]-使用python读写txt文件觉得有用的话,欢迎一起讨论相互学习~Follow Me 原始txt文件程序实现后结果程序实现 filename = '. ...
Spark记录-Scala类与对象小例子
//基类-Person class Person(val na: String, val ag: Int) { //属性 var name: String = na var age: Int = ag ...
SQL记录-PLSQL条件控制
PL/SQL条件控制决策结构需要程序员指定一个或多个条件要计算,或由程序进行测试,如果条件被确定为真那么一条或多条语句被执行,如果要被执行的其它语句条件被确定为假,则选其它执行块. 以下是从在大 ...
如何修改Linux的TTL值
原文地址:http://www.linuxidc.com/Linux/2011-11/47701.htm 网络黑客如果用ping命令去探测一个主机,根据TTL基数可以推测操作系统的类型.对于一个没 ...
OpenGL ES 2.0 Shader 调试新思路(一): 改变提问方式
OpenGL ES 2.0 Shader 调试新思路(一): 改变提问方式 --是什么(答案是具体值) VS 是不是(答案是布尔值) 目录背景介绍问题描述 Codea 是 iPad 上的一款很方便 ...

014 再次整理关于hadoop中yarn的原理及运行

014 再次整理关于hadoop中yarn的原理及运行的更多相关文章

随机推荐

热门专题