017 Spark的运行模式（yarn模式）

1.关于mapreduce on yarn 来提交job的流程

　　yarn=resourcemanager（RM）+nodemanager（NM）

　　client向RM提交任务

　　RM向NM分配applicationMaster（AM），并找到有一个容器，生成一个MR app mstr

　　MR app mstr向RM申请资源　　

　　在NM容器中找到MR app mstr，启动开来

　　MR app mstr监控和调度TASK的运行

　　MR app mstr向RM提交信息

2.配置

　　将Hadoop的配置文件添加到Spark的classpath中，即配置spark-env.sh中的HADOOP_CONF_DIR配置信息

　　在前面local或者standalone已经配置过。

3.启动HDFS，YARN

4.启动Spark命令(后来经过验证，发现不需要也可以计算出结果)

　　在标题上说明不需要启动spark服务，这这里说一下原因：

　　因为程序在yarn框架上运行，所以需要的服务是yarn，至于spark服务，程序跑在yarn上用不到。

　　所以这里的截图被删除。

　　经过验证，想法完全正确。

5.测试client　　

　　bin/spark-submit \
　　--master yarn \
　　--deploy-mode client \
　　--class com.ibeifeng.bigdata.spark.core.TOPNSparkCore \
　　--conf "spark.ui.port=5050" \
　　/etc/opt/datas/logs-analyzer.jar

6.测试cluster 　　

　　bin/spark-submit \
　　--master yarn \
　　--deploy-mode cluster \
　　--class com.ibeifeng.bigdata.spark.core.TOPNSparkCore \
　　--conf "spark.ui.port=5050" \
　　/etc/opt/datas/logs-analyzer.jar

　　这时候，程序结果不会显示在控制台上，因为driver运行在集群上。

7.结果

017 Spark的运行模式（yarn模式）的更多相关文章

flink on yarn模式下两种提交job方式
yarn集群搭建,参见hadoop 完全分布式集群搭建通过yarn进行资源管理,flink的任务直接提交到hadoop集群 1.hadoop集群启动,yarn需要运行起来.确保配置HADOOP_HO ...
012 Spark在IDEA中打jar包，并在集群上运行（包括local模式，standalone模式，yarn模式的集群运行）
一:打包成jar 1.修改代码 2.使用maven打包但是目录中有中文,会出现打包错误 3.第二种方式 4.下一步 5.下一步 6.下一步 7.下一步 8.下一步 9.完成二:在集群上运行(loc ...
spark（四）yarn上的运行模式
架构图 yarn-cluster yarn-client 区别 Yarn-cluster spark的driver运行在applicationMaster内,启动流程为: 这张图可能比较直观 Yarn ...
Spark部署三种方式介绍：YARN模式、Standalone模式、HA模式
参考自:Spark部署三种方式介绍:YARN模式.Standalone模式.HA模式http://www.aboutyun.com/forum.php?mod=viewthread&tid=7 ...
【Spark篇】---Spark中yarn模式两种提交任务方式
一.前述 Spark可以和Yarn整合,将Application提交到Yarn上运行,和StandAlone提交模式一样,Yarn也有两种提交任务的方式. 二.具体 1.yarn-clien ...
spark的运行模式
1.local(本地模式) 单机模式,通常用来测试将spark应用以多线程方式,直接运行在本地本地模式可以启动多个executor不过上限不能超过cpu数 2.standalone(独立模式) 独 ...
Spark的运行模式(2)--Yarn-Cluster和Yarn-Client
3. Yarn-Cluster Yarn是一种统一资源管理机制,可以在上面运行多种计算框架.Spark on Yarn模式分为两种:Yarn-Cluster和Yarn-Client,前者Driver运 ...
Spark的运行模式详解
Spark的运行模式是多种多样的,那么在这篇博客中谈一下Spark的运行模式一:Spark On Local 此种模式下,我们只需要在安装Spark时不进行hadoop和Yarn的环境配置,只要将S ...
Spark on YARN模式的安装（spark-1.6.1-bin-hadoop2.6.tgz + hadoop-2.6.0.tar.gz）（master、slave1和slave2）（博主推荐）
说白了 Spark on YARN模式的安装,它是非常的简单,只需要下载编译好Spark安装包,在一台带有Hadoop YARN客户端的的机器上运行即可. Spark on YARN简介与运行wor ...

随机推荐

拿webshell权限方法（一）
概念 Webshell就是以asp,php,jsp或cgi等网页文件形式存在的一种命令执行环境,也可以将其称为一种网页后门. Access数据库拿webshell 首先看是否能找到网站漏洞进行网站的后 ...
Seafile 网络磁盘
Seafile 个人网盘 1.安装 Seafile 1.安装依赖环境使用 yum 安装 Python 及 MySQL: yum install python python-setuptools p ...
Prometheus 监控 Nginx 流量 (三）
介绍基于Openresty和Prometheus.Consul.Grafana设计的,实现了针对域名和Endpoint级别的流量统计,使用Consul做服务发现.KV存储,Grafana做性能图展示 ...
表单之input的样式修改
修改placeholder字体颜色 html5为input添加了原生的占位符属性placeholder,高级浏览器都支持这个属性,例如: <input type="text" ...
mysql逗逼的.frm文件恢复数据库
mysql数据库用.frm文件进行恢复. 背景:mac系统 .frm文件 (1)打开终端:输入cd /usr/local 回车. (2)输入 ls 回车. 这时候打开finder ---> ...
log4j日志日记记录使用教程
注意:每次引入Logger的时候注意引入的jar包,因为有Logger的包太多了...... Logger必须作为类的静态变量使用.原因如下: 1 使用static修饰的属性是归这个类使用的2 也就是 ...
ubuntu 禁用 nouveau 方法
(1)直接移除这个驱动(备份出来) $ mv /lib/modules/4.4.0-31-generic/kernel/drivers/gpu/drm/nouveau/nouveau.ko /lib/ ...
MHL技术剖析，比HDMI更强【转】
转自:http://blog.chinaunix.net/uid-22030783-id-3294750.html MHL这个只是经常听说,没有见过的东西,现在已经非常火热了,我们才刚刚开始做,人家三 ...
springboot系列十一、redisTemplate和stringRedisTemplate对比、redisTemplate几种序列化方式比较
一.redisTemplate和stringRedisTemplate对比 RedisTemplate看这个类的名字后缀是Template,如果了解过Spring如何连接关系型数据库的,大概不会难猜出 ...
025_set专题
一.sed过滤maven的setting文件的XML注释 sed 's///g' /usr/local/apache-maven-3.5.0/conf/settings. ...

017 Spark的运行模式（yarn模式）

017 Spark的运行模式（yarn模式）的更多相关文章

随机推荐

热门专题