JStorm之Topology调度

topology在服务端提交过程中，会经过一系列的验证和初始化：TP结构校验、创建本地文件夹并拷贝序列化文件jar包、生成znode用于存放TP和task等信息，最后一步才进行任务分配。例如以下图：

watermark/2/text/aHR0cDovL2Jsb2cuY3Nkbi5uZXQvbGlobTBfMQ==/font/5a6L5L2T/fontsize/400/fill/I0JBQkFCMA==/dissolve/70/gravity/Center" alt="" />
提交主函数位于ServiceHandler.java中

private void makeAssignment(String topologyName, String topologyId,

		TopologyInitialStatus status) throws FailedAssignTopologyException {

	//1、创建topology的分配事件

	TopologyAssignEvent assignEvent = new TopologyAssignEvent();

	assignEvent.setTopologyId(topologyId);

	assignEvent.setScratch(false);

	assignEvent.setTopologyName(topologyName);

	assignEvent.setOldStatus(Thrift

			.topologyInitialStatusToStormStatus(status));

  //2、丢入事件处理队列

	TopologyAssign.push(assignEvent);

  //3、等待时间返回

	boolean isSuccess = assignEvent.waitFinish();

	if (isSuccess == true) {

		LOG.info("Finish submit for " + topologyName);

	} else {

		throw new FailedAssignTopologyException(

				assignEvent.getErrorMsg());

	}

}

这当中最基本的是事件丢入队列后兴许的处理过程。事件分配由TopologyAssign线程处理，这个线程的流程非常清晰，监听事件队列。一旦有事件进入，立即取出，进行doTopologyAssignment，例如以下：

public void run() {

	LOG.info("TopologyAssign thread has been started");

	runFlag = true;

	while (runFlag) {

		TopologyAssignEvent event;

		try {

			event = queue.take();

		} catch (InterruptedException e1) {

			continue;

		}

		if (event == null) {

			continue;

		}

		boolean isSuccess = doTopologyAssignment(event);

		..............

}

任务分配的核心代码位于TopologyAssign.java中

public Assignment mkAssignment(TopologyAssignEvent event) throws Exception {

	String topologyId = event.getTopologyId();

	LOG.info("Determining assignment for " + topologyId);

	TopologyAssignContext context = prepareTopologyAssign(event);

	Set<ResourceWorkerSlot> assignments = null;

	if (!StormConfig.local_mode(nimbusData.getConf())) {

		IToplogyScheduler scheduler = schedulers

				.get(DEFAULT_SCHEDULER_NAME);

		//開始进行作业的调度

		assignments = scheduler.assignTasks(context);

	} else {

		assignments = mkLocalAssignment(context);

	}

	............

}

调用栈例如以下：

分配原理是首先获得全部可用的supervisor，推断supervisor可用的标准是是否有空暇的slot，也就是是否全部supervisor.slots.ports指定port都被占用，然后计算出须要分配几个woker。由于一个woker相应一个port，当然这些信息的採集都是来自Zookeeper，如今我们来分析分配的核心代码：
WorkerMaker.java
//注意參数，result是这个作业须要的槽位。传入前仅仅知道须要槽位的数量，详细分配到哪台supervisor上还没指定
//supervisors指当前集群中全部可用的supervisor。即有空暇port的

private void putWorkerToSupervisor(List<ResourceWorkerSlot> result,

		List<SupervisorInfo> supervisors) {

	int key = 0;

	//按所需槽位遍历，每次分配一个

	for (ResourceWorkerSlot worker : result) {

		//首先进行必要的推断和置位

		if (supervisors.size() == 0)

			return;

		if (worker.getNodeId() != null)

			continue;

		if (key >= supervisors.size())

			key = 0;

		//1、取出第一个supervisor

		SupervisorInfo supervisor = supervisors.get(key);

		worker.setHostname(supervisor.getHostName());

		worker.setNodeId(supervisor.getSupervisorId());

		worker.setPort(supervisor.getWorkerPorts().iterator().next());

		//槽位用完则从集合中删除，不再參与分配

		supervisor.getWorkerPorts().remove(worker.getPort());

		if (supervisor.getWorkerPorts().size() == 0)

			supervisors.remove(supervisor);

		//当一个supervisor分配完后便不再使用。除非supervisor不够用

		key++;

	}

}

从上面的代码中我们能够看到，眼下槽位分配没考虑机器负载，槽位的分配并不一定平均，比方第一个supervisor有10个槽位，剩下的supervisor仅仅有两个，那么还是要每一个supervisor分配一个woker的。

注意一个问题，在上面代码中supervisors这个集合是经过排序的，排序规则例如以下：

private void putAllWorkerToSupervisor(List<ResourceWorkerSlot> result,

		List<SupervisorInfo> supervisors) {

	...........

	supervisors = this.getCanUseSupervisors(supervisors);

	Collections.sort(supervisors, new Comparator<SupervisorInfo>() {

		@Override

		public int compare(SupervisorInfo o1, SupervisorInfo o2) {

			// TODO Auto-generated method stub

			return -NumberUtils.compare(o1.getWorkerPorts().size(), o2

					.getWorkerPorts().size());

		}

	});

	this.putWorkerToSupervisor(result, supervisors);

	.............

}

能够看到。当前排序规则是按slot多少的，我们兴许版本号中可能会考虑机器负载的一些因素吧。

JStorm之Topology调度的更多相关文章

流量计算-Jstorm提交Topology过程(下一个)
马上部分流量计算-Jstorm提交Topology过程(上), 5.上篇任务已经ServiceHandler.submitTopologyWithOpts()方法.在该方法中,会实例化一个Topolo ...
流式计算-Jstorm提交Topology过程(上)
Topology是Jstorm对有向无环图的抽象,内部封装了数据来源spout和数据处理单元bolt,以及spout和bolt.bolt和bolt之间的关系.它能够被提交到Jstorm集群. 本文以J ...
Storm和JStorm(阿里的流处理框架)
本文导读: 1.What——JStorm是什么? 1.1 概述 .2优点 .3应用场景 .4JStorm架构 2.Why——为什么启动JStorm项目?(与storm的区别) .1storm的现状.缺 ...
阿里jstorm和storm区别
转自:https://www.cnblogs.com/cn-leodream/p/6497277.html 看介绍文档貌似挺好:https://github.com/alibaba/jstorm ...
jstorm之于storm
关于流处理框架,在先前的文章汇总已经介绍过Strom,今天学习的是来自阿里的的流处理框架JStorm.简单的概述Storm就是:JStorm 比Storm更稳定,更强大,更快,Storm上跑的程序,一 ...
阿里的STORM——JSTORM
看介绍文档貌似挺好:https://github.com/alibaba/jstorm 阿里拥有自己的实时计算引擎类似于hadoop 中的MR 开源storm响应太慢开源社区的速度完全跟不上A ...
JStorm学习
一.简介 JStorm是一个分布式实时计算引擎.JStorm是一个类似于Hadoop MapReduce的系统,用户按照指定的接口实现一个任务,然后将这个任务交给JStorm系统,JStorm将这个任 ...
JStorm：概念与编程模型
1.集群架构 JStorm从设计的角度,就是一个典型的调度系统,简单集群的架构如下图所示,其中Nimbus可增加一个备节点,多个Supervisor节点组成任务执行集群. 1.1.Nimbus Nim ...
让Storm插上CEP的翅膀 - Siddhi调研和集成
什么是 Siddhi? Siddhi 是一种 lightweight, easy-to-use, open source CEP(Complex Event Processing)引擎,由wso2公司 ...

随机推荐

Llama－impala on yarn的中间协调服务
本文基于CDH发行版下的Hadoop Yarn和Impala 早期的Impala版本号中.为了使用Impala.我们一般会在以Client/Server的结构在各个集群节点启动impala-serve ...
SQL纯手写创建数据库到表内内容
建表啥的只点点鼠标,太外行了,不如来看看我的纯手写,让表从无到有一系列:还有存储过程临时表,不间断的重排序: 一:建数据库 create Database Show on primary ( name ...
Java基础——增强for循环
java1.5版本引入了一个增强for循环,基本原理和for循环类似. 语法声明:for(表达式:条件表达式) 举例:for (String str : set) 解释:set代表set集合,str代 ...
<video> controlsList
Audio/Video Updates in Chrome 58 <video controls controlsList="nofullscreen nodownload norem ...
P1343 地震逃生
题目描述汶川地震发生时,四川**中学正在上课,一看地震发生,老师们立刻带领x名学生逃跑,整个学校可以抽象地看成一个有向图,图中有n个点,m条边.1号点为教室,n号点为安全地带,每条边都只能容纳一定量 ...
android 打包工具
sdk.jar-修改路径-JarToDex-DexToSmali-复制文件
Java基础之Colloction
0 引言以下是介绍Java有关集合类,以及对应每个类的用途,同时进行比较集合类的不同特点来让我们深入了解. 1 Collction接口 Collection是最基本的集合接口,一个Collectio ...
Day 04 [与用户交互，格式化输出，基本运算符]
Python 的与用户交互 name=input("请输入姓名:") height=input('请输入身高:') weight=input('请输入体重:') 在python3中 ...
Windows下安装XAMPP，Wordpress
配置XAMPP: 1.下载:https://www.apachefriends.org/zh_cn/download.html(下载速度日了狗!) 2.安装XAMPP; 3.启动apache, ...
iOS开发——GPUImage源码解析
一.基本概念 GPUImage:一个开源的.基于openGL的图片或视频的处理框架,其本身内置了多达120多种常见的滤镜效果,并且支持照相机和摄像机的实时滤镜,并且能够自定义图像滤镜.同时也很方便在原 ...

JStorm之Topology调度

JStorm之Topology调度的更多相关文章

随机推荐

热门专题