Flink整体执行流程

以Flink源码中自带的WordCount为例，执行的入口从用户程序的execute()函数入手，execute()的源码如下：

 public JobExecutionResult execute(String jobName) throws Exception {

         StreamGraph streamGraph = getStreamGraph();

         streamGraph.setJobName(jobName);

         JobGraph jobGraph = streamGraph.getJobGraph();

         . . . . . . .

         LocalFlinkMiniCluster exec = new LocalFlinkMiniCluster(configuration, true);

         try {

             exec.start();

             return exec.submitJobAndWait(jobGraph, getConfig().isSysoutLoggingEnabled());

         }

         finally {

             transformations.clear();

             exec.stop();

         }

     }

　　函数内部主要有getStreamGraph()、getJobGraph()、exec.start()、exec.submitJobAndWait()等。getStreamGraph()的作用是生成StreamGraph图，getJobGraph()的作用是生成JobGraph的图，exec.start()的作用是建立Client、JobManager、TaskManager三者之间通信初始化，exec.submitJobAndWait()的作用提交job并且等待job执行后的结果，该函数提供了任务执行调度执行的入口，进入Client类中，首先执行createUserCodeClassLoader()函数，创建用户代码的加载器，然后执行jobClient.SubmitJobAndWait()，进入JobClient类，在函数内部会执行submit函数，从该函数开始进入AKKA通信阶段，首先会进入JobClientActor，会创建一个jobclientActor来对JobManager和client进行通信，当通信对象创建之后，会执行akka机制的ask函数，该函数的作用是发出一个消息，然后要求收到方给予回复。当消息发出之后，OnReceive()函数会收到actor发出的消息请求，然后调用handleMessage()方法来处理消息请求，该函数内部有connectToJobManager()方法，此方法内部的tryToSubmitJob()函数是正式提交任务的操作，主要做的工作就是uploadUserJars()上传用户程序的jar文件，接着会jobManager.tell()向JobManager发出一个submit消息请求。

　　当JobManager收到Client发送的消息之后，会执行JobManager内部的submitJob方法，

 case SubmitJob(jobGraph, listeningBehaviour) =>

       val client = sender()

       val jobInfo = new JobInfo(client, listeningBehaviour, System.currentTimeMillis(),

         jobGraph.getSessionTimeout)

       log.info("liuzf---开始执行JobManager的submitJob()")

       submitJob(jobGraph, jobInfo)

　首先会把由client收到的job信息封装在jobinfo中，然后把jobinfo以及job的任务图jobGraph一起发送给submit()去执行，在JobManager的submit函数中处理的函数逻辑比较复杂，比较重要的函数执行过程如下：

 private def submitJob(jobGraph: JobGraph, jobInfo: JobInfo, isRecovery: Boolean = false): Unit = {

         try {

           libraryCacheManager.registerJob(jobGraph.getJobID, jobGraph.getUserJarBlobKeys,

             jobGraph.getClasspaths)

         }

         val userCodeLoader = libraryCacheManager.getClassLoader(jobGraph.getJobID)

         }

         executionGraph = ExecutionGraphBuilder.buildGraph()

             try {

               submittedJobGraphs.putJobGraph(new SubmittedJobGraph(jobGraph, jobInfo))

           jobInfo.notifyClients(

             decorateMessage(JobSubmitSuccess(jobGraph.getJobID)))

             log.info(s"开始调度 job $jobId ($jobName).")

             executionGraph.scheduleForExecution()

　　首先执行libraryCacheManager.registerJob()，向CacheManager进行注册，请求缓存，然后执行getClassLoader()来加载用户的代码加载器，接下来会调用ExecutionGraph中的buildGraph()构造ExecutionGraph的并行化版本的执行图，当逻辑执行图构造完毕之后，这时候可以通知Client任务已经成功提交，并且提交过程结束。接下来会调用sheduleForExecution()来会整体的资源进行调度分配，主要是每个TaskManager中的slot的分配，并且当slot分配完成之后，所有的task的任务状态发生改变，由CREATEDàSCHEDULED。接下分配完之后，接下来执行depolyToSlot()函数，就要进入部署状态，同样会执行transitionState()函数，将SCHEDULED状态变为DEPOLYING状态，接着的重要函数是shumitTask()函数，该函数会通过AKKA机制，向TaskManager发出一个submitTask的消息请求，TaskManager收到消息请求后，会执行submitTask()方法，该函数的重要执行过程如下：

 public submitTask(){

      val task = new Task(. . . .)

       log.info(s"Received task ${task.getTaskInfo.getTaskNameWithSubtasks()}")

       val execId = tdd.getExecutionAttemptId

       val prevTask = runningTasks.put(execId, task)

       if (prevTask != null) {

               runningTasks.put(execId, prevTask)

         throw new IllegalStateException("TaskM}anager already contains a task for id " + execId)

       }

       task.startTaskThread()

       sender ! decorateMessage(Acknowledge.get())

     }

　　首先执行Task的构造函数，生成具体物理执行的相关组件，比如ResultPartition等，最后创建执行Task的线程，然后调用startTaskThread()来启动具体的执行线程，Task线程内部的run()方法承载了被执行的核心逻辑，该方法具体的内容为：

 public void run() {

         while (true) {

             ExecutionState current = this.executionState;

             if (current == ExecutionState.CREATED) {

                 if (transitionState(ExecutionState.CREATED, ExecutionState.DEPLOYING)) {

                     break;

                 }

             }

             invokable = loadAndInstantiateInvokable(userCodeClassLoader, nameOfInvokableClass);

             network.registerTask(this);

             Environment env = new RuntimeEnvironment(. . . . );

             invokable.setEnvironment(env);

             // ----------------------------------------------------------------

             //  actual task core work

             if (!transitionState(ExecutionState.DEPLOYING, ExecutionState.RUNNING)) {

             }

             // notify everyone that we switched to running

             notifyObservers(ExecutionState.RUNNING, null);

             executingThread.setContextClassLoader(userCodeClassLoader);

             // run the invokable

             invokable.invoke();

             if (transitionState(ExecutionState.RUNNING, ExecutionState.FINISHED)) {

                 notifyObservers(ExecutionState.FINISHED, null);

             }

             Finally{

                 // free the network resources

                 network.unregisterTask(this);

                 // free memory resources

                 if (invokable != null) {

                     memoryManager.releaseAll(invokable);

                 }

                 libraryCache.unregisterTask(jobId, executionId);

                 removeCachedFiles(distributedCacheEntries, fileCache);

　　首先执行transitionState()函数将TaskManager的状态由CREATED转变为DEPOLYING状态，然后调用loadAndTrantiateInvokable()对用户代码打包成jar包，并且生成用户代码加载器，然后执行network.registerTask()，执行该函数之前，会执行NetworkEnvironment的构造函数，该类是TaskManager通信的主对象，主要用于跟踪中间结果并负责所有的数据交换，在该类中会创建协助通信的关键部件，比如网络缓冲池，连接管理器，结果分区管理器，结果分区可消费通知器等。当网络对象准备完成后，创建一个运行环境，然后执行invoke.setEnvironment(env)，将各种配置打包到运行环境中。

　　当运行环境准备之后，接下来到了具体分析任务执行的时候，首先会调用transitionState()函数将任务状态由DEPOLYING改为RUNNING状态，然后会调用notifyObservers()通知所有的task观察者也改变状态，然后执行setContextClassLoader()将执行的类加载器设置为用户执行的加载器，然后执行invokable.invoke()，该函数是分界点，执行前用户逻辑没有被触发，执行之后说明用户逻辑已完成。当执行完成之后，调用transitionState()函数执行的RUNNING状态改成FINISHED状态。同样调用notifyObservers()来通知其他观察者改变状态，最后，释放资源。

总体的函数执行图如下：因图片太大------>>>>>

链接: https://pan.baidu.com/s/15F1rBAmTSmNrkC8I4GmKnA 密码: du23

Flink整体执行流程的更多相关文章

[源码分析] 带你梳理 Flink SQL / Table API内部执行流程
[源码分析] 带你梳理 Flink SQL / Table API内部执行流程目录 [源码分析] 带你梳理 Flink SQL / Table API内部执行流程 0x00 摘要 0x01 Apac ...
JavaScript 引擎 V8 执行流程概述
本文首发于 vivo互联网技术微信公众号链接:https://mp.weixin.qq.com/s/t__Jqzg1rbTlsCHXKMwh6A作者:赖勇高本文主要讲解的是V8的技术,是V8的入 ...
Apache Flink 进阶（六）：Flink 作业执行深度解析
本文根据 Apache Flink 系列直播课程整理而成,由 Apache Flink Contributor.网易云音乐实时计算平台研发工程师岳猛分享.主要分享内容为 Flink Job 执行作业的 ...
追源索骥：透过源码看懂Flink核心框架的执行流程
li,ol.inline>li{display:inline-block;padding-right:5px;padding-left:5px}dl{margin-bottom:20px}dt, ...
透过源码看懂Flink核心框架的执行流程
前言 Flink是大数据处理领域最近很火的一个开源的分布式.高性能的流式处理框架,其对数据的处理可以达到毫秒级别.本文以一个来自官网的WordCount例子为引,全面阐述flink的核心架构及执行流程 ...
Apache Flink 整体介绍
前言 Flink 是一种流式计算框架,为什么我会接触到 Flink 呢?因为我目前在负责的是监控平台的告警部分,负责采集到的监控数据会直接往 kafka 里塞,然后告警这边需要从 kafka topi ...
轻量级前端MVVM框架avalon - 执行流程2
接上一章执行流程1 在这一大堆扫描绑定方法中应该会哪些实现? 首先我们看avalon能帮你做什么? 数据填充,比如表单的一些初始值,切换卡的各个面板的内容({{xxx}},{{xxx|html}}, ...
struts2 之【struts2简介，struts2开发步骤，struts2详细配置，struts2执行流程】
入门框架学习避免不了的问题: 1. 什么是框架? 简单的说,框架就是模板,模子,模型.就是一个可重用的半成品. 2. 如何学习框架? 学习框架其实就是学习规则,使用框架就是遵循框架的规则,框架是可变的 ...
Spring Boot程序的执行流程
Spring Boot的执行流程如下图所示:(图片来源于网络) 上图为SpringBoot启动结构图,我们发现启动流程主要分为三个部分,第一部分进行SpringApplication的初始化模块,配置 ...

随机推荐

ARM工作模式寻址
用户模式(User) usr 快速中断模式(FIQ) fiq 普通终端模式(IRQ) irq 保护模式(Supervisor) svc 数据访问终止模式(Abo ...
nova计算服务分布式
控制节点 #第一步控制节点下载nova-conpute包 #安装依赖包 #vim /etc/nova/nova.conf [DEFAULT] my_ip=#当前节点IP use_neutron = ...
jmeter做websocket协议的接口测试
1.首先介绍一下我们要测试的接口的业务流程: (1)http协议登录,登录成功获取一个clientsessionid,时效30Min (2)用这个clientsessionid+登陆的用户名建立连接s ...
牛客假日团队赛5 K 金币馅饼（DP 基础题）
链接:https://ac.nowcoder.com/acm/contest/984/K 来源:牛客网金币馅饼时间限制:C/C++ 1秒,其他语言2秒空间限制:C/C++ 32768K,其他语言 ...
Atcoder Regular 098 区间Pre=Xor Q询问区间连续K去最小值最小极差
C 用scanf("%s")就会WA..不知道为什么 /*Huyyt*/ #include<bits/stdc++.h> #define mem(a,b) memset ...
Java并发编程实战第2章线程安全性
编写线程安全的代码,核心在与对共享的和可变的对象的状态的访问. 如果多个线程访问一个可变的对象时没有使用同步,那么就会出现错误.在这种情况下,有3中方式可以修复这个问题: 不在线程之间共享该状态变量 ...
【串线篇】SpringBoot数据访问【数据源/mybatis/指定映射文件位置】
一.配置数据源 1.1.jdbc版本 JDBC(.tomcat.jdbc.pool.DataSource作为数据源) <?xml version="1.0" encoding ...
CSS中filter属性的使用
filter 属性定义了元素的可视效果 blur 给图像设置高斯模糊."radius"一值设定高斯函数的标准差,或者是屏幕上以多少像素融在一起, 所以值越大越模糊. 如果没有设定值 ...
node 中process进程argv,argv0,execArgv,execPath
1.argv const {argv,argv0,execPath v,execPath} = process; argv.forEach(item=>{ console.log(item); ...
vue.js 深度监测
1.select 控件赋值改变,但是无法获取解决方法,在监测时手动赋值新值 'model.UseType': { handler(newVal, oldVal) { $("#UseType ...

Flink整体执行流程

Flink整体执行流程的更多相关文章

随机推荐

热门专题