flink：StreamGraph转换为JobGraph

1 转换基本流程

2 简单来看可以分为两部分：

第一部分是通过一些util、translator、generator等类将职责进行解耦、托管和分离，期间涉及FlinkPipelineTranslationUtil、FlinkPipelineTranslator/StreamGraphTranslator、StreamingJobGraphGenerator等。

第二部分最终转换的操作落在StreamingJobGraphGenerator中，涉及StreamGraph、StreamEdge、StreamConfig、JobGraph、JobVertex等，下面主要关注点在第二步：

3 StreamingJobGraphGenerator的构造方法和成员变量

唯一构造方法：

将StreamGraph对象作为参数传递进来，并初始化一个JobGraph空壳和一系列的成员变量（主要是map，需要保持各种对应关系），用于存储转换的中间态

从命名不难看出各个map的作用，核心套路大多是用节点id或者节点的hash值映射节点

4 StreamingJobGraphGenerator.createJobGraph方法

主要要弄清楚StreamNode转化成JobVertex、算子合并、边上下游关系转换的核心逻辑

4.1 StreamingJobGraphGenerator.createChain方法

这里主要是把SteamNode转化为JobVertex,并根据按需合并算子

步骤：

a、在调用时遍历节点，并通过builtVertices保存已经处理过的节点

b，判断outEdge能不能chain，分门别类放到不同的List集合中待处理

c、对于能chain的节点，就把自己衔接到前一个上面去，把衔接的路径存储下来，然后再把衔接的前一个和自己的后一个再递归调用拿去计算

d、对于不能chain的节点，就作为一个头节点来单独处理掉

e、然后维护单个/合并后的关系，包括合并后的命名、资源、格式化方式等

f、处理转换逻辑，如果是头就创建个JobVertex返回StreamConfig，如果不是就创建个StreamConfig

4.2 StreamingJobGraphGenerator.isChainable方法

决定StreamEdge两边能否chian的逻辑：

4.3 StreamingJobGraphGenerator.createChainedName方法

这个是处理合并后的命名，在日志中或者生成的图中可以看到

4.4 StreamingJobGraphGenerator.createJobVertex方法

这里是StreamNode转变为JobVertex的真正实现，其实也很简单，第一步根据节点的输出new出不同类型的JobVertex，第二步把StreamNode的执行参数复制过来，第三步把自己和相关的映射关系填充到jobGraph和相应的map中去

4.5 StreamingJobGraphGenerator.connect方法

5 总的来看由于在StreamGraph中已经构建好了DAG的关系和映射，此过程中最核心的逻辑就是在createChain合并算子的过程。

6、下面是JobGraph、JobVertex和JobEdge的主要属性，可以对比StreamGraph、StreamNode和StreamEdge来理解

flink：StreamGraph转换为JobGraph的更多相关文章

追源索骥：透过源码看懂Flink核心框架的执行流程
li,ol.inline>li{display:inline-block;padding-right:5px;padding-left:5px}dl{margin-bottom:20px}dt, ...
flink学习笔记：DataSream API
本文为<Flink大数据项目实战>学习笔记,想通过视频系统学习Flink这个最火爆的大数据计算框架的同学,推荐学习课程: Flink大数据项目实战:http://t.cn/EJtKhaz ...
flink学习笔记-flink实战
说明:本文为<Flink大数据项目实战>学习笔记,想通过视频系统学习Flink这个最火爆的大数据计算框架的同学,推荐学习课程: Flink大数据项目实战:http://t.cn/EJtKh ...
Flink学习笔记-支持的数据类型
说明:本文为<Flink大数据项目实战>学习笔记,想通过视频系统学习Flink这个最火爆的大数据计算框架的同学,推荐学习课程: Flink大数据项目实战:http://t.cn/EJtKh ...
Flink 灵魂两百问，这谁顶得住？
Flink 学习 https://github.com/zhisheng17/flink-learning 麻烦路过的各位亲给这个项目点个 star,太不易了,写了这么多,算是对我坚持下来的一种鼓励吧 ...
Flink源码分析 - 剖析一个简单的Flink程序
本篇文章首发于头条号Flink程序是如何执行的?通过源码来剖析一个简单的Flink程序,欢迎关注头条号和微信公众号"大数据技术和人工智能"(微信搜索bigdata_ai_tech) ...
透过源码看懂Flink核心框架的执行流程
前言 Flink是大数据处理领域最近很火的一个开源的分布式.高性能的流式处理框架,其对数据的处理可以达到毫秒级别.本文以一个来自官网的WordCount例子为引,全面阐述flink的核心架构及执行流程 ...
[源码解析] 当 Java Stream 遇见 Flink
[源码解析] 当 Java Stream 遇见 Flink 目录 [源码解析] 当 Java Stream 遇见 Flink 0x00 摘要 0x01 领域 1.1 Flink 1.2 Java St ...
Flink源码阅读(1.7.2)
目录 Client提交任务 flink的图结构 StreamGraph OptimizedPlan JobGraph ExecutionGraph flink部署与执行模型 Single Job Jo ...

随机推荐

获取和设置pdf目录
目录前言工具获取pdf目录获取toc格式目录获取json格式目录设置pdf目录结语前言获取pdf目录:主要场景是为了拿到目录信息做编辑,从pdf软件里面一个个复制那肯定费时费力. 设 ...
(PatchGANs)Pecomputed Real-time Texture Synthesis With Markovian Generative Adversarial Networks
Introduction: Deconvolution; Computational costs; Strided convolutional nets; Markov patches; 1. Q ...
Moment.js常见用法总结
Moment.js常见用法总结 Moment.js是一个轻量级的JavaScript时间库,它方便了日常开发中对时间的操作,提高了开发效率. 日常开发中,通常会对时间进行下面这几个操作:比如获取时 ...
用匿名内部类实现 Java 同步回调
在一个应用系统中,不论使用何种编程语言,模块之间要进行调用,仅存在三种方式:同步调用.异步调用.回调.本文就其中回调方式进行详细解读,并通过匿名内部类的手段,在最后实现一个同步回调的过程. 一.回调的 ...
解决Linux-Centos7启动Mysql服务失败丢失mysql.sock问题
在新安装mysql后进行启动发现报错 mysql启动服务命令 systemctl start mysqld@3306 Starting mysqld (via systemctl): Job for ...
axios前端登录
1.创建一个Login.vue页面 1.1 写页面 views/Login.vue 在 views/components 下创建 Login.vue 页面 1.2 src/router/index.j ...
uniapp微信小程序分享
触发代码如: <button open-type="share">分享</button> 在JS中分享进入页面传参,和微信小程序路由传参的思路是一样的. ...
java的for循环中遇到异常抛出后继续循环执行
@Testpublic void loopTryCatchTest() throws Exception { Map<String, Object> a = new HashMap(); ...
配置内网访问的TV
前言通过内网模式访问tv远程机器方法云主机配置一台云主机,云主机申请两个公网IP 云主机启动两个frps进程绑定到两个内网的ip 客户端配置远程一台linux跳板机运行frpc,启动两个进程 ...
K8S环境的Jenkin性能问题描述
Return Homezq2599 CnBlogsHomeContactAdminPosts - 75 Articles - 0 Comments - 16 K8S环境的Jenkin性能问题处理环境 ...

flink：StreamGraph转换为JobGraph

flink：StreamGraph转换为JobGraph的更多相关文章

随机推荐

热门专题