TF(1): 基础理论

TensorFlow最初由Google大脑的研究员和工程师开发出来，用于机器学习和神经网络方面的研究，于2015.10宣布开源，在众多深度学习框架中脱颖而出，在Github上获得了最多的Star量。TensorFlow最早由Google Brain研究组发起。TensorFlow在历史上机器学习时间线如下：

官网：http://www.tersorflow.org
Github网址：https://github.com/tensorflow/tensorflow
模型仓库网址：https://github.com/tensorflow/models

TensorFlow的计算可以表示为一种有向图(directed graph)，或者称计算图(computation graph)。图中每一个运算操作(operation)是一个节点(node)，节点之间的连接线称为边(edge)。计算图中的节点可以有任意多个输入和任意多个输出，每个节点都只有一个运算操作。在计算图中流动(flow)的数据被称为张量(tensor)，故得名TensorFlow。计算图示例如下：

TensorFlow关键版本发布历史

2015.11.09 在Github上开源(Ver0.5.0)
2015.12.10 支持Python3.3+，GPU性能提升...(Ver0.6.0)
2016.02.17 支持GPU使用Cuda7.0+、cuDNN R2+、cuDNN R4等运算加速库...(Ver0.7.0)
2016.04.30 通过gRPC实现分布式计算...(Ver0.8.0)
2016.06.28 支持Python3.5，支持iOS，支持Mac电脑上的GPU计算...(Ver0.9.0)
2016.09.13 添加C++ shape inference，添加graph-construction C/C++(大部分) Api...(Ver0.10.0)
2016.11.11 支持cuDNN 5、Cuda8.0，HDFS...(Ver0.11.0)
2016.12.21 支持Windows环境运行，cuDNN 5.1...(Ver0.12.0)
2017.02.16 发布正式版(Ver1.0.0)
2017.04.27 支持Windows下的Java Api...(Ver1.1.0)
2017.06.15 支持Windows下的Python 3.6...(Ver1.2.0)

前端API支持语言

Python (推荐使用，API最全面)
C++
Go
Java
Rust
Haskell
非官方(Julia、Javascript、R)

基本使用

使用Tensor表示数据
通过变量(Variable)输入训练数据，维护状态
使用计算图(computational graph)来表示计算任务
在会话(Session)的上下文（Context)来执行计算图

TensorFlow依赖视图

TF托管在github平台，有google groups和contributors共同维护。
TF提供了丰富的深度学习相关的API，如上一小节。
TF提供了可视化分析工具Tensorboard，方便分析和调整模型。
TF支持Linux平台，Windows平台，Mac平台，甚至手机移动设备等各种平台。

TF系统架构

TF的系统架构，从底向上分为设备管理和通信层、数据操作层、图计算层、API接口层、应用层。其中设备管理和通信层、数据操作层、图计算层是TF的核心层。如下图：

底层设备通信层负责网络通信和设备管理。设备管理可以实现TF设备异构的特性，支持CPU、GPU、Mobile等不同设备。网络通信依赖gRPC通信协议实现不同设备间的数据传输和更新。
第二层是Tensor的OpKernels实现。这些OpKernels以Tensor为处理对象，依赖网络通信和设备内存分配，实现了各种Tensor操作或计算。Opkernels不仅包含MatMul等计算操作，还包含Queue等非计算操作。
第三层是图计算层（Graph），包含本地计算流图和分布式计算流图的实现。Graph模块包含Graph的创建、编译、优化和执行等部分，Graph中每个节点都是OpKernels类型表示。
第四层是API接口层。Tensor C API是对TF功能模块的接口封装，便于其他语言平台调用。
第四层以上是应用层。不同编程语言在应用层通过API接口层调用TF核心功能实现相关实验和应用。

详细点的层次及功能划分，可以描述如下：

最底层是硬件计算资源，支持CPU、GPU；
支持两种通信协议；
数值计算层提供最基础的计算，有线性计算、卷积计算；
数据的计算都是以数组的形式参与计算；
计算图层用来设计神经网络的结构；
工作流层提供轻量级的框架调用
最后构造的深度学习网络可以通过TensorBoard服务端可视化

架构详解：

TensorFlow的系统结构以C API为界，将整个系统分为「前端」和「后端」两个子系统：

前端系统：提供编程模型，负责构造计算图；
后端系统：提供运行时环境，负责执行计算图。

如上图所示，重点关注系统中如下4个基本组件，它们是系统分布式运行机制的核心。

Client：

Client是前端系统的主要组成部分，它是一个支持多语言的编程环境。它提供基于计算图的编程模型，方便用户构造各种复杂的计算图，实现各种形式的模型设计。
如下图：Client构建了一个简单计算图。它首先将w与x进行矩阵相乘，再与截距b按位相加，最后更新至s。
Client基于TensorFlow的编程接口，构造计算图。
此时，TensorFlow并未执行任何计算。直至建立Session会话，并以Session为桥梁，建立Client与后端运行时的通道，将Protobuf格式的GraphDef发送至Distributed Master。也就是说，当Client对OP结果进行求值时，将触发Distributed Master的计算图的执行过程。

Distributed Master：

在分布式的运行时环境中，Distributed Master根据Session.run的Fetching参数，从计算图中反向遍历，找到所依赖的「最小子图」。
然后，Distributed Master负责将该「子图」再次分裂为多个「子图片段」，以便在不同的进程和设备上运行这些「子图片段」。
最后，Distributed Master将这些「子图片段」派发给Work Service；随后Work Service启动「子图片段」的执行过程。
如上图所示，Distributed Master开始执行计算子图。在执行之前，Distributed Master会实施一系列优化技术，例如「公共表达式消除」，「常量折叠」等。随后，Distributed Master负责任务集的协同，执行优化后的计算子图。

子片段图：

如上图所示，存在一种合理的「子图片段」划分算法。Distributed Master将模型参数相关的OP进行分组，并放置在PS任务上。其他OP则划分为另外一组，放置在Worker任务上执行。

SEND/RECV节点：

如上图所示，如果计算图的边被任务节点分割，Distributed Master将负责将该边进行分裂，在两个分布式任务之间插入SEND和RECV节点，实现数据的传递。
随后，Distributed Master将「子图片段」派发给相应的任务中执行，在Worker Service成为「本地子图」，它负责执行该子图的上的OP。

Worker Service：

对于每个任务，都将存在相应的Worker Service，它主要负责如下3个方面的职责：

1. 处理来自Master的请求；
2. 调度OP的Kernel实现，执行本地子图；
3. 协同任务之间的数据通信。

Worker Service派发OP到本地设备，执行Kernel的特定实现。它将尽最大可能地利用多CPU/GPU的处理能力，并发地执行Kernel实现。
另外，TensorFlow根据设备类型，对于设备间的SEND/RECV节点进行特化实现：

1. 使用cudaMemcpyAsync的API实现本地CPU与GPU设备的数据传输；
2. 对于本地的GPU之间则使用端到端的DMA，避免了跨host CPU昂贵的拷贝过程。

对于任务之间的数据传递，TensorFlow支持多协议，主要包括：

1. gRPC over TCP
2. RDMA over Converged Ethernet

主流框架对比

对比
社区

参考资料：

TF(1): 基础理论的更多相关文章

TFS命令tf:undo(强制签入签出文件)
由于修改计算机名称或不同电脑上操作忘记签入,则需要强制签入文件具体步骤如下: 1.在命令行中输入"cd C:\Program Files\Microsoft Visual Studio ...
制作HP MicroServer Gen8可用的ESXi 5.x SD/TF卡启动盘
前些日子看到HP公司和京东在搞服务器促销活动,于是就入了一个 ProLiant MicroServer Gen8 的低配版相比上一代产品,新一代 MicroServer系列微型服务器可更换处理器,还 ...
TF Boys (TensorFlow Boys ) 养成记（六）
圣诞节玩的有点嗨,差点忘记更新.祝大家昨天圣诞节快乐,再过几天元旦节快乐. 来继续学习,在/home/your_name/TensorFlow/cifar10/ 下新建文件夹cifar10_train ...
TF Boys (TensorFlow Boys ) 养成记（五）
有了数据,有了网络结构,下面我们就来写 cifar10 的代码. 首先处理输入,在 /home/your_name/TensorFlow/cifar10/ 下建立 cifar10_input.py,输 ...
TF Boys (TensorFlow Boys ) 养成记（四）
前面基本上把 TensorFlow 的在图像处理上的基础知识介绍完了,下面我们就用 TensorFlow 来搭建一个分类 cifar10 的神经网络. 首先准备数据: cifar10 的数据集共有 6 ...
TF Boys (TensorFlow Boys ) 养成记（三）
上次说到了 TensorFlow 从文件读取数据,这次我们来谈一谈变量共享的问题. 为什么要共享变量?我举个简单的例子:例如,当我们研究生成对抗网络GAN的时候,判别器的任务是,如果接收到的是生成器生 ...
TF Boys (TensorFlow Boys ) 养成记（二）
TensorFlow 的 How-Tos,讲解了这么几点: 1. 变量:创建,初始化,保存,加载,共享: 2. TensorFlow 的可视化学习,(r0.12版本后,加入了Embedding Vis ...
TF Boys (TensorFlow Boys ) 养成记（一）
本资料是在Ubuntu14.0.4版本下进行,用来进行图像处理,所以只介绍关于图像处理部分的内容,并且默认TensorFlow已经配置好,如果没有配置好,请参考官方文档配置安装,推荐用pip安装.关于 ...
Vue基础理论
一 vue的定位 (1)Vue.js是一个构建数据驱动的 web 界面的库. (2)Vue.js 的目标是通过尽可能简单的 API 实现响应的数据绑定和组合的视图组件. (3)Vue.js 自身不是一 ...

随机推荐

postman(八)：使用newman来执行postman脚本
通过之前的了解,我们知道postman是基于javascript语言编写的,而导出的json格式的postman脚本也无法直接在服务器运行,它需要在newman中执行(可以把newman看做postm ...
WEB UI做TREE
效果图: 原本的普通搜索帮助,改成上面这样层级的搜索帮助.这里只做了两级. 一,新建一个TREE节点 1.新建tree结构:ZGRTEXT 2.新建树叶节点处理类: 修改超类为CL_BSP_WD_TR ...
jmeter工具应用1
1.Jmeter介绍 Apache JMeter 是Apache组织的开放源代码项目,是一个纯Java桌面应用,用于压力测试和性能测量.它最初被设计用于Web应用测试但后来扩展到其它测试领域. 操 ...
tensorflow中命名空间、变量命名的问题
1.简介对比分析tf.Variable / tf.get_variable | tf.name_scope / tf.variable_scope的异同 2.说明 tf.Variable创建变量:t ...
xftp免费版使用
转自https://www.jb51.net/softs/621774.html
linux软件管理 YUM命令
yum的优点将所有软件包放到官方服务器上,当进行yum在线安装时可以自动解决依赖性问题 yum源文件 [root@ssgao1987 yum.repos.d]# cd /etc/yum.repos. ...
netty源码分析之一：server的启动
nio server启动的第一步,都是要创建一个serverSocketChannel,我截取一段启动代码,一步步分析: public void afterPropertiesSet() throws ...
linux 搭建rap记录
1 安装 jdk1.8版本及以上 2 安装 apache-tomcat 3 安装 redis 最后编辑session配置和数据库配置 <session-config><session ...
[Codeforces441E]Valera and Number
Problem 给定一个数x,有p%的概率乘2,有1-p%的概率加1,问操作k次,其二进制数下末尾零的个数的期望. Solution 每次操作只会影响到最后的8位我们用dp[i][j]表示i个操作后 ...
Python语言：下载上证股票数据程序
from urllib.request import urlretrieve f = open('SHA.csv', 'r')for line in f: data = line.split(',') ...

TF(1): 基础理论

TF(1): 基础理论的更多相关文章

随机推荐

热门专题