C++卷积神经网络实例：tiny_cnn代码具体解释（7）——fully_connected

　　之前的博文中已经将卷积层、下採样层进行了分析。在这篇博文中我们对最后一个顶层层结构fully_connected_layer类（全连接层）进行分析：

　　一、卷积神经网路中的全连接层

　　在卷积神经网络中全连接层位于网络模型的最后部分，负责对网络终于输出的特征进行分类预測，得出分类结果：

　　LeNet-5模型中的全连接层分为全连接和高斯连接，该层的终于输出结果即为预測标签，比如这里我们须要对MNIST数据库中的数据进行分类预測，当中的数据一共同拥有10类（数字0~9），因此全全连接层的终于输出就是一个10维的预測结果向量，哪一维的值为非零，则预測结果相应的就是几。

　　二、fully_connected_layer类结构

　　与之前卷积层和下採样层不同的是，这里的全连接层fully_connected_layer类继承自基类layer，当中类成员一共可分为四大部分：成员变量、构造函数、前向传播函数、反向传播函数。

　　2.1 成员变量

　　fully_connected_layer类的成员变量仅仅有一个。就是一个Filter类型的变量：

　　而这里的Filter是通过类模板參数传入的一个缺省filter_none类型，具体例如以下：

　　至于filter_none类型，从名称推断应该是一个和滤波器核相关的类封装，具体定义在dropout.h文件里：

　　有关dropout.h文件里封装的相关类的具体信息我会在之后的博文中进行具体的介绍。这里先留一个坑，只是事先透漏一点，卷积神经网络中的dropout本质上是为了改善网络过拟合性能而设计的。

　　2.2 构造函数

　　构造函数极其简单。单纯的调用了基类layer的构造函数：

　　至于基类layer，里面封装了大量的虚函数以及纯虚函数，并给出了网络层主要的框架设定。对layer_base类进行了一部分实例化，这几点我们以后会具体说的。

　　2.3 前向传播函数

　　众所周知，卷积神经网络在训练时和BP神经网络的训练极其类似。包含一个样本预測的前向传播过程和误差的反向传播过程。

首先前向传播函数的代码例如以下：

        const vec_t& forward_propagation(const vec_t& in, size_t index) {

            vec_t &a = a_[index];

            vec_t &out = output_[index];

            for_i(parallelize_, out_size_, [&](int i) {

                a[i] = 0.0;

                for (int c = 0; c < in_size_; c++)

                    a[i] += W_[c*out_size_ + i] * in[c];

                a[i] += b_[i];

            });

            for_i(parallelize_, out_size_, [&](int i) {

                out[i] = h_.f(a, i);

            });

            auto& this_out = filter_.filter_fprop(out, index);

            return next_ ?

next_->forward_propagation(this_out, index) : this_out;

        }

　　从代码中能够看出这个前向传播函数本质上属于一个递归函数，用递归的方式实现层层传播的功能：

　　在前向传播的过程中，主要有两个阶段。一是通过当前层的卷积核和偏置完毕对输入数据的映射：

　　从代码中可见，卷积层的映射过程本质上就是一个卷积操作，然后在对卷积结果累加偏置。第二个阶段就是将卷积层的映射结果送入激活函数中进行处理：

　　激活函数的主要作用是对卷积层的映射输出进行规范化。调整期数据分布。经典的激活函数是Sigmoid函数。主要对输出特征进行平滑。在之后学者又提出Relu类型的激活函数。主要是对输出特征进行稀疏化规范，使其更接近于人脑的视觉映射机理。在tiny_cnn中作者封装了sigmoid、relu、leaky_relu、softmax、tan_h、tan_hp1m2等激活函数，这些类都定义在activation命名空间中，具体在activation_function.h文件里，在兴许的篇幅中我会专门拿出一篇博文的篇幅对tiny_cnn的激活函数做集中的分析。

　　2.4 反向传播函数

　　反向传播算法是BP类型神经网络的经典特征。大部分都採用随机梯度下降法对误差进行求导和传播。因为反向传播算法涉及到误差的求偏导、灵敏度传递等概念，导致其在原理上相对于前向传播过程显得更为复杂，代码实现也较为繁琐。我们这里仅仅是先给出反向传播的代码，在兴许的博文中在针对这个传播过程进行更文具体的分析。OK，又是一个坑：

    const vec_t& back_propagation(const vec_t& current_delta, size_t index) {

            const vec_t& curr_delta = filter_.filter_bprop(current_delta, index);

            const vec_t& prev_out = prev_->output(index);

            const activation::function& prev_h = prev_->activation_function();

            vec_t& prev_delta = prev_delta_[index];

            vec_t& dW = dW_[index];

            vec_t& db = db_[index];

            for (int c = 0; c < this->in_size_; c++) {

                // propagate delta to previous layer

                // prev_delta[c] += current_delta[r] * W_[c * out_size_ + r]

                prev_delta[c] = vectorize::dot(&curr_delta[0], &W_[c*out_size_], out_size_);

                prev_delta[c] *= prev_h.df(prev_out[c]);

            }

            for_(parallelize_, 0, out_size_, [&](const blocked_range& r) {

                // accumulate weight-step using delta

                // dW[c * out_size + i] += current_delta[i] * prev_out[c]

                for (int c = 0; c < in_size_; c++)

                    vectorize::muladd(&curr_delta[0], prev_out[c], r.end() - r.begin(), &dW[c*out_size_ + r.begin()]);

                for (int i = r.begin(); i < r.end(); i++)

                    db[i] += curr_delta[i];

            });

            return prev_->back_propagation(prev_delta_[index], index);

        }

　　四、注意事项

　　1、卷积层和下採样层的前向/反向传播函数

　　在fully_connected_layer类中我们发现其内部封装了前向/反向传播函数，但在之前介绍的卷积层和均值下採样层中我们并没有发现前向/反向传播函数的影子，但前向/反向传播函数确实是一个全局的过程。不可能出现断层，因此细致研究就会发现原来作者是将convolutional_layer类和average_pooling_layer相应的前向/反向传播函数封装在了它们共同的基类：partial_connected_layer中了。

　　2、前向传播函数和反向传播函数

　　在这篇博文中我为兴许的博文中挖下了非常多大坑，尤其像前向/反向传播函数这样的卷积神经网络训练的精华部分，是最能体现作者编程功力和框架设计功力的地方，一两篇博文都不一定能讲的清楚，所以请大家不要着急，我会尽快把当中的玄机弄明确。然后用通俗的语言进行解释的，所以说。坑一定会都一一填上的。

C++卷积神经网络实例：tiny_cnn代码具体解释（7）——fully_connected_layer层结构类分析的更多相关文章

C++卷积神经网络实例：tiny_cnn代码具体解释（8）——partial_connected_layer层结构类分析（上）
在之前的博文中我们已经将顶层的网络结构都介绍完毕,包括卷积层.下採样层.全连接层,在这篇博文中主要有两个任务.一是总体贯通一下卷积神经网络在对图像进行卷积处理的整个流程,二是继续我们的类分析.这次须要 ...
C++卷积神经网络实例：tiny_cnn代码具体解释（6）——average_pooling_layer层结构类分析
在之前的博文中我们着重分析了convolutional_layer类的代码结构.在这篇博文中分析相应的下採样层average_pooling_layer类: 一.下採样层的作用下採样层的作用理论上来 ...
DeepLearning.ai学习笔记（四）卷积神经网络 -- week2深度卷积神经网络实例探究
一.为什么要进行实例探究? 通过他人的实例可以更好的理解如何构建卷积神经网络,本周课程主要会介绍如下网络 LeNet-5 AlexNet VGG ResNet (有152层) Inception 二. ...
C++卷积神经网络实例（一）
跟着这位博主来学习C++的卷积网络实例,因为作者一直在更新代码,所以新的代码和这位博主的分析有所不同:这位博主写的东西太泛了,没有讲到实质, 可以参考下他分析的类与类之间的关系图.. 前四节:http ...
经典的卷积神经网络及其Pytorch代码实现
1.LeNet LeNet是指LeNet-5,它是第一个成功应用于数字识别的卷积神经网络.在MNIST数据集上,可以达到99.2%的准确率.LeNet-5模型总共有7层,包括两个卷积层,两个池化层,两 ...
卷积神经网络CNN的原理（三）－－－代码解析
卷积神经网络在几个主流的神经网络开源架构上面都有实现,我这里不是想实现一个自己的架构,主要是通过分析一个最简单的卷积神经网络实现代码,来达到进一步的加深理解卷积神经网络的目的．笔者在github上找 ...
深入学习卷积神经网络（CNN）的原理知识
网上关于卷积神经网络的相关知识以及数不胜数,所以本文在学习了前人的博客和知乎,在别人博客的基础上整理的知识点,便于自己理解,以后复习也可以常看看,但是如果侵犯到哪位大神的权利,请联系小编,谢谢.好了下 ...
Deep Learning模型之：CNN卷积神经网络（一）深度解析CNN
http://m.blog.csdn.net/blog/wu010555688/24487301 本文整理了网上几位大牛的博客,详细地讲解了CNN的基础结构与核心思想,欢迎交流. [1]Deep le ...
卷积神经网络CNN与深度学习常用框架的介绍与使用
一.神经网络为什么比传统的分类器好 1.传统的分类器有 LR(逻辑斯特回归) 或者 linear SVM ,多用来做线性分割,假如所有的样本可以看做一个个点,如下图,有蓝色的点和绿色的点,传统的分类器 ...

随机推荐

iOS----精品开源库-开发强力助攻
30个精品iOS开源库,超强助攻你不会想错过他们,真的. 我爱开源. 文章的尾部你会看到一个太长不看的版本——一个简单的列表,只有标题和到项目的链接.如果你发现这篇文章是有用的,把它和你的iOS开 ...
BZOJ3507 [Cqoi2014]通配符匹配【哈希 + 贪心】
题目几乎所有操作系统的命令行界面(CLI)中都支持文件名的通配符匹配以方便用户.最常见的通配符有两个,一个是星号(""'),可以匹配0个及以上的任意字符:另一个是问号(&quo ...
[NOIP2017] 时间复杂度 (模拟,栈)
题目链接 Solution 用栈进行模拟. 记录一个 \(map\) 来看循环变量有没有用过. 对于每一次入栈都加信息. 出栈直接将 \(top\) 减一下. 反正一堆乱七八糟的东西瞎搞... 注意条 ...
[BZOJ2045]双亲数（莫比乌斯反演）
双亲数 Time Limit: 10 Sec Memory Limit: 259 MBSubmit: 959 Solved: 455[Submit][Status][Discuss] Descri ...
Visual Code 自定义插件安装位置
修改快速方式通过传入方式启动 ,示例: D:\installed_green_soft\VSCode\Code.exe --extensions-dir "D:\installed_gree ...
《Linux命令行与shell脚本编程大全第3版》Linux命令行---0
以下为阅读<Linux命令行与shell脚本编程大全第3版>的读书笔记,为了方便记录,特地与书的内容保持同步,特意做成一节一次随笔,特记录如下: <Linux命令行与shell脚本 ...
15深入理解C指针之---内存释放
一.手动申请的内存,必须及时进行内存释放,否则容易造成内存泄露.主要代码形式为: #include <stdio.h> #include <stdlib.h> int main ...
13深入理解C指针之---内存管理
该系列文章源于<深入理解C指针>的阅读与理解,由于本人的见识和知识的欠缺可能有误,还望大家批评指教. 内存管理对所有程序都很重要,主要包括显式内存管理和隐式内存管理.其中隐式内存管理主要是 ...
C#读取Excel 几种方法的体会
(1) OleDb: 用这种方法读取Excel速度还是非常的快的,但这种方式读取数据的时候不太灵活,不过可以在 DataTable 中对数据进行一些删减修改这种方式将Excel作为一个数据源,直接用 ...
CentOS6.7源码安装MySQL5.6
1.源码安装MySQL5.6 # CentOS6操作系统安装完成后,默认会在/etc目录下存在一个my.cnf, # 强制卸载了mysql-libs之后,my.cnf就会消失 rpm -qa | gr ...

C++卷积神经网络实例：tiny_cnn代码具体解释（7）——fully_connected_layer层结构类分析

C++卷积神经网络实例：tiny_cnn代码具体解释（7）——fully_connected_layer层结构类分析的更多相关文章

随机推荐

热门专题