Deep learning: Dropout, DropConnect

from：https://www.jianshu.com/p/b349c4c82da3

Dropout

训练神经网络模型时，如果训练样本比较少，为了防止模型过拟合，可以使用Dropout来一定程度的减少过拟合。Dropout是Hinton 在2012年提出来的。

Dropout是指在模型训练时随机的让隐层节点的权重变成0，暂时认为这些节点不是网络结构的一部分，但是会把它们的权重保留下来（不更新）上图帮助理解。

我使用的是Matlab的Deeplearning 的工具包https://github.com/rasmusbergpalm/DeepLearnToolbox，
我只使用的是简单地单隐层的感知机，数据是MNIST手写数字识别，该数据一共有60000个训练样本和10000个测试样本。图片大小是28 *
28,网络结构的层数是[784 512
10]，100次迭代，minibatch大小是100，我做了在没有dropout和有dropout的实验对比。dropout的值是0.5，即以0.5的概率随机参数隐层节点。
代码如下：

load mnist_uint8

train_x = double(train_x(1:60000,:)) / 255;

train_y = double(train_y(1:60000,:));

test_x = double(test_x(1:10000,:)) / 255;

test_y = double(test_y(1:10000,:));

[train_x ,mu, sigma] = zscore(train_x);

test_x = normalize(test_x, mu,sigma);

%% without dropout

rand(0);

nn = nnsetup([ 784 512 10]);

opts.numepochs = 100;

opts.batchsize = 100;

[nn, L] = nntrain(nn, train_x, train_y, opts);

[er, bad] = nntest(nn, test_x, test_y);

str = sprintf('testing error rate is : %f', er);

disp(str);

%% with dropout

rand(0);

nn = nnsetup([784 512 10]);

nn.dropoutFraction = 0.5;

opts.batchsize = 100;

opts.numepochs = 100;

nn = nntrain(nn, train_x, train_y, opts);

[er, bad] = nntest(nn, test_x, test_y);

str = sprintf('test error rate is : %f', er);

disp(str);

实验结果是：
test error rate is : 0.035200
With dropout, test error rate is : 0.031400

参考资料:

DropConnect

神经网络一般在大规模标签数据分类表现的很好，但是一帮需要更多的层数和更多的神经元，单数如果没有规范化的话，数百万和数十亿的参数很可能导致模型的过拟合。
现有的Regularization方法:

$l_1$ 或者 $l_2$ 惩罚
贝叶斯的方法
早停
以上提到的Dropout方法[Hinton et al.2012]

DropConnect与Dropout不同的地方是在训练神经网络模型过程中，它不是随机的将隐层节点的输出变成0，而是将节点中的每个与其相连的输入权值以1-p的概率变成0。（一个是输出一个是输入）

在MNITS数据集上的实验结果，分别是no-Drop，dropout和dropconnect的对比。

DropConnect的主页有源码可下载：DropConnect project page

参考资料

Dropout, DropConnect ——一个对输出，一个对输入的更多相关文章

C# 基础控制台程序的创建，输出，输入，定义变量，变量赋值，值覆盖，值拼接，值打印
基础学习内容有 Console.WriteLine("要输出的内容");//往外输出内容的 Console.ReadLine(); //等待用户输入,按回车键结束,防止程序闪退控 ...
2017-2-17 c#基础学习（控制台程序的创建，输出，输入，定义变量，变量赋值，值覆盖，值拼接，值打印）
1 控制台程序的创建 > 新建项目 ,选择 c#, 框架选择4.0 , 选择控制应用台程序, 选择文件保存位置修改名字. 2 c#输出与输入 >在main函数中编写代码 >在编 ...
tornado 02 输出、输入和URL传参
tornado 02 输出.输入和URL传参一.输出 write输出到页面 #write可以接受的对象 #write() 可以接受3种对象:bytes Unicode字符(二进制字符) 字典 #如果 ...
C Primer Plus学习笔记（七）- 字符输入/输出和输入验证
单字符 I/O:getchar() 和 putchar() getchar() 和 putchar() 每次只处理一个字符 getchar() 和 putchar() 都不是真正的函数,它们被定义为供 ...
编写Java程序，实现从控制台输入对应个数的整数，输出对输入整数的从大到小显示
编写Java程序,实现从控制台输入对应个数的整数,输出对输入整数的从大到小显示效果如下: 实现代码: import java.util.Arrays; import java.util.Scanne ...
c#输出、输入
//输出 Console.WriteLine("这是一行文字"); 自动回车的. Console.Write("Hello world"); 不带回车的. ...
【C语言学习】《C Primer Plus》第8章字符输入/输出和输入确认
学习总结 1.缓冲区分为完全缓冲区(fully buffered)I/O和行缓冲区(line-buffered)I/O.对完全缓冲输入来说,当缓冲区满的时候会被清空(缓冲区内容发送至其目的地).这类型 ...
c#输出、输入练习
//输出 Console.WriteLine("这是一行文字"); 自动回车的. Console.Write("Hello world"); 不带回车的. ...
C语言基础学习基本数据类型-变量的输出与输入
变量的输出变量如何输入输出呢?实际上,在这之前你已经使用过输出语句(printf语句)了,我们可以使用printf来执行输出. printf语句的使用方法如下: printf(格式控制字符串, 数据 ...

随机推荐

sklearn countvectorizer坑
但是如果修改为['驴福记 ( 阜通店 )','...',...]执行vectorizer.fit_transform就正常.原因是,创建CountVectorizer实例时,有一个默认参数ana ...
MATLAB变量
序言在Matlab中,变量名由A~Z.a~z.数字和下划线组成,且变量的第一个字符必须是字母. 尽管变量名可以是任意长度, 但是Matlab只识别名称的前N=namelengthmax个字符, 这里 ...
TP无限回复
引入文件和css样式 <script src="__PUBLIC__/bootstrap/js/jquery-1.11.2.min.js"></script> ...
【Checkio Exercise】Probably Dice
题目: Probably Dice Battle is full of randomnesses. You should observe randomness in a controlled sett ...
xshell 利用密钥登录
第一步:新建用户密钥第二步:选择加密方式,密钥长度越长越安全第三步:设置密钥名称和密码(密码可为0,这里是密钥的密码非服务器密码) 第四步:保存公钥到本地第五步:导出私钥到本地第六步:将公钥和 ...
第七篇——Struts2的接收参数
Struts2的接收参数 1.使用Action的属性接收参数 2.使用Domain Model接收参数 3.使用ModelDriven接收参数项目实例 1.项目结构 2.pom.xml <pr ...
Angular4的依赖注入
flask 定义数据关系（多对一）
多对一一对多关系反过来就是多对一关系,这两种关系模式分别从不同的视角出发.一个作者拥有多篇文章,反过来就是多篇文章属于同一个作者.为了便于区分,我们使用居民和城市来演示多对一关系:多个居民住在同一个 ...
Eclipse创建Maven Web项目后更改Servlet版本
Eclipse创建Maven Web项目后更改Servlet版本 1.场景基于Eclipse通过maven-archetype-webapp原型创建一个Web项目后,其默认Servlet版本是2.3, ...
sliver
import 'package:flutter/material.dart';import 'package:xxx/bloc/bloc.dart';import 'package:xxx/model ...

Dropout, DropConnect ——一个对输出，一个对输入