cs231n spring 2017 lecture13 Generative Models

1. 非监督学习

　　监督学习有数据有标签，目的是学习数据和标签之间的映射关系。而无监督学习只有数据，没有标签，目的是学习数据额隐藏结构。

2. 生成模型（Generative Models）

　　已知训练数据，根据训练数据的分布（distribution）生成新的样例。

　　无监督学习中的一个核心问题是估计分布。

3. PixelRNN 和 PixelCNN

　　依次根据已知的像素估计下一个像素。

　　PixelRNN（van der Oord et al. NIPS 2016）：利用RNN（LSTM）从角落开始依次生成像素。缺点是非常慢。

　　PixelCNN（van der Oord et al. NIPS 2016）:利用CNN从角落开始依次生成像素。求像素的最大似然估计。比PixelRNN快，但依旧慢。

　　PixelRNN和PixelCNN的优点是可以显式地求出概率分布，并且给出评价尺度（evaluation metric），生成的结果也不错。缺点是慢。改进版本是PixelCNN++（Salimans et al. 2017）。

4. Variational Autoencoders （VAE）

　　Autoencoder是一种从没有标签的训练数据学习低维度特征（lower-dimensional feature representation）的方法。最开始是用Linear+nonlinearity（sigmoid）的方法，后来人们用深度的全连接层，再后来人们用ReLU CNN。为什么要“低维度特征”？或者说为什么把输入的维度降低？目的是为了获得可靠的、不变的特征。

　　第一种用法是和监督学习配合使用。在训练阶段，可以再用一个Decoder把低维度特征解码成和输入类似的数据。这样可以建立损失函数。训练完成之后可以把Decoder扔掉，把Encoder出的特征当成某个监督学习的输入，预测出结果，建立Loss function。在有大量没有标签的训练数据和少量有标签的数据的情况下，这样做很有效。图中的 z 叫 “latent factors”。

　　第二种用法是生成新的数据。对于编码出的 z（“latent factors” ）的分布 p(z)，可以直接选择简单的概率分布，比如高斯。而对于条件概率 p(x|z)，则是比较复杂的，用神经网络来模拟。训练的过程如下图所示，（推导过程完全没听懂。。。）。训练完了之后可以只用Decoder network，渐进地改变z的各个分量（比如z₁表示微笑的程度，z₂表示头的姿态，则可以生成各种头的姿态各种微笑程度的人脸），生成不同的样例x_hat。

　　Variational Autoencoders的优点：生成模型的主要方法（principled approach）；可以估计q(z|x)（没搞明白这里q是什么。。。），对于其他任务可能是很好的特征描述。缺点：最大化似然估计的下限，而不是直接最大化似然估计，从评估的角度说不如PixelRNN和PixelCNN；相比于GAN，生成的图片比较模糊，质量不高。

5. Generative Adversarial Networks (GAN) （Ian Goodfellow et al., "Generative Adersarial Nets", NIPS 2014）

　　不考虑显式地描述density function，而是根据对抗直接生成样例。我们没有办法直接从复杂的、高维度的训练集分布中生成样例，那么就先从简单的分布生成样例（比如随机噪音），然后从训练集分布学习把这个简单分布生成的样例转变成（transformation）符合训练集分布。神经网络就是用来描述这个复杂的transformation（神经网络的作用似乎一直就是用来描述高维度、非线性的某种函数、映射、转换等等）。该神经网络的输入是随机噪声，输出是符合训练集分布的样例。

　　GAN有两个网络，生成网络（generator network）和区分网络（discriminator network），生成网络尽一切努力生成图片欺骗区分网络，区分网络尽一切努力区分原图和生成的图。

　　具体的训练过程是先优化区分网络k次迭代，再优化生成网络一次迭代，然后不断重复。

　　训练完成之后，可以丢掉区分网络，只用生成网络来生成样例。

　　改进方案如下：

　　2017年是GAN的爆发年，出了成吨的相关研究。生成的样例越来越好。

　　GAN的优点：效果非常好。缺点：训练的过程不稳定，很需要经验和技巧；不能给出对得density function的估计。

6. 总结：生成模型的对比

　　PixelRNN和PixelCNN：显式的density model，优化似然函数，效果不错，低效、慢。

　　Variational autoencoders (VAE)：优化似然函数的下限，latent representation很有用，inference queries，生成的图片的质量不够好。

　　Generative Adversarial Network (GANs)：博弈的原理，生成的图片的质量超级好，难训练，no inference queries。

cs231n spring 2017 lecture13 Generative Models的更多相关文章

cs231n spring 2017 lecture13 Generative Models 听课笔记
1. 非监督学习监督学习有数据有标签,目的是学习数据和标签之间的映射关系.而无监督学习只有数据,没有标签,目的是学习数据额隐藏结构. 2. 生成模型(Generative Models) 已知训练数 ...
cs231n spring 2017 lecture11 Detection and Segmentation 听课笔记
1. Semantic Segmentation 把每个像素分类到某个语义. 为了减少运算量,会先降采样再升采样.降采样一般用池化层,升采样有各种"Unpooling"." ...
cs231n spring 2017 lecture9 CNN Architectures 听课笔记
参考<deeplearning.ai 卷积神经网络 Week 2 听课笔记>. 1. AlexNet(Krizhevsky et al. 2012),8层网络. 学会计算每一层的输出的sh ...
cs231n spring 2017 lecture7 Training Neural Networks II 听课笔记
1. 优化: 1.1 随机梯度下降法(Stochasitc Gradient Decent, SGD)的问题: 1)对于condition number(Hessian矩阵最大和最小的奇异值的比值)很 ...
cs231n spring 2017 Python/Numpy基础 (1)
本文使根据CS231n的讲义整理而成(http://cs231n.github.io/python-numpy-tutorial/),以下内容基于Python3. 1. 基本数据类型:可以用 prin ...
cs231n spring 2017 lecture11 Detection and Segmentation
1. Semantic Segmentation 把每个像素分类到某个语义. 为了减少运算量,会先降采样再升采样.降采样一般用池化层,升采样有各种“Unpooling”.“Transpose Conv ...
cs231n spring 2017 lecture9 CNN Architectures
参考<deeplearning.ai 卷积神经网络 Week 2 听课笔记>. 1. AlexNet(Krizhevsky et al. 2012),8层网络. 学会计算每一层的输出的sh ...
cs231n spring 2017 lecture7 Training Neural Networks II
1. 优化: 1.1 随机梯度下降法(Stochasitc Gradient Decent, SGD)的问题: 1)对于condition number(Hessian矩阵最大和最小的奇异值的比值)很 ...
cs231n spring 2017 Python/Numpy基础
本文使根据CS231n的讲义整理而成(http://cs231n.github.io/python-numpy-tutorial/),以下内容基于Python3. 1. 基本数据类型:可以用 prin ...

随机推荐

Bezier曲线的实现——de Casteljau算法
这学期同时上了计算机图形学和计算方法两门课,学到这部分的时候突然觉得de Casteljau递推算法特别像牛顿插值,尤其递推计算步骤很像牛顿差商表. 一开始用伯恩斯坦多项式计算Bezier曲线的时候, ...
C++构造函数概念作用
作用: 对对象进行初始化,如给成员变量赋初值,而不用专门再写初始化函数. 防止有些对象没被初始化就使用,导致程序出错. 要求: 名字与类名相同,可以有参数,但不能有返回值(void也不行) 编译时: ...
等和的分隔子集（dp）
晓萌希望将 1 到 N 的连续整数组成的集合划分成两个子集合,且保证每个集合的数字和是相等. 例如,对于 N = 3,对应的集合 1, 2, 3 能被划分成3和1,2两个子集合. 这两个子集合中元素分 ...
201403-2 窗口 Java
要想到定义一个窗口类,判断点在不在矩形里好判断需要一个数组,存放结果 import java.util.ArrayList; import java.util.List; import java.u ...
Juniper srx新增接口IP，使PC直连srx(转)
转自:https://www.jianshu.com/p/bc27134bde3d Juniper srx新增接口IP,使PC直连srx 2018.11.19 14:24:15字数 424 概述需求 ...
kafka Poll轮询机制与消费者组的重平衡分区策略剖析
注意本文采用最新版本进行Kafka的内核原理剖析,新版本每一个Consumer通过独立的线程,来管理多个Socket连接,即同时与多个broker通信实现消息的并行读取.这就是新版的技术革新.类似于L ...
ccf-csp 任务调度，回溯算法我觉得ok神**wa了
#include<iostream> #include<string.h> #include<cmath> #define M 41 #define min(a,b ...
python-day8爬虫基础之数据存储
数据存储,在爬虫中也是十分的重要,因为我们要把我们想要的数据保存到本地,其中最简单直接的就是保存为文件文本,比如:TXT.JSON.CSV等等,除此之外,我们还可以将其保存到数据库中,常见的数据库类型 ...
[Scoi2016]背单词（trie+贪心）
题意:重新解释一下题意吧(题意晦涩难懂) 给定n个单词,你可以按照顺序学习,当学习这一单词时,这个单词是第x个要学习的单词,需要的代价分三类: 1.若存在其他单词是其后缀没被学习,则代价为n2 2.若 ...
POJ-2349 Arctic Network（最小生成树+减免路径）
http://poj.org/problem?id=2349 Description The Department of National Defence (DND) wishes to connec ...

cs231n spring 2017 lecture13 Generative Models

cs231n spring 2017 lecture13 Generative Models的更多相关文章

随机推荐

热门专题