cs231n spring 2017 lecture2 Image Classification

1. 相比于传统的人工提取特征（边、角等），深度学习是一种Data-Driven Approach。深度学习有统一的框架，喂不同的数据集，可以训练识别不同的物体。而人工提取特征的方式很脆弱，换一个物体就要重新设计特征。

2. 描述图像之间相似程度，可以直接把每个对应像素做减法，然后把差的绝对值累加起来。这个差值的和越小，图片越接近。这是曼哈顿距离L1。

对应像素点的差值的平方累加再开平方，这是欧几里得距离L2。

L1和L2谁更好，这取决于具体问题。但一般来说，如果做差的向量有很具体的含义，比如对于员工分类，向量的每一个元素可能是“工作年限”、“工资”等，这种用L1会更好一点，因为L1更依赖坐标系。

3. K近领域算法是计算当前图片和所有候选图片的相似程度（或者说距离），最近的K个候选中，最多的那个标签就被作为当前图片的标签。K越大，对噪音越鲁棒（当然，也不是越大越好，会有最佳值）。

这种算法的缺点是：1）预测的复杂度太高，需要和每一个训练数据去比较。2）不鲁邦，测试数据和训练数据必须很像，如果有遮挡、旋转之类的，会误认为差别很大。3）维度问题，数据集必须在整个空间很稠密的分布，需要指数级增加的数据集，维度高的时候就很不现实。

4. Hyperparameter：预先设定的参数，而不是算法学习得到的。比如K近领域算法中的K。这种参数是很依赖具体问题的。如何设置Hyperparameter呢？

　　方案一：在训练集上表现最好的。这个方案是不行的，因为我们在乎的不是在训练集上表现怎么样，而是在乎在没见过的测试集上表现好。或者说方案一并不能保证很好的泛化能力。

　　方案二：把数据集分为训练集和测试集，选在测试集上最好的。这个方案的问题和方案一一样，依旧不能保证很好的泛化能力。

　　方案三：把数据集分为训练集、验证集、测试集，根据验证集上的表现来选择hyperparameter，然后再在测试集上评估。这种方案很好。对于很多hyperparameter的情况，验证集最好也设定的更大一点。　　

　　方案四：把数据集分为n组，交叉验证。随机挑选n-2组用来训练，1组用来验证，1组用来测试。这种方法比较适合小数据集，在深度学习中，由于训练的代价太大，所以用的也不算多这种方案。

5. 深度学习的框架像是拼乐高积木，而线性回归是最基本最好用的最广泛使用的积木。

6. 深度学习的训练过程就是训练出一组参数W，在预测x的时候计算y=f(x,W)，W的每一行都是一个template，对应一个标签，计算出的y是一个向量，每个元素对应一个标签的相似程度，最大的值就对应预测出的标签。深度学习的框架反映在函数f上。

对于线性回归，f就是简单相乘，f(x,W) = Wx。

cs231n spring 2017 lecture2 Image Classification的更多相关文章

cs231n spring 2017 lecture2 Image Classification 听课笔记
1. 相比于传统的人工提取特征(边.角等),深度学习是一种Data-Driven Approach.深度学习有统一的框架,喂不同的数据集,可以训练识别不同的物体.而人工提取特征的方式很脆弱,换一个物体 ...
cs231n spring 2017 lecture11 Detection and Segmentation 听课笔记
1. Semantic Segmentation 把每个像素分类到某个语义. 为了减少运算量,会先降采样再升采样.降采样一般用池化层,升采样有各种"Unpooling"." ...
cs231n spring 2017 lecture11 Detection and Segmentation
1. Semantic Segmentation 把每个像素分类到某个语义. 为了减少运算量,会先降采样再升采样.降采样一般用池化层,升采样有各种“Unpooling”.“Transpose Conv ...
cs231n spring 2017 lecture13 Generative Models 听课笔记
1. 非监督学习监督学习有数据有标签,目的是学习数据和标签之间的映射关系.而无监督学习只有数据,没有标签,目的是学习数据额隐藏结构. 2. 生成模型(Generative Models) 已知训练数 ...
cs231n spring 2017 lecture9 CNN Architectures 听课笔记
参考<deeplearning.ai 卷积神经网络 Week 2 听课笔记>. 1. AlexNet(Krizhevsky et al. 2012),8层网络. 学会计算每一层的输出的sh ...
cs231n spring 2017 lecture7 Training Neural Networks II 听课笔记
1. 优化: 1.1 随机梯度下降法(Stochasitc Gradient Decent, SGD)的问题: 1)对于condition number(Hessian矩阵最大和最小的奇异值的比值)很 ...
cs231n spring 2017 Python/Numpy基础 (1)
本文使根据CS231n的讲义整理而成(http://cs231n.github.io/python-numpy-tutorial/),以下内容基于Python3. 1. 基本数据类型:可以用 prin ...
cs231n spring 2017 lecture13 Generative Models
1. 非监督学习监督学习有数据有标签,目的是学习数据和标签之间的映射关系.而无监督学习只有数据,没有标签,目的是学习数据额隐藏结构. 2. 生成模型(Generative Models) 已知训练数 ...
cs231n spring 2017 lecture9 CNN Architectures
参考<deeplearning.ai 卷积神经网络 Week 2 听课笔记>. 1. AlexNet(Krizhevsky et al. 2012),8层网络. 学会计算每一层的输出的sh ...

随机推荐

python3编码问题个人理解
#coding=utf-8 a = "你" # 这个字符串是Unicode和 a = u“你”等价b = b'\\u4f60' #这个表示b是字节串(如果需要显示b的值则 prin ...
UIWindow statusBar消失
1.新建UIWindow 程序崩溃报无根控制器错误 Xcode7环境下,新建UIWindow需添加rootViewController 2.新建UIWindow后 statusBar消失 Info. ...
TX2在Turtlebot测试kobuki
1.检查TX2开发板上的ROS,输入: $ roscore 如果ROS安装正确显示 started core service [/rosout] 2.输入检测kobuki 命令 ls /dev/kob ...
JavaScript学习总结（三）
在学习完了基本的内容之后,我们来学习一下JavaScript中的对象部分以及如何自定义对象的问题. String对象创建字符串的方式共有两种: 方式1:new String("内容&quo ...
报错：不是GROUP BY 表达式
oracle库中:group by后面必须加上你select后面所查询的所有除聚合函数之外的所有字段. 解决方法:将group by放入子查询中使用或者将select后面的所有查询字段放入group ...
Java学习笔记--精品札记
forech循环增强版(JDK1.7新特性) for(数组单位元素类型 i:遍历目标数组){ 代码块 } char(只能放单个字符)数组可以直接遍历不需要循环,其他数组不可以,必须遍历 toStrin ...
Python说文解字_详解元类
1.深入理解一切接对象: 1.1 什么是类和对象? 首先明白元类之前要明白什么叫做类.类是面向对象object oriented programming的重要概念.在面向对象中类和对象是最基本的两个概 ...
Django框架(十一)：模板介绍、模板语言、模板继承、HTML转义
1. 模板介绍 1.1 模板的功能产生html,控制页面上展示的内容.模板文件不仅仅是一个html文件. 模板文件包含两部分内容: 静态内容:css.js.html. 动态内容:用于动态去产生一些页 ...
Facebook的Libra “区块链”到底是如何运作的？
本文深入研究了"关于Facebook Libra coin (以及更多)平台协议"的26页技术文档,并对其内容进行了分解说明.同时,我们对这53位作者表示衷心的钦佩! 以下为具体分 ...
Linux应用编程之lseek详解
Linux应用编程之lseek详解 1.lseek函数介绍 (1).文件指针:当我们要对一个文件进行读写时,一定要先打开这个文件,所以我们读写的所有文件都是动态文件.动态文件在内存中的形态就是文件流的 ...

cs231n spring 2017 lecture2 Image Classification

cs231n spring 2017 lecture2 Image Classification的更多相关文章

随机推荐

热门专题