目标检测论文解读3—

背景

　　deep ConvNet兴起，VGG16应用在图像分类任务上表现良好，本文用VGG16来解决检测任务。SPP NET存在CNN层不能fine tuning的缺点，且之前的方法训练都是分为多个阶段，特征提取+SVM分类+边框回归，这些问题在Fast R-CNN上都得到了解决。

方法

　　网络模型采用VGG16结构,跟SPP NET相比有如下改进。

　　ROI pooling

　　将最后的max pooling层换成RoI pooling层，可以认为是SPP NET的特殊情况，只有一层金字塔，feature map被分为H*W个bin，作max pooling。

　　bbox regressor

　　网络末尾采用两个不同的全连接层，分别输出分类和位置结果，实现了end-to-end的训练过程。

　　CNNs参数更新

　　其实SPP NET也并不是不能更新CNNs的参数，只是这样开销太大，这是因为SPP NET先是将一堆图片的ROI求出来，打乱后随机取N张训练，这些ROI可能来自于很多不同的图片，这样如果要进行反向传播，必须保存这些图片训练中各层的feature map，开销巨大；Fast R-CNN采用了分层的思想，只在R=2张原图中取N个ROI，这样只用计算存储两张图片，开销大大降低。

总结

　　是在SPP NET的基础上做出的改进，让训练过程变成end-to-end，整个网络的参数都能更新。

缺点

　　ROI的提取采用的还是SS方法。　　

目标检测论文解读3——Fast R-CNN的更多相关文章

AAAI2019 | 基于区域分解集成的目标检测论文解读
Object Detection based on Region Decomposition and Assembly AAAI2019 | 基于区域分解集成的目标检测论文解读作者 | 文永亮学 ...
目标检测论文解读5——YOLO v1
背景之前热门的目标检测方法都是two stage的,即分为region proposal和classification两个阶段,本文是对one stage方法的初次探索. 方法首先看一下模型的网络 ...
目标检测论文解读1——Rich feature hierarchies for accurate object detection and semantic segmentation
背景在2012 Imagenet LSVRC比赛中,Alexnet以15.3%的top-5 错误率轻松拔得头筹(第二名top-5错误率为26.2%).由此,ConvNet的潜力受到广泛认可,一炮而红 ...
目标检测论文解读10——DSSD
背景 SSD算法在检测小目标时精度并不高,本文是在在SSD的基础上做出一些改进,引入卷积层,能综合上下文信息,提高模型性能. 理解 Q1:DSSD和SSD的区别有哪些? (1)SSD是一层一层下采样, ...
目标检测论文解读13——FPN
引言对于小目标通常需要用到多尺度检测,作者提出的FPN是一种快速且效果好的多尺度检测方法. 方法 a,b,c是之前的方法,其中a,c用到了多尺度检测的思想,但他们都存在明显的缺点. a方法:把每图片 ...
目标检测论文解读12——RetinaNet
引言这篇论文深刻分析了one-stage的模型精度比two-stage更差的原因,并提出Focal Loss提高精度. 思路在论文中,作者指出,造成one-stage模型精度差的原因主要是:正负样 ...
目标检测论文解读4——Faster R-CNN
背景 Fast R-CNN中的region proposal阶段所采用的SS算法成为了检测网络的速度瓶颈,本文是在Fast R-CNN基础上采用RPN(Region Proposal Networks ...
目标检测论文解读9——R-FCN
背景基于ResNet 101的Faster RCNN速度很慢,本文通过提出Position-sensitive score maps(位置敏感分值图)来给模型加速. 方法首先分析一下,为什么基于R ...
目标检测论文解读6——SSD
背景 R-CNN系列算法检测速度不够快,YOLO v1检测准确率较低,而且无法检测到密集目标. 方法 SSD算法跟YOLO类似,都属于one stage的算法,即通过回归算法直接从原图得到预测结果,为 ...

随机推荐

css3中@font-face模块自定义字体
一.@font-face模块介绍 @font-face是CSS3中的一个模块,他主要是把自己定义的Web字体嵌入到你的网页中,随着@font-face模块的出现,在Web的开发中使用字体不再只能使用W ...
[LeetCode] 721. Accounts Merge 账户合并
Given a list accounts, each element accounts[i] is a list of strings, where the first element accoun ...
第02组 Alpha事后诸葛亮
目录 1. 组长博客(2分) 2. 总结思考(27分) 2.1. 设想和目标(2分) 2.2. 计划(5分) 2.3. 资源(3分) 2.4. 变更管理(4分) 2.5. 设计/实现(4分) 2.6. ...
CSP2019蒸馏记
Day -$\infty$ ~ Day -2 认真准备联赛. Day -1 复习模板,全真模拟比赛平衡树下午进行了湖南大学 2 小时游. Day 0 上午睡过头了下午日常训练,并没有什么开放日 ...
luogu P5606 小 K 与毕业旅行 - 构造 - 多项式
题目传送门传送门先考虑 $a_i > 0$ 的情况.考虑构造这样一个顺序:$a_i$ 要么和后面的数的乘积都大于 $w$ 要么都小于等于 $w$. 这个构造可以这样做: vector< ...
Ensight——Fluent重叠网格解决方案【翻译】
原文链接:https://support.ceisoftware.com/hc/en-us/articles/360000664191-Overset-Grid-Solutions-from-Flue ...
oracle-DBlink基本操作
01,查询查询DBLINK信息 select * from dba_db_links; select owner,object_name from dba_objects where object_ ...
GreenPlum 大数据平台--常用命令
gpstate 命令参数作用 gpstate -b => 显示简要状态 gpstate -c => 显示主镜像映射 gpstart -d => 指定数据目录(默认值:$MASTE ...
ZJOI 2009 多米诺骨牌（状态压缩+轮廓线+容斥）
题意 https://www.lydsy.com/JudgeOnline/problem.php?id=1435 思路一道很好的状压/容斥题,涵盖了很多比较重要的知识点. 我们称每两行间均有纵跨.每 ...
SpringBoot 2.x 整合Lombok
Lombok的官方介绍 Project Lombok is a java library that automatically plugs into your editor and build too ...

目标检测论文解读3——Fast R-CNN

目标检测论文解读3——Fast R-CNN的更多相关文章

随机推荐

热门专题