金字塔卷积：Pyramidal Convolution

论文地址：https://arxiv.org/pdf/2006.11538.pdf

作者认为，当前CNN主要存在两个不足：（1）实际的感受野不足；（2）在下采样中，很多的细节信息会丢失。

从图中可以看出，有的物体尺寸较大（建筑、沙发），有的物体尺寸较小（行人，书本）。这种尺寸的变化是标准卷积级经捕获的。为此，作者提出了金字塔卷积（Pyramid Convolution, PyConv），包含不同尺度的卷积核，可以提取多尺度信息，在多个任务上均取得了较好的性能

PyConv 的示意如图所示，直观来看，就是从上往下卷积核的大小依次减小，同时，在通道维度上，通道的数目依次增加。最后将得到的 feature map 拼接起来。

在图像分类任务中的 PyConv 示意所图所示，首先是9X9的卷积，16个卷积核，分为16组，因此生成16X16=256个 feature map；然后是7X7的卷积，16个卷积核，分为8组，因此生成16X8=128个 feature map；接着是5X5的卷积，16个卷积核，分为4组，因此生成16X4=64个 feature map；最后是3X3的卷积，16个卷积核，只有1组，因此生成16X1=16个 feature map。然后，会用1X1的卷积来使输出的维度都为 256。

备汪：关于分组卷积，网上有一个比较形象的图示。对于普通卷积，如果输入的 feature map 尺寸为CHW，卷积核的数量为N，每个卷积核的尺寸为CxKxK，那么输出的 feature map 尺寸为 CHN，总的参数量为：NxCxKxK 。

如果进行分组卷积，假定要分成 G 组，每组输入的 feature map 数量为 \(\frac{C}{G}\)，每组输出的 feature map 数量为 \(\frac{N}{G}\)，每个卷积核的尺寸为\(\frac{C}{G}\times K\times K\), 每组的卷积核数量为 \(\frac{N}{G}\)，卷积核只与同组的输入进行卷积，则总的参数量为 \(N\times \frac{C}{G} \times K \times K\)，则总的参数量减少为以前的 \(\frac{1}{G}\)。

当分组数量等于输入map数量，输出map数量也等于输入map的数量，即 G=N=C，每个卷积核尺寸为\(1\times K \times K\)时，就成了 Depthwise convolution。

金字塔卷积 PyConv，通过集成不同尺度的卷积核，提升了多个视觉任务的性能，同时，该模块是一种“即插即用”的模块，可以较好的嵌入不同的网络架构中。

金字塔卷积：Pyramidal Convolution的更多相关文章

从图(Graph)到图卷积(Graph Convolution)：漫谈图神经网络模型 (二)
本文属于图神经网络的系列文章,文章目录如下: 从图(Graph)到图卷积(Graph Convolution):漫谈图神经网络模型 (一) 从图(Graph)到图卷积(Graph Convolutio ...
从图(Graph)到图卷积(Graph Convolution)：漫谈图神经网络模型 (一)
本文属于图神经网络的系列文章,文章目录如下: 从图(Graph)到图卷积(Graph Convolution):漫谈图神经网络模型 (一) 从图(Graph)到图卷积(Graph Convolutio ...
卷积（convolution）与相关（correlation）（matlab 实现）
1. 卷积(convolution) 输出 y(n) 是作为在 x(k) 和 h(n−k)(反转和移位)重叠之下的样本和求出的. 考虑下面两个序列: x(n)=[3,11,7,0,−1,4,2],−3 ...
从图(Graph)到图卷积(Graph Convolution)：漫谈图神经网络模型 (三)
本文属于图神经网络的系列文章,文章目录如下: 从图(Graph)到图卷积(Graph Convolution):漫谈图神经网络模型 (一) 从图(Graph)到图卷积(Graph Convolutio ...
【论文笔记】Pyramidal Convolution: Rethinking Convolutional Neural Networks for Visual Recognition
地址:https://arxiv.org/pdf/2006.11538.pdf github:https://github.com/iduta/pyconv 目前的卷积神经网络普遍使用3×3的卷积神经 ...
转置卷积Transposed Convolution
转置卷积Transposed Convolution 我们为卷积神经网络引入的层,包括卷积层和池层,通常会减小输入的宽度和高度,或者保持不变.然而,语义分割和生成对抗网络等应用程序需要预测每个像素的值 ...
信号处理——卷积（convolution）的实现
作者:桂. 时间:2017-03-07 22:33:37 链接:http://www.cnblogs.com/xingshansi/p/6517301.html 前言信号时域.频域对应关系,及其D ...
各种卷积类型Convolution
从最开始的卷积层,发展至今,卷积已不再是当初的卷积,而是一个研究方向.在反卷积这篇博客中,介绍了一些常见的卷积的关系,本篇博客就是要梳理这些有趣的卷积结构. 阅读本篇博客之前,建议将这篇博客结合在一起 ...
[翻译] 扩张卷积 (Dilated Convolution)
英文原文: Dilated Convolution 简单来说,扩张卷积只是运用卷积到一个指定间隔的输入．按照这个定义,给定我们的输入是一个2维图片,扩张率 k=1 是通常的卷积,k=2 的意思是每个输 ...

随机推荐

分析并封装排序算法(js,java)
前言本次来分享一下排序的api底层的逻辑,这次用js模拟,java的逻辑也是差不多. 先看封装好的api例子: js的sort排序 java的compareTo排序自己模拟的代码(JS) func ...
《The Google File System》论文研读
GFS 论文总结说明:本文为论文 <The Google File System> 的个人总结,难免有理解不到位之处,欢迎交流与指正 . 论文地址:GFS Paper 阅读此论文的过程中 ...
css完美解决网页在iphoneX的头部刘海显示问题
一.解决iphonX白条,网站扩展到整个屏幕网页在iphoneX的浏览器屏幕显示上,默认情况下在头部的2侧会出现白条背景,网站被限制在了一个“安全区域”内,移除白色背景的方法方法一:设置body的 ...
FocusBI：《商业智能7B理论模型》创造者
<商业智能7B理论模型>专门为培养企业级BI人才<如何一个人完成BI项目,成为企业级BI人才>课程而创造,历经我7年的商业智能项目实施工作和经验的提炼与总结,分别深入在甲方公司 ...
Docker-教你如何通过 Docker 快速搭建各种测试环境
今天给大家分享的主题是,如何通过 Docker 快速搭建各种测试环境,本文列举的,也是作者在工作中经常用到的,其中包括 MySQL.Redis.Elasticsearch.MongoDB 安装步骤,通 ...
Report.Net 本地数据库、WebService、Socket报表
本地.服务器的Access.Sql报表编辑.预览.打印. 可自定义预览界面,可方便嵌入到你的程序中去,提供接口函数,如有需要可自行添加接口. 预览采用单双面方式,因为如果页面过多,预览不能全部加载,所 ...
day12 作业
1.通用文件copy工具实现 with open("a.txt","r",encoding="utf-8") as f ,open(&quo ...
es6新增特性总结
定义 ES6是ECMA为JavaScript制定的第6个标准版本,标准委员会决定,标准在每年6月正式发布并作为当年的正式版本,接下来的时间里就在此版本的基础上进行改动,直到下一年6月草案就自然变成新一 ...
【DevCloud · 敏捷智库】两种你必须了解的常见敏捷估算方法
背景在某开发团队辅导的回顾会议上,团队成员对于优化估计具体方法上达成了一致意见.询问是否有什么具体的估计方法来做估算. 问题分析回顾意见上大家对本次Sprint的效果做回顾,其中80%的成员对于本 ...
数据可视化之DAX篇（十六）如何快速理解一个复杂的DAX?这个方法告诉你
https://zhuanlan.zhihu.com/p/64422393 经常有朋友提出一个问题,然后我给出一个DAX之后,TA又不是很理解,反复多次沟通才能把一个表达式讲清楚.或者TA自己写了一个 ...

金字塔卷积：Pyramidal Convolution

金字塔卷积：Pyramidal Convolution的更多相关文章

随机推荐

热门专题