CTAP: Complementary Temporal Action Proposal Generation论文笔记

主要观点：基于sliding window（SW）类的方法，如TURN，可以达到很高的AR，但定位不准；基于Group的方法，如TAG，AR有明显的上界，但定位准。所以结合两者的特长，加入Complementary Filtering（互补滤波）模块，实际上就是加一个网络预测TAG能不能搞，不能搞就用SW。

第一阶段：视频被划分为等长的单元，使用两层时序卷积生成unit-level的actionness score，基于这一分数序列，分别使用TAG和滑动窗口生成两组proposals，其中TAG就是分水岭算法，滑动窗口选用几种不同的尺寸，窗口之间有一定重合，具体参数见论文4.2。

第二阶段：互补滤波。通过一个Proposal-level Actionness Trustworthiness Estimator（PATE）模块来评估TAG能否成功。训练时使用gt作为目标，通过TAG出来的proposals与gt之间的iou决定正负样本，将proposals内的unit-level特征池化到固定尺寸，再过两层fc和sigmoid即可。测试时将其作用于每个SW，如果输出的分数低于阈值，则代表这个窗口内TAG大概率失效，该窗口正式成为一个proposal，否则丢弃。如此，便可获得一个正式的proposal集合。

第三阶段：排序和边界调整。TURN也有这一步骤，但它使用均值池化来聚合时序特征，丢弃了temporal ordering信息。本文设计一个Temporal convolutional Adjustment and Ranking（TAR）网络，使用时序卷积来聚合unit-level特征。具体地，在proposal内部，均匀采样n_ctl个unit（个人称之为内部特征），分别以起始点和终结点为中心各采样n_ctx个unit（个人称之为上下文特征）。内部特征过两层时序卷积和一层全连接，输出是动作的概率。两个上下文特征也分别通过两层时序卷积和一层全连接，输出时间offset。TAR模块的训练，对于原视频进行密集的滑窗采样作为样本，注意，这里SW的参数设定应该比第一阶段更密集，虽然我还没具体看代码。

CTAP: Complementary Temporal Action Proposal Generation论文笔记的更多相关文章

CTAP: Complementary Temporal Action Proposal Generation (ECCV2018)
互补时域动作提名生成这里的互补是指actionness score grouping 和 sliding window ranking这两种方法提proposal的结合,这两种方法各有利弊,形成互补 ...
SST:Single-Stream Temporal Action Proposals论文笔记
SST:Single-Stream Temporal Action Proposals 这是本仙女认认真真读完且把算法全部读懂(其实也不是非常懂)的第一篇论文 CVPR2017 一作论文写作的动机m ...
论文笔记之 SST: Single-Stream Temporal Action Proposals
SST: Single-Stream Temporal Action Proposals 2017-06-11 14:28:00 本文提出一种时间维度上的 proposal 方法,进行行为的识别.本 ...
论文阅读（Zhuoyao Zhong——【aixiv2016】DeepText A Unified Framework for Text Proposal Generation and Text Detection in Natural Images）
Zhuoyao Zhong--[aixiv2016]DeepText A Unified Framework for Text Proposal Generation and Text Detecti ...
论文笔记：Towards Diverse and Natural Image Descriptions via a Conditional GAN
论文笔记:Towards Diverse and Natural Image Descriptions via a Conditional GAN ICCV 2017 Paper: http://op ...
论文笔记系列-Neural Network Search ：A Survey
论文笔记系列-Neural Network Search :A Survey 论文笔记 NAS automl survey review reinforcement learning Bayesia ...
Temporal Action Detection with Structured Segment Networks (ssn)【转】
Action Recognition: 行为识别,视频分类,数据集为剪辑过的动作视频 Temporal Action Detection: 从未剪辑的视频,定位动作发生的区间,起始帧和终止帧并预测类别 ...
TURN TAP: Temporal Unit Regression Network for Temporal Action Proposals（ICCV2017）
Motivation 实现快速和准确地抽取出视频中的语义片段 Proposed Method -提出了TURN模型预测proposal并用temporal coordinate regression来 ...
论文笔记之：Natural Language Object Retrieval
论文笔记之:Natural Language Object Retrieval 2017-07-10 16:50:43 本文旨在通过给定的文本描述,在图像中去实现物体的定位和识别.大致流程图如下 ...

随机推荐

封装Button ,封装UITableView,封装UICollectionView
---恢复内容开始--- 封装Button ,封装UITableView,封装UICollectionView: 1.实现Button的创建和点击事件不用分开操作处理; 2.实现UITableView ...
SpringCloud+Eureka快速搭建微服架构
什么是springcloud? Springcloud是一个微服务框架,相比dubbo等,springcloud提供全套的分布式系统解决方案. Eureka是什么? Eureka是netflix的一个 ...
Vue学习之vue-cli脚手架下载安装及配置
Vue学习之vue-cli脚手架下载安装及配置:https://www.cnblogs.com/clschao/articles/10650862.html 1. 先下载node.js,下载地址:ht ...
Yii2.0 组件
框架之所以是框架,是因为其强大,其封装了很多实用的功能,开发者可以开箱即用. 下边列举Yii2.0的部分组件: var_dump(Yii::$app->session->getId()); ...
python 安装PostgreSQL 模块：psycopg2
官方资料:http://www.psycopg.org/psycopg/docs/ 安装: yum -y install python-psycopg2 (安装的版本可能是2.0) pip insta ...
vue 动态添加对象属性
昨天使用vue发现直接给对象添加属性,并不能触发响应更新,后来看文档发现要通过this.$set 函数动态添加才可用,eg: this.$set( obj, key, data)
查看linux服务器信息
1. vmstat 查看服务器内存,CPU等信息一般是通过两个数字参数来完成的,第一个参数是采样时间间隔,单位是秒, 第二个参数是采样的次数 r: 表示运行队列,如果队列过大说明CPU很繁忙 ...
Codeforces 1237D. Balanced Playlist
传送门首先显然的,如果一个位置开始播放了两圈还没结束,那么就永远不会结束先考虑位置 $1$ 开始播放,用一个 $multisetset$ 维护一下当前听的所有歌,直到某一首歌 $r$ 不合法了就停 ...
怎样终止(杀掉) Linux 中的进程?
使用 kill -9 进程号命令, 可是强行终止该进程. 如果使用直接使用 kill 进程号命令, 则会让进程 "自行了断" . 因此, 一般是 kill -9 进程号用得较 ...
6.Bash的功能
6.Bash的功能本章介绍 Bash 的特色功能.6.1 Bash的启动 bash [长选项] [-ir] [-abefhkmnptuvxdBCDHP] [-o 选项] [-O shopt 选项] [ ...

CTAP: Complementary Temporal Action Proposal Generation论文笔记

CTAP: Complementary Temporal Action Proposal Generation论文笔记的更多相关文章

随机推荐

热门专题