CNN与图像高级应用

stone1234567890 2024-10-21 07:28:57 原文

一、图像识别与定位

　　思路1：视作回归

　　　　4个数字，用L2 loss/欧氏距离损失(x,y,w,h)这四个数都是连续值

　　思路2：借助图像窗口

二、物体识别

　　0.图像识别与定位：

　　　　(1)Classification:C个类别

　　　　(2)Input:Image

　　　　(3)Output:类别标签

　　　　(4)Evaluation metric:准确率

　　1.Localization:

　　　　(1)Input:Image

　　　　(2)Output:物体边界框(x,y,w,h)

　　　　(3)Evaluation metric:交并准则IOU

　　2.Classification+Localization:识别主体+定位(四元组完成)

　　3.边缘策略/选择性搜索=》R-CNN

　　4.R-CNN=>Fast R-CNN

　　5.Fast R-CNN=>Fast R-CNN

　　6.YOLO/SSD

　　7.ImageNet:(1)实际上有识别+定位 2个任务

　　　　(1)思路1：看做回归问题

　　　　　　　　最后的卷积层后

　　　　　　　　全连接层后

　　　　(2)能否对主题有更细致的识别？

　　　　　　　　提前规定好有K个组成部分

　　　　　　　　做成K个部分(关节)做回归预测=》收尾相接的线段

　　　　(3)思路2:图窗+识别与整合

　　　　　　类似刚才的classification+regression思路

　　　　　　选取不同的大小的框

　　　　　　让框出现在不同的位置上

　　　　　　判定得分

　　　　　　按照得分高低对“结果框”做抽取和合并

　　　　(4)实际应用的时候，会尝试各种大小的窗口，甚至在窗口上做一些回归的事情

　　　　(5)想办法克服一下过程中的“参数多”与“计算慢”

　　　　　　用多卷积核的卷积层替换全连接层

　　　　　　降低参数量

　　　　(6)测试/识别阶段的计算是可以复用的(小卷积)

　　　　　加速计算

三、图像分割

　　1.语义分割

　　2.反卷积

CNN与图像高级应用的更多相关文章

使用CNN生成图像先验，实现更广泛场景的盲图像去模糊
现有的最优方法在文本.人脸以及低光照图像上的盲图像去模糊效果并不佳,主要受限于图像先验的手工设计属性.本文研究者将图像先验表示为二值分类器,训练 CNN 来分类模糊和清晰图像.实验表明,该图像先验比目 ...
CSS 图像高级 Css Sprites
上节课中我们学习了背景图像,这节课我们学习背景图像的高级知识,如Css Sprites,CSS 背景渐变等. Css Sprites Css Sprites,国内也叫CSS精灵.它的原理是将许多的小图 ...
卷积神经网络(CNN)张量(图像)的尺寸和参数计算(深度学习)
分享一些公式计算张量(图像)的尺寸,以及卷积神经网络(CNN)中层参数的计算. 以AlexNet网络为例,以下是该网络的参数结构图. AlexNet网络的层结构如下: 1.Input: 图 ...
CNN与图像应用
一.图像识别与定位 0.Classification:C个类别 Input:Image Output:类别标签 Evaluation metric:准确率 1.Localization: Input: ...
CSS 图像高级径向渐变
径向渐变径向渐变使用 radial-gradient 函数语法. 这个语法和线性渐变很类似, 可以指定渐变结束时的形状以及它的大小. 默认来说,结束形状是一个椭圆形并且和容器的大小比例保持一致. ...
CSS 图像高级 CSS 渐变
CSS 渐变 CSS 渐变是在 CSS3 Image Module 中新增加的 <image> 类型. 使用 CSS 渐变可以在两种颜色间制造出平滑的渐变效果.用渐变代替图片,可以加快页面 ...
使用CNN做电影评论的负面检测——本质上感觉和ngram或者LSTM同，因为CNN里图像检测卷积一般是3x3，而文本分类的话是直接是一维的3、4、5
代码如下: from __future__ import division, print_function, absolute_import import tensorflow as tf impor ...
原来CNN是这样提取图像特征的。。。
对于即将到来的人工智能时代,作为一个有理想有追求的程序员,不懂深度学习(Deep Learning)这个超热的领域,会不会感觉马上就out了?作为机器学习的一个分支,深度学习同样需要计算机获得强大的学 ...
visualization of filters keras 基于Keras的卷积神经网络（CNN）可视化
https://adeshpande3.github.io/adeshpande3.github.io/ https://blog.csdn.net/weiwei9363/article/detail ...

随机推荐

[CSP-S模拟测试]:真相（模拟）
题目传送门(内部题106) 输入格式第一行为一个正整数$T$,表示数据组数. 接下来$T$组数据,每组数据第一行一个正整数$n$表示$OIer$,接下来$n$行,第$i$行表示编号为$i$的人所说的 ...
12.并发编程--Queue
并发编程--Queue Queue - 非阻塞队列 - 阻塞队列 Queue是一种特殊的线性表,它只允许在表的前端(front)进行删除操作,而在表的后端(rear)进行插入操作.进行插入操作的端称为 ...
第三天·HTML常用标签
一·<h1>-<h6> 单词缩写:headHTML的<h1>-<h6>代表了六个等级的标题,其中<h1>标签比较重要,因此要尽量少用.一般& ...
forms authentication原理
细说ASP.NET Forms身份认证 asp.net 登陆验证 Form表单验证的3种方式 Understanding and Implementing ASP.NET Custom Forms A ...
spark中使用的内存文件系统-Tachyon FS 简介
转自:http://blog.csdn.net/u014252240/article/details/41810849 发布人:南京大学PASA大数据实验室顾荣 1. Tachyon是什么 Tach ...
Kotlin 的函数定义和使用（译文转）
Kotlin 的函数定义和使用函数声明Kotlin 中的函数使用 fun 关键字声明 fun double(x: Int): Int {}函数用法调用函数使用传统的方法 val result = d ...
vue问题一：触发接口
//在script中先引用 import api from './../../api/index' //vue文件方法中写 del(index, row) { let self=this; // 传 ...
latexdiff中的大坑：字符编码问题
最近用latex写文章,要用到修订模式,于是采用latexdiff命令生成修订版pdf.这原本是一个非常简单方便的方法,却隐藏着字符编码的问题,初次用可能会遇到意想不到的问题,让人很烦,比如,生成出来 ...
WPF 模拟迅雷TabControl界面
WPF模拟迅雷TabControl界面点击查看下载  <Style x:Key="TabControlStyle" Tar ...
阶段3 2.Spring_09.JdbcTemplate的基本使用_3 JdbcTemplate在Dao中的使用
实际的开发过程中都是基于dao的创建持久层dao 定义三个方法持久层实现类创建dao的实现类. 添加未实现的方法通过spring注入 jdbcTemplate.所以这里生成一个jdbcTemp ...