利用光场进行深度图估计(Depth Estimation)算法之一—

前面几篇博客主要说了光场相机，光场相机由于能够记录相机内部整个光场，可以实现重聚焦(模糊线索)和不同视角的变换(视差线索)，同时也可以利用这个特性进行深度估计（Depth Estimation）。

先说一下利用重聚焦得到的不同聚焦平面图像获取深度图（模糊线索 ,defocus），其实这个原理非常简单。

1. 以聚焦范围为0.2F-2F为例，alpha∈(0.2,2)，取Depth Resolution=256, 那么步长就为(2-0.2)/256，我们通过重聚焦算法可以获取得到这个范围内的256幅重聚焦图像。

2. 对每一幅重聚焦的图像进行求梯度的操作，得到梯度图，比如使用matlab中的Gradient2D()函数，得到256幅梯度图。注意，都是三通道的，所以求梯度也要在每一个通道进行。

用C++实现的gradient2D的代码如下：

 void gradient2D(Mat input, Mat& output)

 {

     Mat Ix(input.size(), CV_32F);

     Mat Iy(input.size(), CV_32F);

     //get Iy

     for (int nrow = ; nrow < input.rows; nrow++)

     {

         for (int ncol = ; ncol < input.cols; ncol++)

         {

             if (ncol == )

             {

                 Ix.at<float>(nrow, ncol) = abs(input.at<uchar>(nrow, ) - input.at<uchar>(nrow, ));

             }

             else if (ncol == input.cols - )

             {

                 Ix.at<float>(nrow, ncol) = abs(input.at<uchar>(nrow, ncol) - input.at<uchar>(nrow, ncol - ));

             }

             else

             {

                 Ix.at<float>(nrow, ncol) = abs((input.at<uchar>(nrow, ncol + ) - input.at<uchar>(nrow, ncol - )) / 2.0);

             }

         }

     }

     //get Ix

     for (int nrow = ; nrow < input.rows; nrow++)

     {

         for (int ncol = ; ncol < input.cols; ncol++)

         {

             if (nrow == )

             {

                 Iy.at<float>(nrow, ncol) = abs(input.at<uchar>(, ncol) - input.at<uchar>(, ncol));

             }

             else if (nrow == input.rows - )

             {

                 Iy.at<float>(nrow, ncol) = abs(input.at<uchar>(nrow, ncol) - input.at<uchar>(nrow - , ncol));

             }

             else

             {

                 Iy.at<float>(nrow, ncol) = abs((input.at<uchar>(nrow + , ncol) - input.at<uchar>(nrow - , ncol)) / 2.0);

             }

         }

     }

     magnitude(Ix, Iy, output);

 }

3.对每一幅梯度图在局部窗口内进行均值滤波，相当于参考每一个像素点处的邻域梯度值，增加鲁棒性。这个可以简单的使用OpenCV中的Blur()函数实现。

4.均值滤波后的图像也是三通道的，这一步需要将每一个像素点处的三个通道值求平均，得到灰度图像。每一个像素点处的灰度值就为其对应的梯度值，而大家都知道，梯度值能够反应边缘、纹理等信息。

5.在每一个像素点处，遍历256幅图像，找到梯度值最大的那一幅图像(即该点在这一幅图像中最清晰，也就是聚焦到该像素点对应的物平面)，获取该图像的索引值。（比如某一像素点处的第200幅图像中的梯度值最大，则记录index=200）。遍历所有像素点，并获取索引值。这样得到的是一幅索引图像，每一个像素点处的值对应为该点在该索引下的图像中梯度最大，在程序中为0~255.

6.得到上述索引图后就简单了，可以根据每一个像素点处的索引值找到对应的alpha值，也就相应的得到alpha*F的值，该值就为像距V。

7.得到像距V，根据光学中的物像位置公示1/U +1/V = 1/F。V和F均已知，当然可以算出该点处的U值，而U就是深度，深度图就得到了。

这次没有放图，有时间再放上去，原算法参考论文为[1]，中文较为详细的参考[2]

[1] Tao M W, Hadap S, Malik J, et al. Depth from combining defocus and correspondence using light-field cameras[C]//Proceedings of the IEEE International Conference on Computer Vision. 2013: 673-680.

[2] 杨德刚, 肖照林, 杨恒, 等. 基于光场分析的多线索融合深度估计方法[J]. 计算机学报, 2015, 38(12): 002437-2449.

利用光场进行深度图估计(Depth Estimation)算法之一——聚焦算法的更多相关文章

利用光场进行深度图估计(Depth Estimation)算法之二——匹配算法
光场相机由于能够捕获相机内部光线的强度和方向而得到整个光场,可以实现重聚焦(refocus)和视角变换等功能.进而可以进行深度估计获取深度图,前面说过利用重聚焦的图像进行深度估计,今天说一下利用不同视 ...
泡泡一分钟：Towards real-time unsupervised monocular depth estimation on CPU
Towards real-time unsupervised monocular depth estimation on CPU Matteo Poggi , Filippo Aleotti , Fa ...
【HEVC帧间预测论文】P1.9 Coding Tree Depth Estimation for Complexity Reduction of HEVC
Coding Tree Depth Estimation for Complexity Reduction of HEVC <HEVC标准介绍.HEVC帧间预测论文笔记>系列博客,目录见: ...
deep learning+ Depth Estimation
Depth estimation/stereo matching/optical flow @CVPR 2017 Unsupervised Learning of Depth and Ego-Moti ...
[技术栈]C#利用Luhn算法(模10算法)对IMEI校验
1.Luhn算法(模10算法) 通过查看ISO/IEC 7812-1:2017文件可以看到对于luhn算法的解释,如下图: 算法主要分为三步: 第一步:从右边第一位(最低位)开始隔位乘2: 第二步:把 ...
行为识别笔记：improved dense trajectories算法（iDT算法）（转载）
iDT算法是行为识别领域中非常经典的一种算法,在深度学习应用于该领域前也是效果最好的算法.由INRIA的IEAR实验室于2013年发表于ICCV.目前基于深度学习的行为识别算法效果已经超过了iDT算法 ...
比微软kinect更强的视频跟踪算法--TLD跟踪算法介绍
转自:http://blog.csdn.net/carson2005/article/details/7647500 TLD(Tracking-Learning-Detection)是英国萨里大学的一 ...
FM算法(一)：算法理论
主要内容: 动机 FM算法模型 FM算法VS 其他算法一.动机在传统的线性模型如LR中,每个特征都是独立的,如果需要考虑特征与特征直接的交互作用,可能需要人工对特征进行交叉组合:非线性SVM可 ...
最短路经算法简介(Dijkstra算法，A*算法，D*算法)
据 Drew 所知最短路经算法现在重要的应用有计算机网络路由算法,机器人探路,交通路线导航,人工智能,游戏设计等等.美国火星探测器核心的寻路算法就是采用的D*(D Star)算法. 最短路经计算分静态 ...

随机推荐

Keep Mind Working
想找一个这样的地方,可以让脑袋持续运转着.不会像游戏一样让人着迷,不会像有色电视一样让人想错地方,也不会像工作一样充满太多严密.就是让脑袋继续转着,适意地思考些什么. 之前会跑去游戏里,至少没有太污. ...
UTC 通用格式时间转换为时间戳，并格式化为2017-01-01 12:00:00
在使用阿里云oss获取文件列表是,发现时间格式是这样的 2016-09-20T13:45:04.000Z (尼玛,是什么鬼), 经过度娘的解答,发现这就是传说中的 UTC通用格式时间问题来了,怎么转 ...
C#　DataGridView 列的显示顺序
this.dataGridView1.Columns["列名"].DisplayIndex=Convert.ToInt32("你要放置的位置")
KVO键值观察的具体实现
1.KVO简介 KVO是Objective-C对观察者设计模式的一种实现,它提供一种机制,指定一个被观察对象(如A类),当对象中的某个属性发生变化的时候,对象就会接收到通知,并作出相应的处理.在MVC ...
Java语言的概述？-什么是Java？ (附一张Java工程师的学习路线图)
什么是Java? Java是一门面向对象编程语言,不仅吸收了C++语言的各种优点,还摒弃了C++里难以理解的多继承.指针等概念,因此Java语言具有功能强大和简单易用两个特征.Java语言作为静态面向 ...
一种优雅的条件引用第三方.net库的方法
1.遇到的问题今年我一直在开发一个WebApiClient库,旨在.net下能像java的retrofit一样,方便地请求服务端的http接口.在这restful api盛行的年代,json的身影无 ...
部署Tomcat服务时，解决Cannot invoke Tomcat Manager 异常
最近,在使用Jenkins对工程一键部署的时候,出现调用Tomcat Manager 异常,对其解决方案特记于次. 异常信息可能存在的异常:(1)Cannot invoke Tomcat manag ...
Specified key was too long max key length is 1000 bytes
Mysql建立索引时遇到一个问题就是索引字段长度太长,解决办法: 1.修改字段长度 : 2.修改mysql默认的存储引擎 ,修改为INNODB: https://www.2cto.com/databa ...
利用appium-1.5.3.dmg安装Appium. doctors时，提示 Could not detect Mac OS X Version from sw_vers output: '10.12'
发生这种错误的原因是因为:appium不支持mac 10.12版本. 解决方法: https://stackoverflow.com/questions/40129794/how-to-fix-err ...
python写外网收集信息器
简单化,知道IP去扫描ip import socket from socket import * a=input('请输入域名:') try: ip=gethostbyname(a) print('[ ...

利用光场进行深度图估计(Depth Estimation)算法之一——聚焦算法

利用光场进行深度图估计(Depth Estimation)算法之一——聚焦算法的更多相关文章

随机推荐

热门专题