darknet-yolov3模型预测框size不正确的原因

问题描述：预测框的中心位置正常，但是预测的框的width和height不正常。

解决方法：使得训练的配置cfg和测试中cfg的输入width, height, anchorbox保持一致！

问题是我在修改anchorbox时遇到的，当时训练和测试不在同一环境下，测试端没有及时更新cfg文件造成的，如下图所示：

mAP也是极低的。

修改后，检测框正常，如下图所示：

下面做下boundingbox来源分析：

首先是yolo(you only look once)中是这样定义的：

算法中明确告诉我们:boundingbox只和cell(featuremap中的)位置(Cx,Cy)以及anchorbox的(Pw,Ph)直接相关。所以我们可以重点关注这两个量。

对应到源代码中的实现主要是以下两个函数：

yolo_layer.c

...

box get_yolo_box(float *x, float *biases, int n, int index, int i, int j, int lw, int lh, int w, int h, int stride)

/*

输入参数解析：(*x 预测数据),(*biases 存放anchor数据),

(i、j 对应在feature map上的坐标),

(n 表示anchor数组的mask,为了让三个yolo_layer能取到自己对应的三组anchor, 小尺寸feature map对应大size anchor，比较好理解小尺寸特征图负责检查大尺寸目标),

(index,当前bbox对应的数据的起始下标),

(lw lh,特征图的w h),

(w h, 网络输入的w h),

(同一个bbox数据之间的stride lw*lh)

*/

{

    box b; // 网络为了每一个bbox都给出了4个坐标预测值: tx ty tw ty

    /*

    其中tx 和 ty是相对于当前feature map坐标的偏移

    除以lw&&lh 是计算出bbox坐标在图像中的比例

    */

    b.x = (i + x[index + 0*stride]) / lw;

    b.y = (j + x[index + 1*stride]) / lh;

    /*

    e^tw * biases[2*n] 表示学习到的w回归值和对应prior bbox(anchor) w的乘积得到

    bbox在网络输入size基础上的w size, 除以 net_w得到相对于网络输入图像的比例

    h的计算同理, 这部分的内容涉及到yolov3论文中的图二

    */

    b.w = exp(x[index + 2*stride]) * biases[2*n]   / w;

    b.h = exp(x[index + 3*stride]) * biases[2*n+1] / h;

    return b;

    /*补充一下，这里算出的x,y,w,h都是相对于net input size的比例*/

}
此不分为转载：

https://blog.csdn.net/wwwhp/article/details/84718089

...

int get_yolo_detections(layer l, int w, int h, int netw, int neth, float thresh, int *map, int relative, detection *dets)

{

    int i,j,n;

    float *predictions = l.output;

    if (l.batch == 2) avg_flipped_yolo(l);

    int count = 0;

    for (i = 0; i < l.w*l.h; ++i){

        int row = i / l.w;

        int col = i % l.w;

    //printf("get_yolo_detections:i =%d,row = i / l.w=%d, col = i % l.w;\n",i, row, col);

        for(n = 0; n < l.n; ++n){

            int obj_index  = entry_index(l, 0, n*l.w*l.h + i, 4);

            float objectness = predictions[obj_index];//objectness：有框的

        //printf("objectness:%f\n",objectness);

            if(objectness <= thresh) continue;

        printf("obj_index = %d,objectness:%f, thresh:%f\n",obj_index,objectness,thresh);

            int box_index  = entry_index(l, 0, n*l.w*l.h + i, 0);

            dets[count].bbox = get_yolo_box(predictions, l.biases, l.mask[n], box_index, col, row, l.w, l.h, netw, neth, l.w*l.h);//模型推理出偏移量

            dets[count].objectness = objectness;

            dets[count].classes = l.classes;

            for(j = 0; j < l.classes; ++j){

                int class_index = entry_index(l, 0, n*l.w*l.h + i, 4 + 1 + j);

                float prob = objectness*predictions[class_index];//predictions[class_index]：框中物体是class的概率，prob：置信度

        printf("get_yolo_detections1:prob=objectness*predictions[class_index] = %f * predictions[%d] = %f * %f = %f;\n",objectness,class_index,objectness,predictions[class_index],prob);

                dets[count].prob[j] = (prob > thresh) ? prob : 0;

        printf("get_yolo_detections2:[dets[count].prob[j] = (prob > thresh) ? prob : 0] = [ %f = (%f > %f) ? %f : 0];\n",dets[count].prob[j],prob,thresh,prob);

            }

            ++count;

        }

    }

    correct_yolo_boxes(dets, count, w, h, netw, neth, relative);

    return count;

}

...

如有疑问可以留言。

希望可以帮到困惑的你！

darknet-yolov3模型预测框size不正确的原因的更多相关文章

AlexeyAB DarkNet YOLOv3框架解析与应用实践（二）
AlexeyAB DarkNet YOLOv3框架解析与应用实践(二) 版本3有什么新功能? YOLOv3使用了一些技巧来改进训练和提高性能,包括:多尺度预测.更好的主干分类器等等.全部细节都在我们的 ...
AlexeyAB DarkNet YOLOv3框架解析与应用实践（一）
AlexeyAB DarkNet YOLOv3框架解析与应用实践(一) Darknet: C语言中的开源神经网络 Darknet是一个用C和CUDA编写的开源神经网络框架.它速度快,易于安装,支持C ...
时间序列深度学习：seq2seq 模型预测太阳黑子
目录时间序列深度学习:seq2seq 模型预测太阳黑子学习路线商业中的时间序列深度学习商业中应用时间序列深度学习深度学习时间序列预测:使用 keras 预测太阳黑子递归神经网络设置.预处 ...
AlexeyAB DarkNet YOLOv3框架解析与应用实践（六）
AlexeyAB DarkNet YOLOv3框架解析与应用实践(六) 1. Tiny Darknet 听过很多人谈论SqueezeNet. SqueezeNet很酷,但它只是优化参数计数.当大多数高 ...
AlexeyAB DarkNet YOLOv3框架解析与应用实践（三）
AlexeyAB DarkNet YOLOv3框架解析与应用实践(三) ImageNet分类您可以使用Darknet为1000级ImageNet挑战赛分类图像.如果你还没有安装Darknet,你应该 ...
时间序列深度学习：状态 LSTM 模型预测太阳黑子
目录时间序列深度学习:状态 LSTM 模型预测太阳黑子教程概览商业应用长短期记忆(LSTM)模型太阳黑子数据集构建 LSTM 模型预测太阳黑子 1 若干相关包 2 数据 3 探索性数据分析 ...
tensorflow学习笔记——模型持久化的原理，将CKPT转为pb文件，使用pb模型预测
由题目就可以看出,本节内容分为三部分,第一部分就是如何将训练好的模型持久化,并学习模型持久化的原理,第二部分就是如何将CKPT转化为pb文件,第三部分就是如何使用pb模型进行预测. 一,模型持久化为 ...
AlexeyAB DarkNet YOLOv3框架解析与应用实践（五）
AlexeyAB DarkNet YOLOv3框架解析与应用实践(五) RNNs in Darknet 递归神经网络是表示随时间变化的数据的强大模型.为了更好地介绍RNNs,我强烈推荐Andrej K ...
NLP（十八）利用ALBERT提升模型预测速度的一次尝试
前沿在文章NLP(十七)利用tensorflow-serving部署kashgari模型中,笔者介绍了如何利用tensorflow-serving部署来部署深度模型模型,在那篇文章中,笔者利用k ...

随机推荐

python里一个class可以定义多个构造函数
不行,一个class只能有一个用于构造对象的__init__函数但python中的变量是无类型的,因此传给__init__的参数可以是任何类型python中的函数参数在定义时可以有默认值,可以让__i ...
springBoot（2） HelloWorld
首先下载一个 Spring Boot环境. 下载地址:https://spring.io/tools3/sts/all 打开STS.exe 一,新建项目然后在空白处新建: 1.New→Other→ ...
应用安全 - harbaor - 漏洞汇总
CVE-2019-19026(SQL注入,高危):https://github.com/goharbor/harbor/security/advisories/GHSA-rh89-vvrg-fg64( ...
【Qt开发】事件循环与线程二
事件循环与线程二 Qt 线程类 Qt对线程的支持已经有很多年了(发布于2000年九月22日的Qt2.2引入了QThread类),Qt 4.0版本的release则对其所有所支持平台默认地是对多线程支 ...
56 道高频 JavaScript 与 ES6+ 的面试题及答案
56 道高频 JavaScript 与 ES6+ 的面试题及答案 :https://segmentfault.com/a/1190000020082089?utm_source=weekly& ...
Windows下图文详解Mongodb安装及配置
这两天接触了MongoDB数据库,发现和mysql数据库还是有很大差别的,同时使用前的配置看起来有些繁杂,踩过不少坑,其实只要一步一步搞清了,并不难. 接下来,我就整理下整个安装及配置过程. 安装的M ...
java中Map的put函数和get函数用法
---内容开始--- 没有比较完整的说明他们的用法,一般就只能看源函数,但是看起来比较的费劲. 那么究竟put函数和get函数的用法是如何的呢? 当然java中的Map集合是有Key和Value的. ...
SQL查询结果列拼接成逗号分隔的字符串：group_concat
转自:SQL查询结果列拼接成逗号分隔的字符串背景:做SQL查询时会经常需要,把查询的结果拼接成一个字符串. 解决方法: 通过 group_concat 函数拼接的结果很长,导致拼接结果显示不全,可 ...
题解 AT1877 【回文分割】
题意:给定一个字符串 s,将 s 分割成一些子串,使每个子串都是回文串. 返回 s 所有可能的分割方案. 示例: 输入:aab 输出:3 解释:aba 思路: 记录字符串中每个字符出现的次数si 如果 ...
HNUST-1681 机器人走格子(找规律)
1681: 机器人走格子时间限制: 1 Sec 内存限制: 128 MB提交: 244 解决: 58[提交][状态][讨论版] 题目描述一个长X宽Y的棋盘,有XY个格子.将机器人放在某个格子中 ...

darknet-yolov3模型预测框size不正确的原因

darknet-yolov3模型预测框size不正确的原因的更多相关文章

随机推荐

热门专题