之前一直记不熟各种指标的具体计算，本文准备彻底搞定这个问题，涵盖目前遇到过的所有评价指标。

TP，TN，FP，FN

首先是true-false和positive-negative这两对词。以二分类为例：

positive和negative指的是预测的分类是正样本还是负样本，true和false指的是预测结果是对的还是错的。

因此：

实际类别\预测类别	正样本	负样本
正样本	TP	FN
负样本	FP	TN

基于这些数值可以计算各项指标：

Accuracy, precision, recall等

Accuracy

\[
A C C=\frac{T P+T N}{T P+T N+F P+F N}
\]

分子为所有正确预测了的样本数目（即正样本被预测为正，负样本被预测为负），分母为所有样本总数。

Accuracy代表了所有样本中，被正确预测的样本所占的比例。

其缺陷在于，当正负样本严重不均衡的时候无法反映出模型的真实水平。

Precision

\[
P=\frac{T P}{T P+F P}
\]

分子为正样本被预测为正的个数，分母为所有被预测为正的个数。

Precision代表了被预测为正的样本中，真的是正样本的比例。又叫查准率。

Recall

\[
\operatorname{Recall}=\frac{T P}{T P+F N}
\]

分子为正被预测为正，分母为正样本的总数。

Recall代表了所有正样本中，被正确预测为正样本的比例。

Recall一般被称为召回率，，又叫Sensitivity，又叫查全率，它和一些传统方法中所说的正检率是一个概念。

Specificity

上述的Sensitivity对应的有Specificity：
\[
\operatorname{Specificity}=\frac{T N}{FP+TN}
\]
代表实际负样本中被预测为负的比例。

f1-score

\[
\mathrm{F} 1=\frac{2 * P * R}{P+R}
\]

f1-score是对precision和recall的调和平均值。

正检率，虚警率，漏警率

正检率（P_d）：正样本被正确检测到的概率，即recall。

漏警率（P_m）：正样本没有被预测为正的概率，即1-P_d，即1-recall。

虚警率（P_f）：负样本被预测为正的概率，即1-Specificity。

指标间的关系

为了更简单清楚的说明，用P和N表示预测结果是正和负，用P^和N^表示正样本和负样本。不用*号的原因是我不想在markdown里打一堆转义符。我们有P+N=P^+N^。

对于一个正常的识别模型，P中大多数应当是P^，小部分是N^；同样N中大多应当是N^，小部分是P^。

Precision和recall是互相矛盾的一对指标。直观地理解，precision为所有P中P^的比例，要想提高这个比例，需要更加严格的筛选，更严格的筛选意味着，模型只会将那些预测概率非常高的样本预测为P，显然这会更多地筛选掉实际为N^的P，剩下的P中P^。而对于recall，recall代表P^中P的比例，更加严格的筛选会导致，一些P^的样本没有被预测为P，从而导致recall下降。

同理，正检率与虚警率成正相关关系。

ROC曲线与PR曲线

ROC曲线

ROC曲线即纵轴为正检率，横轴为虚警率。

懒得放示意图了，简单描述一下，一般为从左下到右上的凹函数（注意凹函数的定义），区间为(0,0),(1,1)的正方形区域内。评估方法为计算曲线下积分面积，即AUC。

对于瞎猜模型，ROC曲线应当是一条从(0,0)到(1,1)的对角直线，故AUC为0.5。

对于一个正常的模型，AUC应当在0.5到1之间。越大越好。

PR曲线

类似地，PR曲线纵轴为precision，横轴为recall。

PR曲线一般为从左上到右下的凹函数，区间同样在(0,0),(1,1)的正方形区域。评估方法同样为计算曲线下积分值，称为AP值，对于多个分类，取平均，称为mAP值。

检测识别问题中的metrics的更多相关文章

Atitit 图像清晰度模糊度检测识别评价算法原理
Atitit 图像清晰度模糊度检测识别评价算法原理 1.1. 图像边缘一般都是通过对图像进行梯度运算来实现的1 1.2. Remark: 1 1.3. 1.失焦检测. 衡量画面模糊的主要方 ...
陈新宇：CKafka在人脸识别PAAS中的应用
欢迎大家前往腾讯云+社区,获取更多腾讯海量技术实践干货哦~ 本文首发在云+社区,未经许可,不得转载. 我叫陈新宇,在格灵深瞳负责数据流的研发,首先特别感谢如今老师,他们把Kafka一个优秀的消息中间件 ...
Atitit 图像清晰度模糊度检测识别评价算法源码实现attilax总结
Atitit 图像清晰度模糊度检测识别评价算法源码实现attilax总结 1.1. 原理,主要使用像素模糊后的差别会变小1 1.2. 具体流程1 1.3. 提升性能可以使用采样法即可..1 ...
Atitit 图像处理--图像分类模式识别肤色检测识别原理与attilax的实践总结
Atitit 图像处理--图像分类模式识别肤色检测识别原理与attilax的实践总结 1.1. 五中滤镜的分别效果..1 1.2. 基于肤色的图片分类1 1.3. 性能提升2 1.4. --co ...
Zybo智能小车识别图像中的文字
智能小车识别图像中的文字 [TOC] 运行平台这次的内容是基于Xilinx公司的Zybo开发板以及其配套的Zrobot套件开发 Zybo上面的sd卡搭载了Ubuntu12.04LTS的linux版本 ...
qtp不识别树结构中的点击事件
qtp不识别树结构中的点击事件,未生成该点击事件的脚本,解决办法: 1.未生成点击"auto分类c1"的脚本 2.点击1.对象库-2.添加对象库-3.选中对象-点击OK,即将该对象 ...
ASP.NET 后台不识别ASPX中的控件
请问后台不识别ASPX中的控件,怎么解决这个程序是在网上下载的 C# code <asp:DataGrid runat="server" ID="dgList1& ...
javacpp-opencv图像处理系列：国内车辆牌照检测识别系统（万份测试车牌识别准确率99.7%以上，单次平均耗时39ms）
javaCV图像处理系列: 一.javaCV图像处理之1:实时视频添加文字水印并截取视频图像保存成图片,实现文字水印的字体.位置.大小.粗度.翻转.平滑等操作二.javaCV图像处理之2:实时视频添 ...
Python中识别DataFrame中的nan
# 识别python中DataFrame中的nanfor i in pfsj.index: if type(pfsj.loc[i]['WZML']) == float: print('float va ...

随机推荐

邓士鹏【MySql大全】
禁止使用系统关键字: typename 1.计算两个日期的时间差函数 SELECT TIMESTAMPDIFF(MONTH,'2009-10-01','2009-09-01'); interval可是 ...
MySQL基础（5） | 存储过程
MySQL基础(5) | 存储过程一.基础结束符[重要] mysql的命令行执行每一条命令是以分号结尾的,也就是说识别是否为一条命令,是根据分号决定的. 然而存储过程中设计多条语句,很可能出现多个 ...
IDEA下配置JavaWeb项目
前提已安装IDEA专业版已安装Tomcat 已安装JDK 创建JavaWeb项目 File --> New --> Project... 设置工程名字: 创建完成后工程结构如下: 设置 ...
学习R语言的一点小心得
1.目前R 语言处于入门阶段吧,能够执行一些简单的模型了,还是有收获的. 但是在跑模型的时候经常遇到各种各样的错误,最常见的错误就是数据带入模型之后,数据的类型不对,因此模型跑不下去,因此说,利用he ...
吴裕雄--天生自然HADOOP操作实验学习笔记：hdfs分布式文件系统安装
实验目的复习安装jdk 学习免密码登录掌握安装配置hdfs集群的方法掌握hdfs集群的简单使用和检查其工作状态实验原理 1.hdfs是什么 hadoop安装的第一部分是安装hdfs,hdfs是 ...
理解Android线程创建流程
copy from : http://gityuan.com/2016/09/24/android-thread/ 基于Android 6.0源码剖析,分析Android线程的创建过程 /androi ...
用idea打包maven项目
利用idea工具打包项目 1.点击图中标记①,idea会自动生成打包命令,这个打包命令会包含单元测试内容,如果单元测试的内容报错,是打包不成功的,这个时候我们需要在打包命令中用 -Dmaven.tes ...
请求筛选模块被配置为拒绝包含双重转义序列的请求（.net core程序的‘web.config’调整）
之前项目有一个静态文件特殊字符转义的报错(+变为 %2B),老是显示404 请求筛选模块被配置为拒绝包含双重转义序列的请求 .网上的大多数解决方案都是一下: https://www.cnblogs ...
【14】Softmax回归
在下面的内容中,我们用C来表示需要分的类数. 最后一层的隐藏单元个数为4,为所分的类的数目,输出的值表示属于每个类的概率. Softmax函数的具体步骤如下图: 简单来说有三步: 计算z值(4×1矩阵 ...
PAT (Basic Level) Practice （中文）1029 旧键盘 (20 分)
旧键盘上坏了几个键,于是在敲一段文字的时候,对应的字符就不会出现.现在给出应该输入的一段文字.以及实际被输入的文字,请你列出肯定坏掉的那些键. 输入格式: 输入在 2 行中分别给出应该输入的文字.以及 ...

检测识别问题中的metrics