Classification week6: precision & recall 笔记

华盛顿大学 machine learning ：classification 笔记

第6周 precision & recall

1.accuracy 局限性

　　我们习惯用 accuracy 评价一个分类器模型的准确程度，accuracy即正确预测的样本数/预测样本总数，一般情况下这种评价都适用。

　　但假设一个这样的二分类器，95%的数据都是 +1 ，分类器直接把所有数据预测为 +1，那这个分类器的accuracy 为95%, 很高，但显然这不是个好的分类器。对于这样的数　　据，评价一个分类器模型准确程度还需别的评价标准。

2.True Positive & False Positive & False Negative & True Negative

　　对于一个二分类器，预测结果可能有以下几种情况:

　　True Positive: 实际为 +1，预测也为 +1。

　　False Positive: 实际为 -1，预测为 +1。

　　False Negative: 实际为 +1，预测为 -1。

　　True Negative: 实际为 -1，预测也为 -1。

3. Accuracy & precision & recall

　　Accuracy 表示为：

　　考虑另外两个评价参数 precision 和 recall。

4.Optimistic model & pessimistic model

Optimistic model：

　　一个预测模型过于乐观，即几乎对于所有样本都预测为 +1，这种情况往往发生在数据集多数为 +1 ，且模型过拟合的情况下。

　　这种模型的预测结果中， False Negative很少（实际+1 被预测为 -1），False Positive较多（实际-1 被预测为 +1）。即precision 较低， recall较高，Precision 和recall 中主要应注意 precision。

　　对于这种模型，需要注意减少false positive 的数量, 即：

　　计算Cost时false positive 与 false negative权重不同，false positive 的权重应更高；

　　提高预测为 +1 的confidence level，即提高判断为+1的阈值（+1 if probability >= threshold else -1），模型需要在更有把握的时候才能预测为 +1。

pessimistic model：

　　一个预测模型过于悲观，即只有在非常肯定的情况下才会预测为 +1，

　　这种模型的预测结果中， False Negative很多（实际+1 被预测为 -1），False Positive较少（实际-1 被预测为 +1）。即 precision较高， recall较低，应主要注意 recall。

　　对于这种模型，需要注意减少false negative 的数量，即

　　计算Cost时提高false negative 的权重。

　　降低预测为 +1 的confidence level。

5. 用Precision & recall评价模型好坏

　　显然，最理想的模型 precision、recall 都为1，然而实际情况中面临着 precision & recall 之间的权衡问题，precision 和recall 往往是此消彼长，例如有两个分类器模型A 和B，如下图所示，考虑到precision 和 recall, 哪个模型更好?

一个评价方法是：比较曲线下的面积大小（area-under-the-curve, AUC）。以这种方法进行比较，显然B分类器更好。

Classification week6: precision & recall 笔记的更多相关文章

评价指标整理：Precision, Recall, F-score, TPR, FPR, TNR, FNR, AUC, Accuracy
针对二分类的结果,对模型进行评估,通常有以下几种方法: Precision.Recall.F-score(F1-measure)TPR.FPR.TNR.FNR.AUCAccuracy 真实结果 1 ...
查准与召回（Precision & Recall）
Precision & Recall 先看下面这张图来理解了,后面再具体分析.下面用P代表Precision,R代表Recall 通俗的讲,Precision 就是检索出来的条目中(比如网页) ...
TP Rate ,FP Rate, Precision, Recall, F-Measure, ROC Area,
TP Rate ,FP Rate, Precision, Recall, F-Measure, ROC Area, https://www.zhihu.com/question/30643044 T/ ...
机器学习：评价分类结果（Precision - Recall 的平衡、P - R 曲线）
一.Precision - Recall 的平衡 1)基础理论调整阈值的大小,可以调节精准率和召回率的比重: 阈值:threshold,分类边界值,score > threshold 时分类为 ...
Precision,Recall,F1的计算
Precision又叫查准率,Recall又叫查全率.这两个指标共同衡量才能评价模型输出结果. TP: 预测为1(Positive),实际也为1(Truth-预测对了) TN: 预测为0(Negati ...
目标检测的评价标准mAP, Precision, Recall, Accuracy
目录 metrics 评价方法 TP , FP , TN , FN 概念计算流程 Accuracy , Precision ,Recall Average Precision PR曲线 AP计算 A ...
Handling skewed data---trading off precision& recall
preision与recall之间的权衡依然是cancer prediction的例子,预测为cancer时,y=1;一般来说做为logistic regression我们是当hθ(x)>=0 ...
通过Precision/Recall判断分类结果偏差极大时算法的性能
当我们对某些问题进行分类时,真实结果的分布会有明显偏差. 例如对是否患癌症进行分类,testing set 中可能只有0.5%的人患了癌症. 此时如果直接数误分类数的话,那么一个每次都预测人没有癌症的 ...
机器学习基础梳理—(accuracy,precision,recall浅谈)
一.TP TN FP FN TP:标签为正例,预测为正例(P),即预测正确(T) TN:标签为负例,预测为负例(N),即预测正确(T) FP:标签为负例,预测为正例(P),即预测错误(F) FN:标签 ...

随机推荐

Splunk 会议回想: 大数据的关键是机器学习
作者 Jonathan Allen ,译者张晓鹏 Splunk的用户大会已经接近尾声.三天时间的会议里,共进行了160多个主题研讨.涵盖了从安全.运营到商业智能.甚至包含物联网,会议中一遍又一遍出现 ...
B5:责任链模式 Chain Of Responsibility
使多个对象都有机会处理处理请求,从而避免请求的发送者和接受者之间的耦合关系.将这个对象连成一条链,并沿着该链处理请求,直到有一个对象能够处理它为止. 相当于switch/case,在客户端指定了每一链 ...
JSP--百度百科
JSP全名为Java Server Pages,中文名叫java服务器页面,其根本是一个简化的Servlet设计,它[1] 是由Sun Microsystems公司倡导.许多公司参与一起建立的一种动 ...
WP8 NavigationInTransition实现页面切换效果
NavigationInTransition这个是实现页面切换效果,而且没控件来拖,要自己手动写, 将App.xaml.cs中InitializePhoneApplication()函数里的RootF ...
shell exec命令执行shell打印输出到一个文件
[root@master ~]# .sh #!/bin/bash exec >> /tmp/.log >>/tmp/.log date ldkkdfkslfds date [r ...
HTTP请求报文属性详解
HTTP请求报文组成:请求行+请求头+请求体注意:请求体和URL都可以传递请求参数. 常见请求头属性: 1.Accept 作用:浏览器客户端用来告诉服务端能接受什么类型的响应. 例如: Acce ...
HTML5特性
HTML5规范围绕如何使用新增标记定义了大量Javascript API,其中一些API与DOM重叠,定义了浏览器应该支持DOM拓展. 1.与类相关的扩充 HTML5新增了getElementsByC ...
Docker 基础概念科普和常用操作介绍
Docker 基础概念 Docker是什么? Docker的思想来自于集装箱,集装箱解决了:在一艘大船上,可以把货物规整的摆放起来.并且各种各样的货物被集装箱标准化了,集装箱和集装箱之 ...
android中几个很有用的的api
0x0001 public PackageInfo getPackageArchiveInfo (String archiveFilePath, int flags) Since: API Level ...
C++ Primer Plus的若干收获--（二）
哎,真是不想吐槽考驾照的艰辛历程了.跑到大西郊,顶着大太阳,一天就能摸上个十几分钟二十分钟的车,简直不要太坑爹,这两天真是做的我屁股疼的不行. .. 今天果断不去了.仅仅可惜我的大阿根廷啊,坚持到最后 ...

Classification week6: precision & recall 笔记

Classification week6: precision & recall 笔记的更多相关文章

随机推荐

热门专题