自己训练SVM分类器进行HOG行人检测

正样本来源是INRIA数据集中的96*160大小的人体图片，使用时上下左右都去掉16个像素，截取中间的64*128大小的人体。

负样本是从不包含人体的图片中随机裁取的，大小同样是64*128(从完全不包含人体的图片中随机剪裁出64*128大小的用于人体检测的负样本)。

SVM使用的是OpenCV自带的CvSVM类。

首先计算正负样本图像的HOG描述子，组成一个特征向量矩阵，对应的要有一个指定每个特征向量的类别的类标向量，输入SVM中进行训练。

训练好的SVM分类器保存为XML文件，然后根据其中的支持向量和参数生成OpenCV中的HOG描述子可用的检测子参数，再调用OpenCV中的多尺度检测函数进行行人检测。

难例(Hard Example)是指利用第一次训练的分类器在负样本原图(肯定没有人体)上进行行人检测时所有检测到的矩形框，这些矩形框区域很明显都是误报，把这些误报的矩形框保存为图片，加入到初始的负样本集合中，重新进行SVM的训练，可显著减少误报。

用训练好的分类器在负样本原图上检测Hard Example见：用初次训练的SVM+HOG分类器在负样本原图上检测HardExample

#include <iostream>

#include <fstream>

#include <opencv2/core/core.hpp>

#include <opencv2/highgui/highgui.hpp>

#include <opencv2/imgproc/imgproc.hpp>

#include <opencv2/objdetect/objdetect.hpp>

#include <opencv2/ml/ml.hpp>

using namespace std;

using namespace cv;

#define PosSamNO 2400    //正样本个数

#define NegSamNO 12000    //负样本个数

#define TRAIN false    //是否进行训练,true表示重新训练，false表示读取xml文件中的SVM模型

#define CENTRAL_CROP true   //true:训练时，对96*160的INRIA正样本图片剪裁出中间的64*128大小人体

//HardExample：负样本个数。如果HardExampleNO大于0，表示处理完初始负样本集后，继续处理HardExample负样本集。

//不使用HardExample时必须设置为0，因为特征向量矩阵和特征类别矩阵的维数初始化时用到这个值

#define HardExampleNO 4435  

//继承自CvSVM的类，因为生成setSVMDetector()中用到的检测子参数时，需要用到训练好的SVM的decision_func参数，

//但通过查看CvSVM源码可知decision_func参数是protected类型变量，无法直接访问到，只能继承之后通过函数访问

class MySVM : public CvSVM

{

public:

	//获得SVM的决策函数中的alpha数组

	double * get_alpha_vector()

	{

		return this->decision_func->alpha;

	}

	//获得SVM的决策函数中的rho参数,即偏移量

	float get_rho()

	{

		return this->decision_func->rho;

	}

};

int main()

{

	//检测窗口(64,128),块尺寸(16,16),块步长(8,8),cell尺寸(8,8),直方图bin个数9

	HOGDescriptor hog(Size(64,128),Size(16,16),Size(8,8),Size(8,8),9);//HOG检测器，用来计算HOG描述子的

	int DescriptorDim;//HOG描述子的维数，由图片大小、检测窗口大小、块大小、细胞单元中直方图bin个数决定

	MySVM svm;//SVM分类器

	//若TRAIN为true，重新训练分类器

	if(TRAIN)

	{

		string ImgName;//图片名(绝对路径)

		ifstream finPos("INRIAPerson96X160PosList.txt");//正样本图片的文件名列表

		//ifstream finPos("PersonFromVOC2012List.txt");//正样本图片的文件名列表

		ifstream finNeg("NoPersonFromINRIAList.txt");//负样本图片的文件名列表

		Mat sampleFeatureMat;//所有训练样本的特征向量组成的矩阵，行数等于所有样本的个数，列数等于HOG描述子维数

		Mat sampleLabelMat;//训练样本的类别向量，行数等于所有样本的个数，列数等于1；1表示有人，-1表示无人

		//依次读取正样本图片，生成HOG描述子

		for(int num=0; num<PosSamNO && getline(finPos,ImgName); num++)

		{

			cout<<"处理："<<ImgName<<endl;

			//ImgName = "D:\\DataSet\\PersonFromVOC2012\\" + ImgName;//加上正样本的路径名

			ImgName = "D:\\DataSet\\INRIAPerson\\INRIAPerson\\96X160H96\\Train\\pos\\" + ImgName;//加上正样本的路径名

			Mat src = imread(ImgName);//读取图片

			if(CENTRAL_CROP)

				src = src(Rect(16,16,64,128));//将96*160的INRIA正样本图片剪裁为64*128，即剪去上下左右各16个像素

			//resize(src,src,Size(64,128));

			vector<float> descriptors;//HOG描述子向量

			hog.compute(src,descriptors,Size(8,8));//计算HOG描述子，检测窗口移动步长(8,8)

			//cout<<"描述子维数："<<descriptors.size()<<endl;

			//处理第一个样本时初始化特征向量矩阵和类别矩阵，因为只有知道了特征向量的维数才能初始化特征向量矩阵

			if( 0 == num )

			{

				DescriptorDim = descriptors.size();//HOG描述子的维数

				//初始化所有训练样本的特征向量组成的矩阵，行数等于所有样本的个数，列数等于HOG描述子维数sampleFeatureMat

				sampleFeatureMat = Mat::zeros(PosSamNO+NegSamNO+HardExampleNO, DescriptorDim, CV_32FC1);

				//初始化训练样本的类别向量，行数等于所有样本的个数，列数等于1；1表示有人，0表示无人

				sampleLabelMat = Mat::zeros(PosSamNO+NegSamNO+HardExampleNO, 1, CV_32FC1);

			}

			//将计算好的HOG描述子复制到样本特征矩阵sampleFeatureMat

			for(int i=0; i<DescriptorDim; i++)

				sampleFeatureMat.at<float>(num,i) = descriptors[i];//第num个样本的特征向量中的第i个元素

			sampleLabelMat.at<float>(num,0) = 1;//正样本类别为1，有人

		}

		//依次读取负样本图片，生成HOG描述子

		for(int num=0; num<NegSamNO && getline(finNeg,ImgName); num++)

		{

			cout<<"处理："<<ImgName<<endl;

			ImgName = "D:\\DataSet\\NoPersonFromINRIA\\" + ImgName;//加上负样本的路径名

			Mat src = imread(ImgName);//读取图片

			//resize(src,img,Size(64,128));

			vector<float> descriptors;//HOG描述子向量

			hog.compute(src,descriptors,Size(8,8));//计算HOG描述子，检测窗口移动步长(8,8)

			//cout<<"描述子维数："<<descriptors.size()<<endl;

			//将计算好的HOG描述子复制到样本特征矩阵sampleFeatureMat

			for(int i=0; i<DescriptorDim; i++)

				sampleFeatureMat.at<float>(num+PosSamNO,i) = descriptors[i];//第PosSamNO+num个样本的特征向量中的第i个元素

			sampleLabelMat.at<float>(num+PosSamNO,0) = -1;//负样本类别为-1，无人

		}

		//处理HardExample负样本

		if(HardExampleNO > 0)

		{

			ifstream finHardExample("HardExample_2400PosINRIA_12000NegList.txt");//HardExample负样本的文件名列表

			//依次读取HardExample负样本图片，生成HOG描述子

			for(int num=0; num<HardExampleNO && getline(finHardExample,ImgName); num++)

			{

				cout<<"处理："<<ImgName<<endl;

				ImgName = "D:\\DataSet\\HardExample_2400PosINRIA_12000Neg\\" + ImgName;//加上HardExample负样本的路径名

				Mat src = imread(ImgName);//读取图片

				//resize(src,img,Size(64,128));

				vector<float> descriptors;//HOG描述子向量

				hog.compute(src,descriptors,Size(8,8));//计算HOG描述子，检测窗口移动步长(8,8)

				//cout<<"描述子维数："<<descriptors.size()<<endl;

				//将计算好的HOG描述子复制到样本特征矩阵sampleFeatureMat

				for(int i=0; i<DescriptorDim; i++)

					sampleFeatureMat.at<float>(num+PosSamNO+NegSamNO,i) = descriptors[i];//第PosSamNO+num个样本的特征向量中的第i个元素

				sampleLabelMat.at<float>(num+PosSamNO+NegSamNO,0) = -1;//负样本类别为-1，无人

			}

		}

		////输出样本的HOG特征向量矩阵到文件

		//ofstream fout("SampleFeatureMat.txt");

		//for(int i=0; i<PosSamNO+NegSamNO; i++)

		//{

		//	fout<<i<<endl;

		//	for(int j=0; j<DescriptorDim; j++)

		//		fout<<sampleFeatureMat.at<float>(i,j)<<"  ";

		//	fout<<endl;

		//}

		//训练SVM分类器

		//迭代终止条件，当迭代满1000次或误差小于FLT_EPSILON时停止迭代

		CvTermCriteria criteria = cvTermCriteria(CV_TERMCRIT_ITER+CV_TERMCRIT_EPS, 1000, FLT_EPSILON);

		//SVM参数：SVM类型为C_SVC；线性核函数；松弛因子C=0.01

		CvSVMParams param(CvSVM::C_SVC, CvSVM::LINEAR, 0, 1, 0, 0.01, 0, 0, 0, criteria);

		cout<<"开始训练SVM分类器"<<endl;

		svm.train(sampleFeatureMat, sampleLabelMat, Mat(), Mat(), param);//训练分类器

		cout<<"训练完成"<<endl;

		svm.save("SVM_HOG.xml");//将训练好的SVM模型保存为xml文件

	}

	else //若TRAIN为false，从XML文件读取训练好的分类器

	{

		svm.load("SVM_HOG_2400PosINRIA_12000Neg_HardExample(误报少了漏检多了).xml");//从XML文件读取训练好的SVM模型

	}

	/*************************************************************************************************

	线性SVM训练完成后得到的XML文件里面，有一个数组，叫做support vector，还有一个数组，叫做alpha,有一个浮点数，叫做rho;

	将alpha矩阵同support vector相乘，注意，alpha*supportVector,将得到一个列向量。之后，再该列向量的最后添加一个元素rho。

	如此，变得到了一个分类器，利用该分类器，直接替换opencv中行人检测默认的那个分类器（cv::HOGDescriptor::setSVMDetector()），

	就可以利用你的训练样本训练出来的分类器进行行人检测了。

	***************************************************************************************************/

	DescriptorDim = svm.get_var_count();//特征向量的维数，即HOG描述子的维数

	int supportVectorNum = svm.get_support_vector_count();//支持向量的个数

	cout<<"支持向量个数："<<supportVectorNum<<endl;

	Mat alphaMat = Mat::zeros(1, supportVectorNum, CV_32FC1);//alpha向量，长度等于支持向量个数

	Mat supportVectorMat = Mat::zeros(supportVectorNum, DescriptorDim, CV_32FC1);//支持向量矩阵

	Mat resultMat = Mat::zeros(1, DescriptorDim, CV_32FC1);//alpha向量乘以支持向量矩阵的结果

	//将支持向量的数据复制到supportVectorMat矩阵中

	for(int i=0; i<supportVectorNum; i++)

	{

		const float * pSVData = svm.get_support_vector(i);//返回第i个支持向量的数据指针

		for(int j=0; j<DescriptorDim; j++)

		{

			//cout<<pData[j]<<" ";

			supportVectorMat.at<float>(i,j) = pSVData[j];

		}

	}

	//将alpha向量的数据复制到alphaMat中

	double * pAlphaData = svm.get_alpha_vector();//返回SVM的决策函数中的alpha向量

	for(int i=0; i<supportVectorNum; i++)

	{

		alphaMat.at<float>(0,i) = pAlphaData[i];

	}

	//计算-(alphaMat * supportVectorMat),结果放到resultMat中

	//gemm(alphaMat, supportVectorMat, -1, 0, 1, resultMat);//不知道为什么加负号？

	resultMat = -1 * alphaMat * supportVectorMat;

	//得到最终的setSVMDetector(const vector<float>& detector)参数中可用的检测子

	vector<float> myDetector;

	//将resultMat中的数据复制到数组myDetector中

	for(int i=0; i<DescriptorDim; i++)

	{

		myDetector.push_back(resultMat.at<float>(0,i));

	}

	//最后添加偏移量rho，得到检测子

	myDetector.push_back(svm.get_rho());

	cout<<"检测子维数："<<myDetector.size()<<endl;

	//设置HOGDescriptor的检测子

	HOGDescriptor myHOG;

	myHOG.setSVMDetector(myDetector);

	//myHOG.setSVMDetector(HOGDescriptor::getDefaultPeopleDetector());

	//保存检测子参数到文件

	ofstream fout("HOGDetectorForOpenCV.txt");

	for(int i=0; i<myDetector.size(); i++)

	{

		fout<<myDetector[i]<<endl;

	}

	/**************读入图片进行HOG行人检测******************/

	//Mat src = imread("00000.jpg");

	//Mat src = imread("2007_000423.jpg");

	Mat src = imread("1.png");

	vector<Rect> found, found_filtered;//矩形框数组

	cout<<"进行多尺度HOG人体检测"<<endl;

	myHOG.detectMultiScale(src, found, 0, Size(8,8), Size(32,32), 1.05, 2);//对图片进行多尺度行人检测

	cout<<"找到的矩形框个数："<<found.size()<<endl;

	//找出所有没有嵌套的矩形框r,并放入found_filtered中,如果有嵌套的话,则取外面最大的那个矩形框放入found_filtered中

	for(int i=0; i < found.size(); i++)

	{

		Rect r = found[i];

		int j=0;

		for(; j < found.size(); j++)

			if(j != i && (r & found[j]) == r)

				break;

		if( j == found.size())

			found_filtered.push_back(r);

	}

	//画矩形框，因为hog检测出的矩形框比实际人体框要稍微大些,所以这里需要做一些调整

	for(int i=0; i<found_filtered.size(); i++)

	{

		Rect r = found_filtered[i];

		r.x += cvRound(r.width*0.1);

		r.width = cvRound(r.width*0.8);

		r.y += cvRound(r.height*0.07);

		r.height = cvRound(r.height*0.8);

		rectangle(src, r.tl(), r.br(), Scalar(0,255,0), 3);

	}

	imwrite("ImgProcessed.jpg",src);

	namedWindow("src",0);

	imshow("src",src);

	waitKey();//注意：imshow之后必须加waitKey，否则无法显示图像

	/******************读入单个64*128的测试图并对其HOG描述子进行分类*********************/

	////读取测试图片(64*128大小)，并计算其HOG描述子

	////Mat testImg = imread("person014142.jpg");

	//Mat testImg = imread("noperson000026.jpg");

	//vector<float> descriptor;

	//hog.compute(testImg,descriptor,Size(8,8));//计算HOG描述子，检测窗口移动步长(8,8)

	//Mat testFeatureMat = Mat::zeros(1,3780,CV_32FC1);//测试样本的特征向量矩阵

	////将计算好的HOG描述子复制到testFeatureMat矩阵中

	//for(int i=0; i<descriptor.size(); i++)

	//	testFeatureMat.at<float>(0,i) = descriptor[i];

	////用训练好的SVM分类器对测试图片的特征向量进行分类

	//int result = svm.predict(testFeatureMat);//返回类标

	//cout<<"分类结果："<<result<<endl;

	system("pause");

}

结果：

(1) 1500个INRIA正样本，2000个负样本，结果误报太多：

(2) 2400个INRIA正样本，12000个负样本，结果表明负样本增多后误报明显减少，但依然有不少误报：

(3)2400个INRIA正样本，12000个负样本 + 4435个用(2)中的分类器在负样本原图上检测出来的Hard Example，

结果误报明显减少，几乎没有误报了，但同时漏检率增加：

上图中的两个小女孩都没有被检测出来

(4)下面是OpenCV中HOG检测器的默认SVM参数的结果，OpenCV自带的SVM参数也是用INRIA数据集训练得到的：

上图中的两个小女孩用OpenCV默认SVM参数也检测不出来。

所以感觉要想效果好的话，还应该加大正样本的个数。

参考：
http://blog.csdn.net/carson2005/article/details/7841443

源码下载，环境为VS2010 + OpenCV2.4.4

http://download.csdn.net/detail/masikkk/6547973

自己训练SVM分类器进行HOG行人检测的更多相关文章

hog行人检测
本文主要介绍下opencv中怎样使用hog算法,因为在opencv中已经集成了hog这个类.其实使用起来是很简单的,从后面的代码就可以看出来.本文参考的资料为opencv自带的sample. 关于op ...
HOG行人检测如何制作样品
原文链接:http://blog.csdn.net/Armily/article/details/8333836 如何制作训练样本分析了原作者的数据集,结合网上一些资料,下面描述如何制作训练样本 1 ...
利用Hog特征和SVM分类器进行行人检测
在2005年CVPR上,来自法国的研究人员Navneet Dalal 和Bill Triggs提出利用Hog进行特征提取,利用线性SVM作为分类器,从而实现行人检测.而这两位也通过大量的测试发现,Ho ...
HOG + SVM(行人检测, opencv实现)
HOG+SVM流程 1.提取HOG特征灰度化 + Gamma变换(进行根号求解) 计算梯度map(计算梯度) 图像划分成小的cell,统计每个cell梯度直方图多个cell组成一个block, 特 ...
HOG目标检测
用HOG进行行人检测时,需要用训练好的支持向量机来对图片进行分类,在opencv中,支持向量机已经训练好,但自己来训练支持向量机才能更好的体会这一过程. 参考:http://blog.csdn.net ...
机器学习经典算法详解及Python实现--基于SMO的SVM分类器
原文:http://blog.csdn.net/suipingsp/article/details/41645779 支持向量机基本上是最好的有监督学习算法,因其英文名为support vector ...
Hog SVM 车辆行人检测
HOG SVM 车辆检测近期需要对卡口车辆的车脸进行检测,首先选用一个常规的检测方法即是hog特征与SVM,Hog特征是由dalal在2005年提出的用于道路中行人检测的方法,并且取的了不错的识别效 ...
如何正确训练一个 SVM + HOG 行人检测器
这几个月一直在忙着做大论文,一个基于 SVM 的新的目标检测算法.为了做性能对比,我必须训练一个经典的 Dalal05 提出的行人检测器,我原以为这个任务很简单,但是我错了. 为了训练出一个性能达标的 ...
利用HOG+SVM实现行人检测
利用HOG+SVM实现行人检测很久以前做的行人检测,现在稍加温习,上传记录一下. 首先解析视频,提取视频的每一帧形成图片存到磁盘.代码如下 import os import cv2 videos_s ...

随机推荐

hdu3397区间覆盖，区间翻转，区间合并，区间求和
调了很久的代码..注意区间翻转和覆盖的操作互相的影响 /* 区间替换操作怎么搞? 应该是加个tag标记如果整个区间都是0|1,那么把若有tag的话直接set1|0即可,也不用设置tag标记反之要设 ...
js中数组去重
编写函数norepeat(arr) 将数组的重复元素去掉,并返回新的数组 [注]正序去重,会漏掉一些元素. [注]去重倒序. var arr = [10, 20, 30, 40, 30, 20, 20 ...
【动态规划】Part1
1. 硬币找零题目描述:假设有几种硬币,如1.3.5,并且数量无限.请找出能够组成某个数目的找零所使用最少的硬币数. 分析: dp [0] = 0 dp [1] = 1 + ...
otter部署【原创】
环境IP:10.10.6.171 部署:mysql源库IP:10.10.6.172 部署:mysql目标库IP:10.10.6.173 部署:zookeeper,manager,node,canal ...
[转] 通过Ajax方式上传文件，使用FormData进行Ajax请求
通过传统的form表单提交的方式上传文件: <form id= "uploadForm" action= "http://localhost:8080/cfJAX_ ...
解决Delphi7的自带的UTF-8编码转换函数BUG
Delphi7及其以下版本的 VCL 只支持 Ansi, 所以... WideString 与 UTF8String (定义与 AnsiString 相同) 并没有办法正确的在 VCL 中显示 Del ...
python爬取糗百内容
#-*- coding: utf-8 -*- import urllib import urllib2 import re #页面为1 page=1 url='http://www.qiushibai ...
【Java】剑指offer(41) 数据流中的中位数
本文参考自<剑指offer>一书,代码采用Java语言. 更多:<剑指Offer>Java实现合集题目如何得到一个数据流中的中位数?如果从数据流中读出奇数个数值,那么中 ...
OSINT系列：网站信任评估WOT
OSINT系列:网站信任评估WOT Web of Trust(WOT)是芬兰的一家网站信任评估服务公司.它通过收集用户对网站的评价,来评估网站的可信任度.在该公司网站www.mywot.com,用户 ...
在webpack中使用postcss之插件包precss
precss是一个预处理css的插件包,集成了很多postcss插件的功能,比如嵌套,变量,继承,混合,循环,判断.下面来介绍如何在webpack中使用precss.一.新建项目1.新建package ...

自己训练SVM分类器进行HOG行人检测

自己训练SVM分类器进行HOG行人检测的更多相关文章

随机推荐

热门专题