将自己数据转化为cifar10支持的lmdb
首先,看一下cafferoot/data/cifar10(cafferoot指的是自己caffe安装的根目录)下面的get_cifar10.sh
可见其下载的是bin格式的图片,然后通过cafferoot/examples/cifar10/create_cifar10.sh将bin文件转化为lmdb格式。
那么这样的问题来了,由于,cifar10由官网提供了2进制的bin文件,如果我们想训练自己的模型呢?如果我们想加进自己的图片呢。所以,一个保持和官网cifar10同步的将传统的jpg、png等格式转为bin格式的程序应用而生。
进入正题
1,cifar10的bin数据格式
image 的大小为32*32,flag为0-9,共10类,使用的是cifar-10数据集
二进制数据格式为flag,R(1024),G(1024),B(1024),每个通道按行排列
2,读取cifar10的bin文件,将bin文件中数据转化为图片并显示
- void read_cifar_bin(string file_address,vector<Mat>& image,vector<int>& flag)
- {
- int width = 32, height = 32;//注意这个数值,根据自己样本的大小进行修改,重要的事情说三遍
- ifstream fin(file_address, ios::binary);
- while (!fin.eof())
- {
- char flag_tmp;
- unsigned char tmp;
- Mat image_tmp(width, height, CV_8UC3);
- fin.read((char *)&flag_tmp, sizeof(flag_tmp));
- for (int j = 2; j >=0; j--)
- {
- for (int r = 0; r < image_tmp.rows; r++)
- for (int c = 0; c < image_tmp.cols; c++)
- {
- fin.read((char *)&tmp, sizeof(tmp));
- image_tmp.at<Vec3b>(r, c)[j] = tmp;
- }
- }
- image.push_back(image_tmp);
- flag.push_back(flag_tmp);
- }
- }
3,将自己的jpg,png等传统格式转化为cifar10支持的bin文件
- void write_cifar_bin(string file_address, vector<string>& image_address, vector<int>& flag)
- {
- ofstream fout(file_address, ios::binary);
- for (size_t i = 0; i < image_address.size(); i++)
- {
- Mat image_tmp = imread(image_address[i], 1);
- resize(image_tmp, image_tmp, Size(32, 32));
- int pix[1024];
- char flag_tmp = flag[i];
- fout.write((char *)&flag_tmp, sizeof(flag_tmp));
- for (int j = 2; j >= 0; j--)
- {
- for (int r = 0; r < image_tmp.rows; r++)
- for (int c = 0; c < image_tmp.cols; c++)
- {
- unsigned char tmp = image_tmp.at<Vec3b>(r, c)[j];
- fout.write((char *)&tmp, sizeof(tmp));
- }
- }
- }
- }
- int main()
- {
- string file_address = "data_batch_1.bin";
- vector<Mat> image;
- vector<int>flag;
- read_cifar_bin(file_address, image, flag);
- imshow("test", image[5000]);//随便需要显示的图像。可以跟改[]中数据进行验证
- waitKey();
- return 0;
- }
5,将bin转为图片的测试,并保存为jpg,并且保存相应的flag
- int main()
- {
- string file_address = "data_batch_1.bin";
- vector<Mat> image;
- vector<int>flag;
- read_cifar_bin(file_address, image, flag);
- ofstream mydata_batch_1("mydata_batch_1.txt");
- for (int i = 0; i < image.size(); i++)
- {
- char buffer[50];
- char address[100] = ".\\data_batch_1\\";
- _itoa(i, buffer, 10);
- imwrite(strcat(address, strcat(buffer, ".jpg")), image[i]);
- mydata_batch_1 << address << buffer <<".jpg"<< " " << flag[i] << endl;
- cout << i << endl;
- waitKey(1);
- }
- return 0;
- }
6,将图像转为bin
- int main()
- {
- string file_address = "mydata_batch_1.bin";
- vector<string> image_address;
- vector<int> flag;
- ifstream finSample("mydata_batch_1.txt");
- char buf[100], buftmp[50], flagtmp[10];
- while (!finSample.eof())
- {
- finSample.getline(buf, sizeof(buf));
- sscanf(buf, "%s %s", buftmp, flagtmp);
- int tmp=atoi(flagtmp);
- image_address.push_back(buftmp);
- flag.push_back(tmp);
- }
- write_cifar_bin(file_address, image_address, flag);
- return 0;
- }
7,实验测试
(1)【步骤4】将cifar10的data_batch_1.bin转化为图像的测试,从左到右依次为image[0],image[5000],image[9999](cifar10每个batch有10000个图像,所以是0-9999)
(2) 【步骤5】将cifar10的data_batch_1.bin转化为图像,并保存在jpg格式的测试。
(3)【步骤6】将第二步生成的jpg转化为bin文件, 程序运行后将生成mydata_batch_1.bin,可以看到和原始的data_batch_1.bin有着同样的大小。
那么到底这个和原始的一样不一样呢?我们还是使用步骤4的程序进行测试,同样的还是测试image[0],image[5000],image[9999],从下图可以看出和原始的bin的数据是一样的。
有了上面的2个转化程序,就可以转化自己的图像了,then let's make some noise!
将自己数据转化为cifar10支持的lmdb的更多相关文章
- C# Json数据反序列化为Dictionary并根据关键字获取指定值1
Json数据: { "dataSet": { "header": { "returnCode": "0", " ...
- C# Json数据反序列化为Dictionary并根据关键字获取指定值
Json数据: { "dataSet": { "header": { "returnCode": "0", " ...
- 将Dictionary序列化为json数据 、json数据反序列化为Dictionary
需要引用System.Web.Extensions dll类库 /// <summary> /// 将json数据反序列化为Dictionary /// </summary> ...
- Excel数据转化为sql脚本
在实际项目开发中,有时会遇到客户让我们把大量Excel数据导入数据库的情况.这时我们就可以通过将Excel数据转化为sql脚本来批量导入数据库. 1 在数据前插入一列单元格,用来拼写sql语句. 具体 ...
- C#:Json数据反序列化为Dictionary并根据关键字获取指定的值
转自曾是土木人原文 C#:Json数据反序列化为Dictionary并根据关键字获取指定的值 Json数据: { "dataSet": { "header": ...
- [转]Excel数据转化为sql脚本
在实际项目开发中,有时会遇到客户让我们把大量Excel数据导入数据库的情况.这时我们就可以通过将Excel数据转化为sql脚本来批量导入数据库. 1 在数据前插入一列单元格,用来拼写sql语句. 具体 ...
- 记一次深刻的教训-----将mat数据转化为SequenceFile
深刻的体会就是,“java.lang.NullPointer.Exception”就是空指针异常可能是由于数组部分元素未被初始化引起的. 1)使用jmatio将mat数据转化为SequenceFile ...
- 把数据转化为JSON格式用ajax进行前后端交互
接着在https://www.cnblogs.com/dong973711/p/10907733.html的基础上做验证. 从前端提交数据 前端页面,submit.html <!DOCTYPE ...
- MySQL随机获取数据的方法,支持大数据量
最近做项目,需要做一个从mysql数据库中随机取几条数据出来. 总所周知,order by rand 会死人的..因为本人对大数据量方面的只是了解的很少,无解,去找百度老师..搜索结果千篇一律.特发到 ...
随机推荐
- 从客户端中检测到有潜在危险的 Request.Form 值的问题的解决方法。
在controller控制器里面添加[ValidateInput(false)] [ValidateInput(false)] public ActionResult m ...
- python的文件编码注释
在python源文件的第一行或第二行写入如下内容: # -*- coding:gbk -*- # 设置源文件编码格式为gbk 或 # -*- coding:utf-8 -*- # 设置源文件编码格式为 ...
- c++ rapidjson解析多层级json
如果一个层级为data,其内部又包含一个层级status, 可以直接通过这种方式来跨级访问: rapidjson::Value& val_status = doc["data&quo ...
- 基于NodeJS的全栈式开发(基于NodeJS的前后端分离)
也谈基于NodeJS的全栈式开发(基于NodeJS的前后端分离) 前言 为了解决传统Web开发模式带来的各种问题,我们进行了许多尝试,但由于前/后端的物理鸿沟,尝试的方案都大同小异.痛定思痛,今天我们 ...
- 何时使用padding和margin
先看看这张图: 重点其实是background-image CSS边距属性定义元素周围的空间.通过使用单独的属性,可以对上.右.下.左的外边距进行设置.也可以使用简写的外边距属性同时改变所有的外边距. ...
- BZOJ4561 JLoi2016 圆的异或并 【扫描线】【set】*
BZOJ4561 JLoi2016 圆的异或并 Description 在平面直角坐标系中给定N个圆.已知这些圆两两没有交点,即两圆的关系只存在相离和包含.求这些圆的异或面积并.异或面积并为:当一片区 ...
- flask第十六篇——Response【2】
今天来介绍自定义返回对象: 现在我们假定有一个需求:所有的视图函数都要返回json格式的对象我们先看一下Response的源码: 发现只有一行default_mimetype='text/html', ...
- 【oracle】Oracle安装概述
一.各种分布式数据库 MS SQL Server是中大型分布式关系型数据库. Oracle ,DB2(IBM)是超大型分布式关系数据库. MySql是中小型分布式关系型数据库. 二.Oracle O ...
- C#通过StreamWriter对象实现把数值内容写到记事本
本文介绍下,用C#实现将数组内容写到txt文件中的一例代码,有需要的朋友,参考下吧. 代码示例:StreamWriter sw=new StreamWriter("F:\\ex.txt&qu ...
- uwsgi配置理解
最近使用uwsgi 部署了flask应用,出现了不少问题,仔细查阅了一下资料以及翻看了官方文档,就对自己了解到的做个总结~~ 一.http/http-socket/socketuwsgi开头当然少不了 ...