coco数据集标注图转为二值图python（附代码）

coco数据集大概有8w张以上的图片，而且每幅图都有精确的边缘mask标注。

后面后分享一个labelme标注的json或xml格式转二值图的源码（以备以后使用）

而我现在在研究显著性目标检测，需要的是边缘mask的二值图像。搜了很久，并没有人做过这种工作，只能得到如下的掩膜图

而我需要的图像为二值图，如下

说下我的过程并附上代码：

首先，coco数据集将所有的8w多张图片标注信息整合到一个json文件中，所以我们需要将单张图片标注信息json文件提取出来，以下是批量提取脚本。

注：需要改动地方 1）第6行：将json_file改为原coco数据集json文件的地址（coco/annotations/xxxxx.json）

2) 第13行：设置需要提取的图片数量我是提取82000张

3）第37行：设置存储json文件的目录需要新建空文件夹我是放在./coco_single_object下

4）第33-35行：可选将图片的名称写入data.txt中不需要的话可以注释掉

 # -*- coding:utf-8 -*-

 from __future__ import print_function

 import json

 #json文件的地址 需要手动设置

 json_file='../pycocotools/instances_train2014.json' # # Object Instance 类型的标注

 # person_keypoints_val2017.json  # Object Keypoint 类型的标注格式

 # captions_val2017.json  # Image Caption的标注格式

 data=json.load(open(json_file,'r'))

 #设置需要提取的图片数量 我设置提取82000张

 for i in range(82000):

     data_2 = {}

     data_2['info'] = data['info']

     data_2['licenses'] = data['licenses']

     data_2['images'] = [data['images'][i]]  # 只提取第一张图片

     data_2['categories'] = data['categories']

     annotation = []

     # 通过imgID 找到其所有对象

     imgID = data_2['images'][0]['id']

     for ann in data['annotations']:

         if ann['image_id'] == imgID:

             annotation.append(ann)

     data_2['annotations'] = annotation

     # 保存到新的JSON文件，便于查看数据特点

     #img_file 获取图片名称

     img_file=data_2['images'][0]['file_name']

     img_first=img_file.split(".")[0]

     #将提取出的图片写入data.txt文件中并换行 (optional)

     # with open('./coco_single_object/data.txt',mode='a') as f:

     #         f.write(img_file)

     #         f.write("\n")

     #设置存储目录 我的是存在当前目录下coco_single_object文件夹下 需要手动创建空文件夹

     json.dump(data_2, open('./coco_single_object/'+img_first+'.json', 'w'), indent=4)  # indent=4 更加美观显示

最后的结果是82000张 json文件

---------------------------------------------------------------------------------------------------------------------------------------

有了单张json文件之后，就是将mask掩膜提取出二值图片的过程了

注：函数传入4个参数 json_path,img_path,color_img_save,binary_img_save

分别对应 json_path: 上一步提取出的json文件的文件夹路径

img_path: coco数据集下载时原图目录

color_img_save: 存放原图的目录（需要新建此文件夹）

binary_img_save: 存放二值图的目录（需要新建此文件夹）

 from __future__ import print_function

 from pycocotools.coco import COCO

 import os, sys, zipfile

 import urllib.request

 import shutil

 import numpy as np

 import skimage.io as io

 import matplotlib.pyplot as plt

 import pylab

 pylab.rcParams['figure.figsize'] = (8.0, 10.0)

 import os

 def get_single_binaryImg(json_path,img_path,color_img_save,binary_img_save):

     # json_path json文件路径  从coco数据集的annotations标注json文件中提取出的单个json文件

     #  img_path 原图目录   下载coco数据集时的原图目录

     # color_img_save 原图存放目录

     # binary_img_save 二值图存放目录

     dir=os.listdir(json_path)

     for jfile in dir:

         annFile =os.path.join(json_path,jfile)

         coco = COCO(annFile)

         imgIds = coco.getImgIds()

         img = coco.loadImgs(imgIds[0])[0]

         dataDir = img_path

         shutil.copy(os.path.join(dataDir, img['file_name']), color_img_save)

         # load and display instance annotations

         # 加载实例掩膜

         catIds = []

         for ann in coco.dataset['annotations']:

             if ann['image_id'] == imgIds[0]:

                 catIds.append(ann['category_id'])

         annIds = coco.getAnnIds(imgIds=img['id'], catIds=catIds, iscrowd=None)

         width = img['width']

         height = img['height']

         anns = coco.loadAnns(annIds)

         mask_pic = np.zeros((height, width))

         for single in anns:

             mask_single = coco.annToMask(single)

             mask_pic += mask_single

         for row in range(height):

             for col in range(width):

                 if (mask_pic[row][col] > 0):

                     mask_pic[row][col] = 255

         imgs = np.zeros(shape=(height, width, 3), dtype=np.float32)

         imgs[:, :, 0] = mask_pic[:, :]

         imgs[:, :, 1] = mask_pic[:, :]

         imgs[:, :, 2] = mask_pic[:, :]

         imgs = imgs.astype(int)

         img_name = img['file_name'].split(".")[0]

         plt.imsave(binary_img_save + "/" + img_name + ".png", imgs)

 if __name__ == '__main__':

     json_path =r"G:\jianfeng\code\dataset\cocoapi-master\PythonAPI\get_json\test"

     img_path=r"G:\jianfeng\code\dataset\coco\train2014"

     color_img_save = r"G:\jianfeng\code\dataset\cocoapi-master\PythonAPI\get_json\color_img"

     binary_img_save = r"G:\jianfeng\code\dataset\cocoapi-master\PythonAPI\get_json\binary_img"

     get_single_binaryImg(json_path,img_path,color_img_save,binary_img_save)

最终出现这些结果：

最后在搜索得到二值图方法时，也找到了一个不错的源码，但是他是将labelme格式的json或者xml转为二值图，虽然不是将coco格式转为二值图，但是记录下也许以后也会用的到

https://github.com/samr28/labelme-to-binary-image

参考：

https://blog.csdn.net/wc781708249/article/details/79603522

https://blog.csdn.net/u013735511/article/details/79099483

coco数据集标注图转为二值图python（附代码）的更多相关文章

c语言实现灰度图转换为二值图
将上篇得到的灰度图转换为二值图,读取像素数据,低于某一值置0,否则设置为255,为得到更好的效果不同图片应采用不同的值 /* 2015年6月2日11:16:22 灰度图转换为二值图 blog:http ...
C语言实现将彩色BMP位图转化为二值图
CTF做了图片的隐写题,还没有形成系统的认识,先来总结一下BMP图的组成,并通过将彩色图转为二值图的例子加深下理解. 只写了位图二进制文件的格式和代码实现,至于诸如RGB色彩和调色板是什么的一些概念就 ...
S0.4 二值图与阈值化
目录二值图的定义二值图的应用阈值化二值化/阈值化方法 1,无脑简单判断 opencv3函数threshold()实现 2,Otsu算法(大律法或最大类间方差法) OpenCV3 纯代码实现大津 ...
用 Python 通过马尔可夫随机场（MRF）与 Ising Model 进行二值图降噪
前言这个降噪的模型来自 Christopher M. Bishop 的 Pattern Recognition And Machine Learning (就是神书 PRML……),问题是如何对一个 ...
使用OpenCV查找二值图中最大连通区域
http://blog.csdn.net/shaoxiaohu1/article/details/40272875 使用OpenCV查找二值图中最大连通区域标签: OpenCVfindCoutour ...
opencv删除二值图中较小的噪点色块
CvSeq* contour = NULL; double minarea = 100.0; double tmparea = 0.0; CFileDialog dlg(true); if (dlg. ...
zw·准专利·高保真二值图细部切分算法
zw·准专利·高保真二值图细部切分算法高保真二值图细部切分算法,是中国字体协会项目的衍生作品. 说准专利算法,是因为对于图像算法的标准不了解,虽然报过专利,但不是这方面的,需要咨询专 ...
超越OpenCV速度的MorphologyEx函数实现（特别是对于二值图，速度是CV的4倍左右）。
最近研究了一下opencv的 MorphologyEx这个函数的替代功能, 他主要的特点是支持任意形状的腐蚀膨胀,对于灰度图,速度基本和CV的一致,但是 CV没有针对二值图做特殊处理,因此,这个函数对 ...
BMP彩色转成黑色二值图
一天半把彩色bmp转成黑白了. 原理是: 第一步:读出位图数据的偏移位置:即第11个字节,用fseek即可. 然后将偏移位置之前的数据全部写入新的bmp图中. 第二步:用fseek移到位图数据这前,判 ...

随机推荐

BERT源码分析
一.整体整个代码文件如下: 二.tensorflow基础 1.tf.expand_dims 作用:给定张量“ input”,此操作将在“ input”形状的尺寸索引“ axis”处插入尺寸为1的尺寸 ...
PHP的stdClass
概述以下是百度百科对php中的 stdClass的描述: stdClass在PHP5才开始被流行.而stdClass也是zend的一个保留类.stdClass类是PHP的一个内部保留类,初始时没有成 ...
ACWING 95 费解的开关解题记录
你玩过“拉灯”游戏吗?25盏灯排成一个5x5的方形.每一个灯都有一个开关,游戏者可以改变它的状态.每一步,游戏者可以改变某一个灯的状态.游戏者改变一个灯的状态会产生连锁反应:和这个灯上下左右相邻的灯也 ...
Java Web 学习(7) —— Spring MVC 之国际化
Spring MVC 之国际化 i18n 与 l10n internationalization:国际化,以 i 开头,以 n 结尾,中间 18 个字母,简称 i18n. localization:本 ...
Python 列表生成式 & 字典生成式
Python 列表生成式 & 字典生成式通过生成式可以更加简洁地生成列表和字典列表生成式对比直接生成数据后加入列表示例: user_list = list() for i in ran ...
腾讯云服务器centos7.2+nginx（开启gzip压缩）+uwsgi+Django+react
因为项目原因,学习了react,Django,完成react开发项目过后,打包(做好了代码分割.压缩)放入Django中,在本地运行速度很快,结果放到服务器中,虽然某些js文件很小(只有一百多kb), ...
怎么在ubuntu下安装使用pycharm
1.安装jdk 先下载jdk: https://pan.baidu.com/s/1o7MqvKA 解压到本地: 方法一:直接点击右键,点“提取此文件方法二:使用命令行sudo tar -zxvf j ...
利用OD破解一个简单的C语言程序
最近在学习汇编(看的是王爽老师的<汇编语言(第三版)>),然后想尝试使用OD(Ollydbg)软件破解一个简单的C语言程序练练手. 环境: C语言编译环境:VC++6.0 系统:在Wind ...
谈谈EF Core实现数据库迁移
作为程序员,在日常开发中,记忆犹新的莫过于写代码,升级程序.升级程序包含两部分:一是,对服务程序更新:二是,对数据库结构更新.本篇博文主要介绍数据库结构更新,在对数据库升级时,不知道园友们是否有如下经 ...
ReSharper激活方法
激活方式选择License Keys. 激活码: MTW881U3Z5-eyJsaWNlbnNlSWQiOiJNVFc4ODFVM1o1IiwibGljZW5zZWVOYW1lIjoiTnNzIElt ...

coco数据集标注图转为二值图python（附代码）

coco数据集标注图转为二值图python（附代码）的更多相关文章

随机推荐

热门专题