pytorch 计算图像数据集的均值和标准差

在使用 torchvision.transforms进行数据处理时我们经常进行的操作是：

transforms.Normalize((0.485,0.456,0.406), (0.229,0.224,0.225))

前面的(0.485,0.456,0.406)表示均值，分别对应的是RGB三个通道；后面的(0.229,0.224,0.225)则表示的是标准差

这上面的均值和标准差的值是ImageNet数据集计算出来的，所以很多人都使用它们

但是如果你想要计算自己的数据集的均值和标准差，让其作为你的transforms.Normalize函数的参数的话可以进行下面的操作

代码get_mean_std.py：

# coding:utf-

import os

import numpy as np

from torchvision.datasets import ImageFolder

import torchvision.transforms as transforms

from dataloader import Dataloader

from options import options

import pickle

"""

    在训练前先运行该函数获得数据的均值和标准差

"""

class Dataloader():

    def __init__(self, opt):

        # 训练，验证，测试数据集文件夹名

        self.opt = opt

        self.dirs = ['train', 'test', 'testing']

        self.means = [, , ]

        self.stdevs = [, , ]

        self.transform = transforms.Compose([transforms.Resize(opt.isize),

                                        transforms.CenterCrop(opt.isize),

                                        transforms.ToTensor(),#数据值从[0,255]范围转为[0,1]，相当于除以255操作

                                        # transforms.Normalize((0.485,0.456,0.406), (0.229,0.224,0.225))

                                        ])

        # 因为这里使用的是ImageFolder，按文件夹给数据分类，一个文件夹为一类，label会自动标注好

        self.dataset = {x: ImageFolder(os.path.join(opt.dataroot, x), self.transform) for x in self.dirs}

    def get_mean_std(self, type, mean_std_path):

        """

        计算数据集的均值和标准差

        :param type: 使用的是那个数据集的数据，有'train', 'test', 'testing'

        :param mean_std_path: 计算出来的均值和标准差存储的文件

        :return:

        """

        num_imgs = len(self.dataset[type])

        for data in self.dataset[type]:

            img = data[]

            for i in range():

                # 一个通道的均值和标准差

                self.means[i] += img[i, :, :].mean()

                self.stdevs[i] += img[i, :, :].std()

        self.means = np.asarray(self.means) / num_imgs

        self.stdevs = np.asarray(self.stdevs) / num_imgs

        print("{} : normMean = {}".format(type, self.means))

        print("{} : normstdevs = {}".format(type, self.stdevs))

        # 将得到的均值和标准差写到文件中，之后就能够从中读取

        with open(mean_std_path, 'wb') as f:

            pickle.dump(self.means, f)

            pickle.dump(self.stdevs, f)

            print('pickle done')

if __name__ == '__main__':

    opt = options().parse()

    dataloader = Dataloader(opt)

    for x in dataloader.dirs:

        mean_std_path = 'mean_std_value_' + x + '.pkl'

        dataloader.get_mean_std(x, mean_std_path)

然后再从相应的文件读取均值和标准差放到dataloader.py的transforms.Normalize函数中即可：

# coding:utf-

import os

import torch

import torchvision.transforms as transforms

from torchvision.datasets import ImageFolder

import numpy as np

import pickle

"""

    用于加载训练train、验证test和测试数据testing

"""

class Dataloader():

    def __init__(self, opt):

        # 训练，验证，测试数据集文件夹名

        self.opt = opt

        self.dirs = ['train', 'test', 'testing']

        # 均值和标准差存储的文件路径

        self.mean_std_path = {x: 'mean_std_value_' + x + '.pkl' for x in self.dirs}

        # 初始化为0

        self.means = {x: [, , ] for x in self.dirs}

        self.stdevs = {x: [, , ] for x in self.dirs}

        print(type(self.means['train']))

        print(self.means)

        print(self.stdevs)

        for x in self.dirs:

            #如果存在则说明之前有获取过均值和标准差

            if os.path.exists(self.mean_std_path[x]):

                with open(self.mean_std_path[x], 'rb') as f:

                    self.means[x] = pickle.load(f)

                    self.stdevs[x] = pickle.load(f)

                    print('pickle load done')

        print(self.means)

        print(self.stdevs)

        # 将相应的均值和标准差设置到transforms.Normalize函数中

        self.transform = {x: transforms.Compose([transforms.Resize(opt.isize),

                                        transforms.CenterCrop(opt.isize),

                                        transforms.ToTensor(),

                                        transforms.Normalize(self.means[x], self.stdevs[x]),

                                        ]) for x in self.dirs}

...

pytorch 计算图像数据集的均值和标准差的更多相关文章

计算图像数据集的RGB均值
最近在跑代码的时候,需要用到RGB三个通道上的均值,如下图所示: 写了一个程序,如下: import os import cv2 import random import numpy as np #数 ...
opencv学习之路（38）、Mat像素统计基础——均值，标准差，协方差；特征值，特征向量
本文部分内容转自 https://www.cnblogs.com/chaosimple/p/3182157.html 一.统计学概念二.为什么需要协方差三.协方差矩阵注:上述协方差矩阵还需要除以 ...
OpenCV2+入门系列（四）：计算图像的直方图，平均灰度，灰度方差
本篇懒得排版,直接在网页html编辑器编辑在图像处理时,我们常常需要求出图像的直方图.灰度平均值.灰度的方差,这里给出一个opencv2+自带程序,实现这些功能. 直方图对于直方图,使用cv::c ...
Caffe学习系列(15)：计算图片数据的均值
图片减去均值后,再进行训练和测试,会提高速度和精度.因此,一般在各种模型中都会有这个操作. 那么这个均值怎么来的呢,实际上就是计算所有训练样本的平均值,计算出来后,保存为一个均值文件,在以后的测试中, ...
计算图像相似度——《Python也可以》之一
声明:本文最初发表于赖勇浩(恋花蝶)的博客http://blog.csdn.net/lanphaday 先将两张图片转化为直方图,图像的相似度计算就转化为直方图的距离计算了,本文依照如下公式进行直方图 ...
OpenCV 学习（计算图像的直方图）
OpenCV 计算图像的直方图计算图像的直方图是图像处理领域一个非经常见的基本操作. OpenCV 中提供了 calcHist 函数来计算图像直方图.只是这个函数说实话挺难用的,研究了好久才掌握了些 ...
C语言之文件操作07——读取文件数据并计算均值方差标准差
//文件 /* =============================================================== 题目:从文本文件"high.txt" ...
动手学深度学习6-认识Fashion_MNIST图像数据集
获取数据集读取小批量样本小结本节将使用torchvision包,它是服务于pytorch深度学习框架的,主要用来构建计算机视觉模型. torchvision主要由以下几个部分构成: torchv ...
什么是pytorch（4.数据集加载和处理）(翻译)
数据集加载和处理这里主要涉及两个包:torchvision.datasets 和torch.utils.data.Dataset 和DataLoader torchvision.datasets是一 ...

随机推荐

WXS介绍
WXS(WeiXin Script)是小程序的一套脚本语言,结合 WXML,可以构建出页面的结构. 1.WXS与JS的区别 1.1 WXS 的基础类库: WXS 只提供给开发者5个基础类库,分别是 c ...
重装windows10系统的教程
1.首先从官网上下载一个win10的系统, 2.准备一个8GB的移动U盘,下载好的镜像文件烧录在这个U盘, 3.按照不同型号的机型,使用不同的按键进入BOIS模式,然后选中U盘作为启动项,读取出来这个 ...
Django之路——9 Django的form组件的信息校验
forms组件校验字段功能针对一个实例:注册用户讲解. 模型:models.py class UserInfo(models.Model): name=models.CharField(max_l ...
《少年先疯队》第九次团队作业：Beta冲刺第二天
2.1 今日完成任务情况姚玉婷:房间管理功能测试文档的编写马丽莎:酒店系统中商品管理功能的完善张琼:商品管理功能的测试孙苗坤:商品管理功能的测试 2.2 明天任务安排姚玉婷:酒店系统中 ...
Keras神经网络data generators解决数据内存
在使用kears训练model的时候,一般会将所有的训练数据加载到内存中,然后喂给网络,但当内存有限,且数据量过大时,此方法则不再可用.此博客,将介绍如何在多核(多线程)上实时的生成数据,并立即的送入 ...
国产MM才叫漂亮[景甜]
Djiango权限组件
一. login中注册权限url def login(request): if request.method == "POST": username = request.POST ...
asp.net使用WebUploader做大文件的分块和断点续传
HTML部分 <%@ Page Language="C#" AutoEventWireup="true" CodeBehind="index.a ...
洛谷P1162（自我感觉思路还算巧妙的一道题）
P1162 填涂颜色题目描述由数字0 组成的方阵中,有一任意形状闭合圈,闭合圈由数字1构成,围圈时只走上下左右4个方向.现要求把闭合圈内的所有空间都填写成2.例如:6X6的方阵(n=6),涂色前和 ...
Dart 日期时间 DateTime
1.获取当前时间 var now = new DateTime.now(); print(now); // 2019-06-20 16:59:05.560543 2.设置时间 var d =new D ...

pytorch 计算图像数据集的均值和标准差

pytorch 计算图像数据集的均值和标准差的更多相关文章

随机推荐

热门专题