在深度学习的视觉VISION领域数据预处理的魔法常数magic constant、黄金数值的复现： mean=[0.485, 0.456, 0.406],std=[0.229, 0.224, 0.225]

代码：

https://gist.github.com/pmeier/f5e05285cd5987027a98854a5d155e27

import argparse

import multiprocessing

from math import ceil

import torch

from torch.utils import data

from torchvision import datasets, transforms

class FiniteRandomSampler(data.Sampler):

    def __init__(self, data_source, num_samples):

        super().__init__(data_source)

        self.data_source = data_source

        self.num_samples = num_samples

    def __iter__(self):

        return iter(torch.randperm(len(self.data_source)).tolist()[: self.num_samples])

    def __len__(self):

        return self.num_samples

class RunningAverage:

    def __init__(self, num_channels=3, **meta):

        self.num_channels = num_channels

        self.avg = torch.zeros(num_channels, **meta)

        self.num_samples = 0

    def update(self, vals):

        batch_size, num_channels = vals.size()

        if num_channels != self.num_channels:

            raise RuntimeError

        updated_num_samples = self.num_samples + batch_size

        correction_factor = self.num_samples / updated_num_samples

        updated_avg = self.avg * correction_factor

        updated_avg += torch.sum(vals, dim=0) / updated_num_samples

        self.avg = updated_avg

        self.num_samples = updated_num_samples

    def tolist(self):

        return self.avg.detach().cpu().tolist()

    def __str__(self):

        return "[" + ", ".join([f"{val:.3f}" for val in self.tolist()]) + "]"

def make_reproducible(seed):

    torch.manual_seed(seed)

    torch.backends.cudnn.deterministic = True

    torch.backends.cudnn.benchmark = False

def main(args):

    if args.seed is not None:

        make_reproducible(args.seed)

    transform = transforms.Compose(

        [transforms.Resize(256), transforms.CenterCrop(224), transforms.ToTensor()]

    )

    dataset = datasets.ImageNet(args.root, split="train", transform=transform)

    num_samples = args.num_samples

    if num_samples is None:

        num_samples = len(dataset)

    if num_samples < len(dataset):

        sampler = FiniteRandomSampler(dataset, num_samples)

    else:

        sampler = data.SequentialSampler(dataset)

    loader = data.DataLoader(

        dataset,

        sampler=sampler,

        num_workers=args.num_workers,

        batch_size=args.batch_size,

    )

    running_mean = RunningAverage(device=args.device)

    running_std = RunningAverage(device=args.device)

    num_batches = ceil(num_samples / args.batch_size)

    with torch.no_grad():

        for batch, (images, _) in enumerate(loader, 1):

            images = images.to(args.device)

            images_flat = torch.flatten(images, 2)

            mean = torch.mean(images_flat, dim=2)

            running_mean.update(mean)

            std = torch.std(images_flat, dim=2)

            running_std.update(std)

            if not args.quiet and batch % args.print_freq == 0:

                print(

                    (

                        f"[{batch:6d}/{num_batches}] "

                        f"mean={running_mean}, std={running_std}"

                    )

                )

    print(f"mean={running_mean}, std={running_std}")

    return running_mean.tolist(), running_std.tolist()

def parse_input():

    parser = argparse.ArgumentParser(

        description="Calculation of ImageNet z-score parameters"

    )

    parser.add_argument("root", help="path to ImageNet dataset root directory")

    parser.add_argument(

        "--num-samples",

        metavar="N",

        type=int,

        default=None,

        help="Number of images used in the calculation. Defaults to the complete dataset.",

    )

    parser.add_argument(

        "--num-workers",

        metavar="N",

        type=int,

        default=None,

        help="Number of workers for the image loading. Defaults to the number of CPUs.",

    )

    parser.add_argument(

        "--batch-size",

        metavar="N",

        type=int,

        default=None,

        help="Number of images processed in parallel. Defaults to the number of workers",

    )

    parser.add_argument(

        "--device",

        metavar="DEV",

        type=str,

        default=None,

        help="Device to use for processing. Defaults to CUDA if available.",

    )

    parser.add_argument(

        "--seed",

        metavar="S",

        type=int,

        default=None,

        help="If given, runs the calculation in deterministic mode with manual seed S.",

    )

    parser.add_argument(

        "--print_freq",

        metavar="F",

        type=int,

        default=50,

        help="Frequency with which the intermediate results are printed. Defaults to 50.",

    )

    parser.add_argument(

        "--quiet",

        action="store_true",

        help="If given, only the final results is printed",

    )

    args = parser.parse_args()

    if args.num_workers is None:

        args.num_workers = multiprocessing.cpu_count()

    if args.batch_size is None:

        args.batch_size = args.num_workers

    if args.device is None:

        device = "cuda" if torch.cuda.is_available() else "cpu"

    args.device = torch.device(device)

    return args

if __name__ == "__main__":

    args = parse_input()

    main(args)

命名为文件：

imagenet_normalization.py

下载好数据集：

官方给出的运行命令及结果：

Fortunately, varying the num_samples with seed=0 (python imagenet_normalization.py $IMAGENET_ROOT --num-samples N --seed 0)

`num_samples`	`mean`	`std`
`1000`	`[0.483, 0.454, 0.401]`	`[0.226, 0.223, 0.222]`
`2000`	`[0.482, 0.451, 0.396]`	`[0.225, 0.222, 0.221]`
`5000`	`[0.484, 0.454, 0.401]`	`[0.225, 0.221, 0.221]`
`10000`	`[0.485, 0.454, 0.401]`	`[0.225, 0.221, 0.220]`
`20000`	`[0.484, 0.453, 0.400]`	`[0.224, 0.220, 0.219]`

as well as varying the seed with num_samples=1000 (python imagenet_normalization.py $IMAGENET_ROOT --num-samples 1000 --seed S)

`seed`	`mean`	`std`
`0`	`[0.483, 0.454, 0.401]`	`[0.226, 0.223, 0.222]`
`1`	`[0.485, 0.455, 0.402]`	`[0.223, 0.218, 0.217]`
`27`	`[0.479, 0.449, 0.398]`	`[0.225, 0.220, 0.219]`
`314`	`[0.480, 0.454, 0.403]`	`[0.223, 0.218, 0.217]`
`4669`	`[0.490, 0.458, 0.406]`	`[0.224, 0.219, 0.219]`

运行命令：

time python ./imagenet_normalization.py ./ --num-samples 10000 --seed 0

time python ./imagenet_normalization.py ./ --num-samples 20000 --seed 0

===============================================

在深度学习的视觉VISION领域数据预处理的魔法常数magic constant、黄金数值的复现： mean=[0.485, 0.456, 0.406],std=[0.229, 0.224, 0.225]的更多相关文章

【深度学习系列】PaddlePaddle之数据预处理
上篇文章讲了卷积神经网络的基本知识,本来这篇文章准备继续深入讲CNN的相关知识和手写CNN,但是有很多同学跟我发邮件或私信问我关于PaddlePaddle如何读取数据.做数据预处理相关的内容.网上看的 ...
深度学习变革视觉计算总结（CCF-GAIR）
孙剑博士分享的是<深度学习变革视觉计算>,分别从视觉智能.计算机摄影学和AI计算三个方面去介绍. 他首先回顾了深度学习发展历史,深度学习发展到今天并不容易,过程中遇到了两个主要障碍: 第一 ...
sklearn学习笔记（一）——数据预处理 sklearn.preprocessing
https://blog.csdn.net/zhangyang10d/article/details/53418227 数据预处理 sklearn.preprocessing 标准化 (Standar ...
深度学习与自动驾驶领域的数据集（KITTI,Oxford,Cityscape,Comma.ai,BDDV,TORCS,Udacity,GTA,CARLA,Carcraft)
http://blog.csdn.net/solomon1558/article/details/70173223 Torontocity HCI middlebury caltech 行人检测数据集 ...
【数据分析 R语言实战】学习笔记第三章数据预处理（下）
3.3缺失值处理 R中缺失值以NA表示,判断数据是否存在缺失值的函数有两个,最基本的函数是is.na()它可以应用于向量.数据框等多种对象,返回逻辑值. > attach(data) The f ...
【深度学习系列】关于PaddlePaddle的一些避“坑”技巧
最近除了工作以外,业余在参加Paddle的AI比赛,在用Paddle训练的过程中遇到了一些问题,并找到了解决方法,跟大家分享一下: PaddlePaddle的Anaconda的兼容问题之前我是在服务 ...
【深度学习系列】PaddlePaddle垃圾邮件处理实战（二）
PaddlePaddle垃圾邮件处理实战(二) 前文回顾在上篇文章中我们讲了如何用支持向量机对垃圾邮件进行分类,auc为73.3%,本篇讲继续讲如何用PaddlePaddle实现邮件分类,将深度 ...
机器学习&深度学习经典资料汇总,data.gov.uk大量公开数据
<Brief History of Machine Learning> 介绍:这是一篇介绍机器学习历史的文章,介绍很全面,从感知机.神经网络.决策树.SVM.Adaboost到随机森林.D ...
【AI in 美团】深度学习在文本领域的应用
背景近几年以深度学习技术为核心的人工智能得到广泛的关注,无论是学术界还是工业界,它们都把深度学习作为研究应用的焦点.而深度学习技术突飞猛进的发展离不开海量数据的积累.计算能力的提升和算法模型的改进. ...
搜狗大数据总监、Polarr 联合创始人关于深度学习的分享交流 | 架构师小组交流会
架构师小组交流会是由国内知名公司技术专家参与的技术交流会,每期选择一个时下最热门的技术话题进行实践经验分享.第一期:来自沪江.滴滴.蘑菇街.扇贝架构师的 Docker 实践分享第二期:来自滴滴.微博 ...

随机推荐

物理机安装Centos系统
引言在工作中,经常会在本地搭建开发环境,而使用的基本都是Linux系统,本文就教大家如何安装一套Centos Linux系统准备 1.系统选择系统:Centos 版本:7.9 2.镜像下载下载 ...
将html页面转成pdf下载保存（html2canvas + jspdf或者Print调出打印功能导出pdf）
方案1:html2canvas + jspdf (缺点:清晰度不高) 安装插件: 亲测可用 yarn add html2canvas yarn add jspdf import html2canvas ...
基于OMAPL138＋FPGA核心板——MCSDK开发入门（下）
本文测试板卡为创龙科技 SOM-TL138F 是一款基于 TI OMAP-L138(定点/浮点 DSP C674x + ARM9)+ 紫光同创 Logos/Xilinx Spartan-6 低功耗 F ...
NXP i.MX 6ULL工业开发板规格书（ ARM Cortex-A7，主频792MHz）
1 评估板简介创龙科技TLIMX6U-EVM是一款基于NXP i.MX 6ULL的ARM Cortex-A7高性能低功耗处理器设计的评估板,由核心板和评估底板组成.核心板经过专业的PCB Layou ...
SpringBoot学习备忘
在 mapper.xml 中的 like 的写法 db1.name like "%"#{name}"%" 参考mybatis mapper.xml中like的写 ...
Linux使用Tomcat常用命令
切换到tomcat主目录下 cd usr/local/tomcat # 1.启动tomcat服务 # 方式一:直接启动 bin/startup.sh # 方式二:作为服务启动(推荐) nohup bi ...
Oracle 字符串分割，并将内码转中文(简单实现)，项目实战
导读实际项目开发过程中,可能会遇到这种情况,A表中A1字段存储B表中的内码如(1,2,3),此时需要将A表中的A1字段转中文,为了方便理解,我们这里创建学生表和老师表,一个学生对应N个老师. 创建表 ...
PowerBuilder现代编程方法X11：PB程序完全跨平台方案
PB可能要支持Windows.macOS.Linux.iOS.Android与鸿蒙操作系统和X86.ARM.RISC-V与国产龙芯CPU的原生应用了! PowerBuilder现代编程方法X11:PB ...
解决方案 | pywintypes.com_error: (-2147221005, '无效的类字符串', None, None) --Python连接CAD报错真正解决思路！
1 背景 import pythoncom import win32com.client import math wincad = win32com.client.Dispatch("Aut ...
如何删除Git中缓存的用户名和密码
昨天在上传代码的时候提示输入用户名密码,结果输错了3次就没有提示框了,就一直报错(身份验证失败),没办法提交代. 在使用git的过程中,我们也会经常遇到以前保存在git的用户名密码忘记了,或者不用了. ...

在深度学习的视觉VISION领域数据预处理的魔法常数magic constant、黄金数值的复现： mean=[0.485, 0.456, 0.406],std=[0.229, 0.224, 0.225]

在深度学习的视觉VISION领域数据预处理的魔法常数magic constant、黄金数值的复现： mean=[0.485, 0.456, 0.406],std=[0.229, 0.224, 0.225]的更多相关文章

随机推荐

热门专题