os.walk|图片数据集

该函数的功能：遍历指定文件夹下的所有【路径】【文件夹】【文件名】

'''

os.walk(top[, topdown=True[, onerror=None[, followlinks=False]]])

参数：

top -- 是你所要遍历的目录的地址, 返回的是一个三元组(root,dirs,files)。

root 所指的是当前正在遍历的这个文件夹的本身的地址

dirs 是一个 list ，内容是该文件夹中所有的目录的名字(不包括子目录)

files 同样是 list , 内容是该文件夹中所有的文件(不包括子目录)

topdown --可选，为 True，则优先遍历 top 目录，否则优先遍历 top 的子目录(默认为开启)。如果 topdown 参数为 True，walk 会遍历top文件夹，与top 文件夹中每一个子目录。

onerror -- 可选，需要一个 callable 对象，当 walk 需要异常时，会调用。

followlinks -- 可选，如果为 True，则会遍历目录下的快捷方式(linux 下是软连接 symbolic link )实际所指的目录(默认关闭)，如果为 False，则优先遍历 top 的子目录。

'''

函数定义

#查看root的所有值【root代表当前遍历文件夹的路径】

for root,dirs,files in os.walk(".",topdown=True):

    print(os.getcwd())

    print(root)

'''

说明：topdown = True  从最上层开始遍历  得到当前文件夹下的所有文件夹

返回结果：

D:\python\TensorFlow\1_data_input_create\4.3    ##1.当前工作目录一直没有改变（脚本所在目录）

.                                                   ##遍历顶层文件夹【'.'代表当前工作目录【一层】】

D:\python\TensorFlow\1_data_input_create\4.3    ##1.当前工作目录一直没有改变（脚本所在目录）

.\mnist_digits_images                               ##遍历到子文件【二层】

D:\python\TensorFlow\1_data_input_create\4.3

.\mnist_digits_images\0                             ##遍历到子文件夹【三层】，【三层】有10个文件夹，一次遍历

D:\python\TensorFlow\1_data_input_create\4.3

.\mnist_digits_images\1

D:\python\TensorFlow\1_data_input_create\4.3

.\mnist_digits_images\2

D:\python\TensorFlow\1_data_input_create\4.3

.\mnist_digits_images\3

D:\python\TensorFlow\1_data_input_create\4.3

.\mnist_digits_images\4

D:\python\TensorFlow\1_data_input_create\4.3

.\mnist_digits_images\5

D:\python\TensorFlow\1_data_input_create\4.3

.\mnist_digits_images\6

D:\python\TensorFlow\1_data_input_create\4.3

.\mnist_digits_images\7

D:\python\TensorFlow\1_data_input_create\4.3

.\mnist_digits_images\8

D:\python\TensorFlow\1_data_input_create\4.3

.\mnist_digits_images\9

'''

查看所有root

for root,dirs,files in os.walk(".",topdown=True):

    print(dirs)

#

'''

['mnist_digits_images']                              ###指定目录下，只有一个文件夹【二层】

['0', '1', '2', '3', '4', '5', '6', '7', '8', '9']   ###正在遍历的文件夹有10个文件夹【三层】

[]                                                   ### 文件夹0 中没有文件夹

[]                                                   ### 文件夹1 中没有文件夹

[]

[]

[]

[]

[]

[]

[]

[]

'''

查看所有dirs

for root,dirs,files in os.walk(".",topdown=True):

    print(files)

'''

['4.3_data_input_create.py', 'os模块.py', '配套知识点.py']    ###【一层】所有文件

[]                                                                                  ###【二层】没有文件

['0.bmp', '1.bmp', '10.bmp', '100.bmp', '101.bmp', '102.bmp', '103.bmp', '104.bmp',

                              ###【三层】文件较多，只列举了文件夹0中的文件，文件夹1的文件类似

查看所有files

##文件名和路径组合成文件名【绝对路径】,路径分离出当前文件夹名

for (dirpath,dirsname,filesname) in os.walk('mnist_digits_images',topdown=True):

    for filename in filesname:

        filename_path = os.sep.join([dirpath,filename])

        print(filename_path)

        time.sleep(1)

        dir_name = dirpath.split('\\')[-1]

        print(dir_name)

        time.sleep(12)

        '''

        第一次循环

        mnist_digits_images\0\0.bmp   ##文件的绝对路径

        0                             ##当前文件名

        第二次循环

        mnist_digits_images\0\1.bmp

        0

        '''

文件绝对路径和提取遍历位置的文件名

##将字符串类型的文件名称，映射成数字类型

##去重排序:set()--无序不重复集合类型  sorted()排序，默认升序   list（）变成列表形式

lab = list(sorted(set(labelsnames)))

'''

['0', '1', '2', '3', '4', '5', '6', '7', '8', '9']

'''

##映射成数字

labdict = dict(zip(lab,list(range(len(lab)))))

'''

{'0': 0, '1': 1, '2': 2, '3': 3, '4': 4, '5': 5, '6': 6, '7': 7, '8': 8, '9': 9}

补充：

>>>a = [1,2,3]

>>> b = [4,5,6]

>>> c = [4,5,6,7,8]

>>> zipped = zip(a,b)     # 打包为元组的列表

[(1, 4), (2, 5), (3, 6)]

>>> zip(a,c)              # 元素个数与最短的列表一致

[(1, 4), (2, 5), (3, 6)]

>>> zip(*zipped)          # 与 zip 相反，*zipped 可理解为解压，返回二维矩阵式

[(1, 2, 3), (4, 5, 6)]

'''

labels = [labdict[i] for i in labelsnames]

'''

列表解析：通过遍历所有字符串类型的文件夹名称【'0','0',````['9']】,通过字典取值，获得数字类型的文件名[0,0,`````,9]

[0, 0, 0, 0, 0, 0, 0, 0, 0, 0, 0, 0, 0, 0, 0, 0, 0, ``````9]每个数字都对应一张图片

'''

将字符串类型的文件名称，映射成数字类型

a = np.array(labelsnames)

'''

将列表形式转化成数组形式

['0' '0' '0' ... '9' '9' '9']

'''

b = shuffle(np.asarray(lfilenames),np.asarray(labels))

'''

from sklearn.utils import shuffle   乱序

[array(['mnist_digits_images\\8\\292.bmp',

       'mnist_digits_images\\1\\668.bmp',

       'mnist_digits_images\\6\\121.bmp', ...,

       'mnist_digits_images\\7\\821.bmp',

       'mnist_digits_images\\6\\308.bmp',

       'mnist_digits_images\\7\\286.bmp'], dtype='<U29'), array([8, 1, 6, ..., 7, 6, 7])]

'''

转换成数组，并且乱序

os.walk|图片数据集的更多相关文章

DCGAN增强图片数据集
DCGAN增强图片数据集 1.Dependencies Python 3.6+ PyTorch 0.4.0 numpy 1.14.1, matplotlib 2.2.2, scipy 1.1.0 im ...
python os.walk()
os.walk()返回三个参数:os.walk(dirpath,dirnames,filenames) for dirpath,dirnames,filenames in os.walk(): 返回d ...
os.walk()
os.walk() 方法用于通过在目录树种游走输出在目录中的文件名,向上或者向下. walk()方法语法格式如下: os.walk(top[, topdown=True[, onerror=None[ ...
[py]os.walk爬目录&sys.argv灵活获取参数
1, 遍历目录 os.walk('/tmp') os.next() 2,sys.argv ######################################## py@lanny:~/t ...
Python 用 os.walk 遍历目录
今天第一次进行文件遍历,自己递归写的时候还调试了好久,(主要因为分隔符号的问题),后来发现了os.walk方法,就忍不住和大家分享下. 先看下代码: import os for i in os.wa ...
python os.walk()和os.path.walk()
一.os.walk() 函数声明:os.walk(top,topdown=True,onerror=None) (1)参数top表示需要遍历的顶级目录的路径. (2)参数topdown的默认值是“Tr ...
python 简单示例说明os.walk和os.path.walk的不同
import os,os.path def func(arg,dirname,names): for filespath in names: print os.path.join(dirname,fi ...
os.walk获取同级目录具有随机性
1.在不同机器上,相同内容的目录和文件,os.walk获取结果中路径的先后顺序具有随机性. 2.查看os.walk源码得知,listdir具有随机性. 3.修改该源码,对listdir结果排序后,使得 ...
python os.walk()遍历
os.walk()遍历 import os p='/bin' #设定一个路径 for i in os.walk(p): #返回一个元组 print (i) # i[0]是路径 i[1]是文件夹 i[2 ...

随机推荐

分布式系统架构常识：CAP理论。
什么是CAP理论? 2000年7月,加州大学伯克利分校的Eric Brewer教授在ACM PODC会议上提出CAP猜想.2年后麻省理工学院的Seth Gilbert和NancyLynch从理论上证明 ...
ajax跨域请求，状态码200，F12控制台报错
在接口的地方加上请求头.//跨域请求header('Access-Control-Allow-Origin:*'); 不要在ajax里面加!!!!!!!!!
SqlServer 查询所有字段要写说明
查询出所有未写说明的字段: SELECT IC.table_name TableName, ColName=C.name, PFD.[value] FROM sys.columns C INNER J ...
Python3学习笔记——类
#!/usr/bin/env python #-*- coding:utf-8 -*- #面向对象(类+对象) 三大特性:封装.继承.多态类的成员: 字段: 普通字段:保存在对象(实例)中,执行只能 ...
Vue中组件间传值常用的几种方式
版本说明: vue-cli:3.0 一.父子组件间传值 1.props/$emit -父组件==>>子组件: 子组件中通过定义props接收父组件中通过v-bind绑定的数据父组件代码 ...
C# Aspose.Words 数据写入到word，模板样式复杂（转换指定内容并返回多张图片）
public ResultResponse<string[]> PrintStudyRecords([FromBody]StudyInfo info) { ResultResponse&l ...
go语言从例子开始之Example3.变量
在 Go 中,变量被显式声明,并被编译器所用来检查函数调用时的类型正确性 package main import "fmt" func main() { var 声明 1 个或者 ...
判断Xen虚拟机随想
kvm xen虚拟化技术剑桥大学开发,vmware visualbox windows下检测是否安装,注册表读取安装路径 linux下检测是否安装 rpm -qa 列出判断软件包是否安装,rpm ...
centos系统jdk安装
下载Oracle官网的jdk来安装不使用openjdk 最新的官网地址: https://www.oracle.com/technetwork/java/javase/downloads/jdk8- ...
通过cmd命令启动appium server，appium server安装过程
电脑上已安装了appium desktop版,想在移动端自动化的过程中,通过脚本启动appium server,环境准备: 1.确保电脑安装了node.js,目前用的是node12 2.安装JDK,且 ...

os.walk|图片数据集

os.walk|图片数据集的更多相关文章

随机推荐

热门专题