Python之获取文件夹中文件列表以及glob与fnmatch模块的使用

获取文件夹中的文件列表

print(os.listdir("../secondPackage"))  # ['__init__.py', 'secondCookBook.py', '文件与IO.py', 'testPackage', '迭代器与生成器.py']

# 注释：　curdir = '.'  pardir = '..'

print(os.listdir(os.curdir))  # ['__init__.py', 'secondCookBook.py', '文件与IO.py', 'testPackage', '迭代器与生成器.py']

print(os.listdir(os.pardir))  # ['__init__.py', 'cookBook', 'secondPackage', 'cookBook.py']

通过某种方式过滤数据，可以考虑结合 os.path 库中的一些函数来使用列表推导。比如：

 通过isfile判断是否是文件

files=[name for name in os.listdir("../secondPackage") if os.path.isfile(os.path.join("../secondPackage",name))]

print(files)  # ['__init__.py', 'secondCookBook.py', '文件与IO.py', '迭代器与生成器.py']

# isdir判断是否是目录

dirs=[name for name in os.listdir("../secondPackage") if os.path.isdir(os.path.join("../secondPackage",name))]

print(dirs)  # ['testPackage']

# 过滤一个目录的内容 startswith() 和 endswith()

pyfiles = [name for name in os.listdir('../secondPackage')

            if name.endswith('.py')]

print(pyfiles)  # ['__init__.py', 'secondCookBook.py', '文件与IO.py', '迭代器与生成器.py']

文件名的匹配，你可能会考虑使用 glob 或 fnmatch 模块

glob模块的主要方法就是glob,该方法返回所有匹配的文件路径列表（list）；该方法需要一个参数用来指定匹配的路径字符串（字符串可以为绝对路径也可以为相对路径），其返回的文件名只包括当前目录里的文件名，不包括子文件夹里的文件。

import glob

# 在 secondPackage 文件夹下找所有的py 文件

print(glob.glob(r"../secondPackage/*.py"))  # ['../secondPackage/__init__.py', '../secondPackage/secondCookBook.py', '../secondPackage/文件与IO.py', '../secondPackage/迭代器与生成器.py']

#  iglob方法 获取一个迭代器（ iterator ）对象，使用它可以逐个获取匹配的文件路径名，与glob.glob()的区别是：glob.glob同时获取所有的匹配路径，而 glob.iglob一次只获取一个匹配路径

print([res for res in glob.iglob(r"../secondPackage/*.py")])  #　['../secondPackage/__init__.py', '../secondPackage/secondCookBook.py', '../secondPackage/文件与IO.py', '../secondPackage/迭代器与生成器.py']

glob模块支持的通配符：

通配符

功能

匹配0或多个字符

**

匹配所有文件、目录、子目录和子目录里的文件（3.5版本新增）

匹配1个字符，与正则表达式里的?不同

 [exp]

匹配指定范围内的字符，如：[1-9]匹配1至9范围内的字符

[!exp]

匹配不在指定范围内的字符

fnmatch模块,fnmatch、fnmatchcase、filter和translate

fnmatch：判断文件名是否符合特定的模式。
fnmatchcase：判断文件名是否符合特定的模式，区分大小写。
filter：返回输入列表中，符合特定模式的文件名列表。
translate：将通配符模式转换成正则表达式。

import fnmatch

print([name for name in os.listdir(os.curdir) if fnmatch.fnmatch(name,'*.py')])

# ['__init__.py', 'secondCookBook.py', '文件与IO.py', '迭代器与生成器.py']

namelist=os.listdir(os.curdir)

print(fnmatch.filter(namelist,'*.py'))  # 区别是接受的第一个参数是列表

# ['__init__.py', 'secondCookBook.py', '文件与IO.py', '迭代器与生成器.py']

fnmatch模块支持的通配符：

通配符	含义
*	匹配任何数量的字符
？	匹配单个字符
[seq]	匹配seq中的字符
[!seq]	匹配除seq以外的任何字符

glob模块和fnmatch模块区别

fnmatch模块，都是利用os.listdir获取文件列表，然后通过字符串fnmatch模块进行文件名匹配的，而glob模块比较简单，直接 实现了os.listdir 加上 fnmatch的功能

# 结合使用例子：

pyfiles = glob.glob(r"../secondPackage/*.py")

pystate=[(name,os.stat(name))for name in pyfiles]

for name,state in pystate:

    print(name,state.st_size,state.st_mtime)

# ../secondPackage/__init__.py 73 1550806762.0806901

# ../secondPackage/secondCookBook.py 73 1550806783.724303

# ../secondPackage/文件与IO.py 11685 1552458917.495922

# ../secondPackage/迭代器与生成器.py 6428 1551944052.2551782

Python之获取文件夹中文件列表以及glob与fnmatch模块的使用的更多相关文章

Python按顺序读取文件夹中文件
参考资料: https://blog.csdn.net/qq_22227123/article/details/79903116 https://blog.csdn.net/merdy_xi/arti ...
python批量处理文件夹中文件的问题
用os模块读取文件夹中文件原来的代码: import osfrom scipy.misc import imread filenames=os.listdir(r'./unprocess')for ...
php获取指定文件夹中文件名称
/** * php获取指定文件夹中文件名称 * @author jackie <2018.10.10> */ public static function getFileName($fil ...
C# 将文件夹中文件复制到另一个文件夹
p{ text-align:center; } blockquote > p > span{ text-align:center; font-size: 18px; color: #ff0 ...
Java访问文件夹中文件的递归遍历代码Demo
上代码: import java.io.File; /* * 需求:对指定目录进行所有内容的列出(包含子目录中的内容) * 也可以理解为深度遍历. */ public class FindAllFi ...
C#实现对指定文件夹中文件按修改时间排序
string path = "~/Document/Introduction/团队管理制度/"; DirectoryInfo dirinfo = new Di ...
【linux】复制文件夹中文件，排除部分文件
如下 cp `ls|grep -v -E '*json|out'|xargs` /home/data/ 用grep -v 表示排除, -E 表示正则 ls|grep -v -E '*json|out ...
python文件夹中文件读取踩坑
Q: 进行数据集图片预处理时,初始命名如下图(Fig1左),发现读取文件时,读取的结构并非如所设想的那样顺序读取 Fig 1 A: pyhton读取文件的时候,按照文件名的ascii码中的顺序进行逐位 ...
使用java读取文件夹中文件的行数
使用java统计某文件夹下所有文件的行数经理突然交代一个任务:要求统计某个文件夹下所有文件的行数.在网上查了一个多小时没有解决.后来心里不爽就决定自己写一个java类用来统计文件的行数,于是花了两个 ...

随机推荐

linux --memcached的安装与配置
转载:http://blog.sina.com.cn/s/blog_4829b9400101piil.html 1.准备安装包:libevent-2.0.21-stable.tar.gz 和memca ...
[SDOI2015]寻宝游戏（LCA，set）
[SDOI2015]寻宝游戏题目描述小B最近正在玩一个寻宝游戏,这个游戏的地图中有N个村庄和N-1条道路,并且任何两个村庄之间有且仅有一条路径可达.游戏开始时,玩家可以任意选择一个村庄,瞬间转移到 ...
css：鼠标点击出现有颜色的边框？如何解决
今天遇到上图这样出现有颜色的边框解决办法: css设置属性 outline:none;
[apache] apache配置文件中的deny和allow
allow 和Deny可以用于apache的conf文件或者.htaccess文件中(配合Directory, Location, Files等),用来控制目录和文件的访问授权. 例如: <Di ...
python的次方操作
好简单,不需要import任何包 b=a**n就是求a的n次方,如果n=0.5就是开方如果开方的是负数或者附复数,需要 import math b=math.sqrt(a) 这样
hadoop中的一些术语介绍
1．MR作业是客户端执行的一个工作单元:包括输入数据,MR的程序和配置信息． Hadoop将作业分成若干个任务task来执行,分为两种任务:map和reduce任务．这些任务运行在集群的节点上,并通过 ...
A1001
两数相加,结果每三位添加一个逗号.一开始没有注意到%03d的问题,因为有某些数据逗号分割后高位带0,因此需要用0来补充空位. #include<iostream> #include< ...
python学习笔记（十五）python操作数据库
1.连接mysql,ip,端口号,密码,账号,数据库 2.建立游标 3.执行sql 4.获取结果 5.关闭连接,关闭游标游标打开仓库的大门: import pymysql conn=pymysql. ...
php中间件是什么
php中间件(middleware)是一个闭包,而且返回一个闭包. 中间件为过滤进入应用的HTTP请求提供了一套便利的机制,可以分为前置中间件和后置中间件.常用于验证用户是否经过认证,添加响应头(跨域 ...
django正常运行确报错的解决方法
django正常运行却报错的处理方法出处 : https://www.infvie.com/ops-notes/django-normal-operation-error 报错一:self._soc ...

Python之获取文件夹中文件列表以及glob与fnmatch模块的使用

Python之获取文件夹中文件列表以及glob与fnmatch模块的使用的更多相关文章

随机推荐

热门专题