python（re 模块）

1.re.match()

尝试从字符串的起始位置匹配一个模式，如果不是起始位置匹配成功的话，match()就返回none。
- group()　　以str形式返回对象中match的元素
- start()　　返回开始位置
- end()　　返回结束位置
- span()　　以tuple形式返回范围

import re

print(re.match('www', 'www.duoceshi.com').span())  # 在起始位置匹配

print(re.match('www', 'www.duoceshi.com').start())  # 在起始位置匹配

print(re.match('www', 'www.duoceshi.com').end())  # 在起始位置匹配

print(re.match('www', 'www.duoceshi.com').group())  # 在起始位置匹配

print(re.match('duo', 'www.duoceshi.com'))  # 不在在起始位置匹配

print(re.match('com', 'www.duoceshi.com'))  # 不在在起始位置匹配

#结果如下

(0, 3)

0

3

www

None

None

2.re.search()

扫描整个字符串并返回第一个成功的匹配

import re

print(re.search('www', 'www.duoceshi.com').span())  # 在起始位置匹配

print(re.search('com', 'www.duoceshi.com').span())  # 不在起始位置匹配

#结果如下

(0, 3)

(13, 16)

3.re.findall()

在字符串中找到正则表达式所匹配的所有子串，并返回一个列表，如果没有找到匹配的，则返回空列表。

import re

print(re.findall("\d","asd123adasd"))   #查找匹配的数字

#结果如下

['', '', '']

4.re.finditer()

和 findall 类似，在字符串中找到正则表达式所匹配的所有子串，并把它们作为一个迭代器返回。

import re

for i in re.finditer("\d","asd123adasd"):   #查找匹配的数字

    print(i.group())

#结果如下

1

2

3

5.re.split()

split 方法按照能够匹配的子串将字符串分割后返回列表

import re

print(re.split("a","asd123adasd")) 

#结果如下

['', 'sd123', 'd', 'sd']

模式	描述
^	匹配字符串的开头
	import re print(re.findall("^t","python")) print(re.findall("^p","python")) #结果如下 [] ['p']
$	匹配字符串的末尾。
	import re print(re.findall("t$","python")) print(re.findall(".n$","python")) #结果如下 [] ['on']
.	匹配任意字符，除了换行符，当re.DOTALL标记被指定时，则可以匹配包括换行符的任意字符。
	import re print(re.findall(".","python")) print(re.findall("t.","python")) #匹配t + 后面的任意字符 #结果如下 ['p', 'y', 't', 'h', 'o', 'n'] ['th']
[...]	用来表示一组字符,单独列出：[amk] 匹配 'a'，'m'或'k'
	import re print(re.findall("a.","asd123adasd")) print(re.findall("a..","asd123adasd")) print(re.findall("a...","asd123adasd")) print(re.findall("[^a]","asd123adasd")) #结果如下 ['as', 'ad', 'as'] ['asd', 'ada'] ['asd1', 'adas'] ['s', 'd', '', '', '', 'd', 's', 'd']
[^...]	不在[]中的字符：[^abc] 匹配除了a,b,c之外的字符。
	import re print(re.findall("[^th]","python")) #匹配除 th 以外的所有字符 #结果如下 ['p', 'y', 'o', 'n']
re*	匹配0个或多个的表达式。
re+	匹配1个或多个的表达式。
re?	匹配0个或1个由前面的正则表达式定义的片段，非贪婪方式
re{ n}	精确匹配 n 个前面表达式。例如， o{2} 不能匹配 "Bob" 中的 "o"，但是能匹配 "food" 中的两个 o。
re{ n,}	匹配 n 个前面表达式。例如， o{2,} 不能匹配"Bob"中的"o"，但能匹配 "foooood"中的所有 o。"o{1,}" 等价于 "o+"。"o{0,}" 则等价于 "o*"。
re{ n, m}	匹配 n 到 m 次由前面的正则表达式定义的片段，贪婪方式
a\| b	匹配a或b
	import re print(re.findall("y\|a","python")) #匹配 y 或 a #结果如下 ['y']
(re)	对正则表达式分组并记住匹配的文本
(?imx)	正则表达式包含三种可选标志：i, m, 或 x 。只影响括号中的区域。
(?-imx)	正则表达式关闭 i, m, 或 x 可选标志。只影响括号中的区域。
(?: re)	类似 (...), 但是不表示一个组
(?imx: re)	在括号中使用i, m, 或 x 可选标志
(?-imx: re)	在括号中不使用i, m, 或 x 可选标志
(?#...)	注释.
(?= re)	前向肯定界定符。如果所含正则表达式，以 ... 表示，在当前位置成功匹配时成功，否则失败。但一旦所含表达式已经尝试，匹配引擎根本没有提高；模式的剩余部分还要尝试界定符的右边。
(?! re)	前向否定界定符。与肯定界定符相反；当所含表达式不能在字符串当前位置匹配时成功
(?> re)	匹配的独立模式，省去回溯。
\w	匹配字母数字及下划线
\W	匹配非字母数字及下划线
\s	匹配任意空白字符，等价于 [\t\n\r\f].
\S	匹配任意非空字符
\d	匹配任意数字，等价于 [0-9].
\D	匹配任意非数字
\A	匹配字符串开始
\Z	匹配字符串结束，如果是存在换行，只匹配到换行前的结束字符串。
\z	匹配字符串结束
\G	匹配最后匹配完成的位置。
\b	匹配一个单词边界，也就是指单词和空格间的位置。例如， 'er\b' 可以匹配"never" 中的 'er'，但不能匹配 "verb" 中的 'er'。
\B	匹配非单词边界。'er\B' 能匹配 "verb" 中的 'er'，但不能匹配 "never" 中的 'er'。
\n, \t, 等.	匹配一个换行符。匹配一个制表符。等
\1...\9	匹配第n个分组的内容。
\10	匹配第n个分组的内容，如果它经匹配。否则指的是八进制字符码的表达式。

参考：https://www.cnblogs.com/shenjianping/p/11647473.html

python（re 模块）的更多相关文章

Python标准模块--threading
1 模块简介 threading模块在Python1.5.2中首次引入,是低级thread模块的一个增强版.threading模块让线程使用起来更加容易,允许程序同一时间运行多个操作. 不过请注意,P ...
Python的模块引用和查找路径
模块间相互独立相互引用是任何一种编程语言的基础能力.对于“模块”这个词在各种编程语言中或许是不同的,但我们可以简单认为一个程序文件是一个模块,文件里包含了类或者方法的定义.对于编译型的语言,比如C#中 ...
Python Logging模块的简单使用
前言日志是非常重要的,最近有接触到这个,所以系统的看一下Python这个模块的用法.本文即为Logging模块的用法简介,主要参考文章为Python官方文档,链接见参考列表. 另外,Python的H ...
Python标准模块--logging
1 logging模块简介 logging模块是Python内置的标准模块,主要用于输出运行日志,可以设置输出日志的等级.日志保存路径.日志文件回滚等:相比print,具备如下优点: 可以通过设置不同 ...
python基础-模块
一.模块介绍 ...
python 安装模块
python安装模块的方法很多,在此仅介绍一种,不需要安装其他附带的pip等,python安装完之后,配置环境变量,我由于中英文分号原因,环境变量始终没能配置成功汗. 1:下载模块的压缩文件解压到任意 ...
python Queue模块
先看一个很简单的例子 #coding:utf8 import Queue #queue是队列的意思 q=Queue.Queue(maxsize=10) #创建一个queue对象 for i in ra ...
python logging模块可能会令人困惑的地方
python logging模块主要是python提供的通用日志系统,使用的方法其实挺简单的,这块就不多介绍.下面主要会讲到在使用python logging模块的时候,涉及到多个python文件的调 ...
Python引用模块和查找模块路径
模块间相互独立相互引用是任何一种编程语言的基础能力.对于"模块"这个词在各种编程语言中或许是不同的,但我们可以简单认为一个程序文件是一个模块,文件里包含了类或者方法的定义.对于编译 ...
Python Paramiko模块与MySQL数据库操作
Paramiko模块批量管理:通过调用ssh协议进行远程机器的批量命令执行. 要使用paramiko模块那就必须先安装这个第三方模块,仅需要在本地上安装相应的软件(python以及PyCrypto), ...

随机推荐

MySQL入门，第二部分，必备基础知识点
一.数据类型日期和时间数据类型 date 字节日期,格式:2014-09-18 日期和时间数据类型 time 字节时间,格式:08:42:30 日期和时间数据类型 datetime 字节日期时 ...
Github star 1.7k 的项目源码解析
先拜读源码,最后总结,以及其他实现思路.如有错误,欢迎指正! 项目介绍名称:Darkmode.js 功能:给你的网站添加暗色模式项目链接:https://github.com/sandoche/D ...
001-iOS开发前奏-C语言笔记
001-iOS开发前奏-C语言笔记学习目标 1.[了解]操作系统 2.[了解]应用软件 3.[了解]操作系统的分类和市场占有份额 4.[了解]iOS操作系统 5.[了解]应用软件开发的分类 6.[了 ...
D3.js 力导向图的拖拽（drag）与缩放（zoom）
不知道大家会不会跟我一样遇到这样的问题,在之前做的力导向图的基础上加上缩放功能的时候,拖动节点时整体会平移不再是之前酷炫的效果(失去了拉扯的感觉!).天啊,简直不能接受如此丑X的效果.经过不懈的努力终 ...
在学习java之余，js的使用精髓-闭包和原型链
这里分享下廖雪峰官网写的js教程,内容写的比较实用,易懂,其中简介的原型链和闭包的知识,小伙伴们一起上呀,畅游在知识的海洋中: 地址:https://www.liaoxuefeng.com/wiki/ ...
Sprint 5 summary: UI 界面更新，Azure端部署和用户反馈分析 12/28/2015
本次sprint主要完成的任务有对手机APP的UI界面的更新,同时对Azure客户端的部署进行了相应的学习和有关的程序设计.同时对于ALPHA release的用户反馈做出相应的分析以确定接下来工作的 ...
网站假死重启NGINX无效必须重启PHP 原因分析
一.错误提示说明: Nginx 502 Bad Gateway:请求的PHP-CGI已经执行,但是由于某种原因(一般是读取资源的问题)没有执行完毕而导致PHP-CGI进程终止. Nginx 504 G ...
[转]ThinkCMF框架任意内容包含漏洞分析复现
0x00 简介 ThinkCMF是一款基于PHP+MYSQL开发的中文内容管理框架,底层采用ThinkPHP3.2.3构建.ThinkCMF提出灵活的应用机制,框架自身提供基础的管理功能,而开发者可以 ...
python列表简介
什么是列表?如何使用列表?https://docs.python.org/3/library/stdtypes.html#sequence-types-list-tuple-range 列表相关知识: ...
Python pandas库159个常用方法使用说明
Pandas库专为数据分析而设计,它是使Python成为强大而高效的数据分析环境的重要因素. 一.Pandas数据结构 1.import pandas as pd import numpy as np ...

python（re 模块）

python（re 模块）的更多相关文章

随机推荐

热门专题