笔记-python-lib-re
笔记-python-lib-re
1. re模块简介
re模块提供了与perl类似的正则匹配功能。
要搜索的模式和字符串都可以是Unicode字符串(str)以及8位字符串(bytes)。但是,不能混合Unicode字符串和8位字符串:也就是说,不能将Unicode字符串与字节模式匹配,反之亦然。
反斜杠:正则表达式使用了\表示转义,如果要匹配一个反斜杠,需要写成\\\\作为模式字符串。
另一种办法是声明字符串中的\不会以特殊方式处理,在字符串前加r,r’\n’是两个字符,而不是换行;
2. 模块内容
2.1. compile
re.compile(pattern, flags=0)
compile 函数用于编译正则表达式,生成一个正则表达式( Pattern )对象,供 match() 和 search() 这两个函数使用。
参数:
pattern:一个字符串形式的正则表达式
flags:可选,表示匹配模式,比如忽略大小写,多行模式等,具体参数为:
re.I 忽略大小写
re.L 表示特殊字符集 \w, \W, \b, \B, \s, \S 依赖于当前环境
re.M 多行模式,影响^和$
re.S 意为' . '包括换行符在内的任意字符(一般' . '不包括换行符)
re.U 表示特殊字符集 \w, \W, \b, \B, \d, \D, \s, \S 依赖于 Unicode 字符属性数据库
re.X 为了增加可读性,忽略空格和' # '后面的注释
example:
pattern = re.compile(r’\d+?’)
2.2. match
re.match(pattern, string, flags=0)
判断RE是否在字符串刚开始的位置匹配,返回match object。
注意:只要字符串开始部分满足匹配即成功,如果想要整串匹配可加$符。
example:
s = re.match('[a-z]+', str1)
2.3. search
re.search(pattern, string, flags=0)
在字符串内查找模式匹配,只要找到第一个匹配然后返回一个match object对象,如果没有则返回None。
<_sre.SRE_Match object; span=(0, 5), match='eoorg'>
2.4. split
split(pattern, string, maxsplit=0, flags=0)
以模式匹配的字符串的为界拆分字符串;
如果使用(),则模式组也包含在结果中;
str1 = 'eoorg943443g382\jgdo 349po\oer g34 345364 sfwe fwegre ewfwe fwef'
s = re.split(r'\d+', str1, 4)
['eoorg', 'g', '\\jgdo ', 'po\\oer g', ' 345364 sfwe fwegre ewfwe fwef']
s = re.split(r'(\d+)', str1, 4)
['eoorg', '943443', 'g', '382', '\\jgdo ', '349', 'po\\oer g', '34', ' 345364 sfwe fwegre ewfwe fwef']
maxsplit指定最大拆分次数,达到次数后,剩余字符串作为列表元素添加到列表尾部。
2.5. findall
findall(pattern, string, flags=0)
遍历匹配,获取字符串中所有匹配的字符串,返回一个列表;如果模式有多个组,返回元组列表。
2.6. sub
sub(pattern, repl, string, count=0, flags=0)
替换匹配的子串,返回替换后的字符串。
str1 = 'JGOOD is a handome boy, he is cool, clever, and so on...'
s = re.sub('\s+', '-', str1)
print(s)
参数count指替换个数,默认为0,表示每个匹配项都替换。
2.7. subn
subn(pattern, repl, string, count=0, flags=0)
与sub所做操作一样,但返回一个元组,(new_string, number_of_sub_made)。
2.8. match objects
上面讲过search,match会返回一个match object
str1 = 'JGOOD is a handome boy, he is cool, clever, and so on...'
s = re.search('[a-z]+', str1)
print(s)
<_sre.SRE_Match object; span=(6, 8), match='is'>
match objects支持以下方法和属性:
match.group([group1]) 可以不带参数,表示所有匹配项;带参数则表示参数所对应的项;
str1 = 'JGOOD is a handome boy, he is cool, clever, and so on...'
pattern = re.compile(r'\s+')
s = re.match('(\w+)\s(\w+)', str1)
print(s)
<_sre.SRE_Match object; span=(0, 8), match='JGOOD is'>
>>> s.group()
'JGOOD is'
>>> s.group(1)
'JGOOD'
>>> s.group(2)
'is'
>>>
match.groups() 返回一个tuple,包含所有子组
match.start()
match.end() 返回匹配结果开始结束字符的下标
match.span() 与上文同义,返回匹配结果开始结束下标,格式是元组;
match.re 以re.compile('(\\w+)\\s(\\w+)')格式返回该对象使用的正则表达式
笔记-python-lib-re的更多相关文章
- 笔记-python -asynio
笔记-python -asynio 1. 简介 asyncio是做什么的? asyncio is a library to write concurrent code using the a ...
- 笔记-python操作mysql
笔记-python操作mysql 1. 开始 1.1. 环境准备-mysql create database db_python; use db_python; create tabl ...
- 笔记-python异常信息输出
笔记-python异常信息输出 1. 异常信息输出 python异常捕获使用try-except-else-finally语句: 在except 语句中可以使用except as e,然后通 ...
- 笔记-python lib-pymongo
笔记-python lib-pymongo 1. 开始 pymongo是python版的连接库,最新版为3.7.2. 文档地址:https://pypi.org/project/pymong ...
- 笔记-python tutorial-9.classes
笔记-python tutorial-9.classes 1. Classes 1.1. scopes and namespaces namespace: A namespace is ...
- MongoDB学习笔记:Python 操作MongoDB
MongoDB学习笔记:Python 操作MongoDB Pymongo 安装 安装pymongopip install pymongoPyMongo是驱动程序,使python程序能够使用Mong ...
- 机器学习实战笔记(Python实现)-08-线性回归
--------------------------------------------------------------------------------------- 本系列文章为<机器 ...
- 机器学习实战笔记(Python实现)-05-支持向量机(SVM)
--------------------------------------------------------------------------------------- 本系列文章为<机器 ...
- 机器学习实战笔记(Python实现)-04-Logistic回归
--------------------------------------------------------------------------------------- 本系列文章为<机器 ...
- 机器学习实战笔记(Python实现)-03-朴素贝叶斯
--------------------------------------------------------------------------------------- 本系列文章为<机器 ...
随机推荐
- Json数组对象和对象数组
Json的简单介绍 从结构上看,所有的数据最终都可以分成三种类型: 第一种类型是scalar(标量),也就是一个单独的string(字符串)或数字(numbers),比如“北京”这个单独的词. 第二种 ...
- iOS开发ReactiveCocoa学习笔记(五)
ReactiveCocoa常见操作方法介绍: demo地址:https://github.com/SummerHH/ReactiveCocoa.git filter ignore ignoreValu ...
- 关于wav文件fft处理后x,y轴坐标数据的问题
1.关于横坐标的频率的最大值是采样频率,那么每个点对应的频率值就很好算了:f(n) = [Fs/(N/2)]*n (Fs是采样频率,常见的是44.1KHz(44100),N是采样点数,k表是第k个点 ...
- Centos6.8 Mysql5.6 安装配置教程
MySQL是一个关系型数据库管理系统,由瑞典MySQL AB 公司开发,目前属于 Oracle 旗下产品.MySQL 最流行的关系型数据库管理系统,在 WEB 应用方面MySQL是最好的 RDBMS ...
- 超链接显示网站 A,访问后进入网站 B
#前端黑魔法# 出一个思考题:如何用最少的字符实现下图效果.即超链接显示网站 A,访问后进入网站 B. 当然这个是上古时代的黑魔法了,稍懂前端的都知道原理.所以这里只问最短的实现~ 一个简单的演示:( ...
- 【extjs6学习笔记】0.3 准备: 类库结构2
- MYSQL 4种插入数据的方式比较
4种插入数据的方式 第一种:insert into insert into是最常用的插入数据的方式,可以单条插入,也可以多条,还可以指定从其他表中select然后插入. 详细可以参考:insert语法 ...
- vue-绑定style、css
class.style的绑定1.在 v-bind 用于 class 和 style 时, Vue.js 专门增强了它.表达式的结果类型除了字符串之外,还可以是对象或数组2.绑定css2.1对象绑定2. ...
- jquery UI_tabs
1.tab使用 <!doctype html> <html lang="en"> <head> <meta charset="u ...
- Liunx开发(Extjs4.1+desktop+SSH2超强视频教程实践)(2)
然后装eclipse: 为啥默认是搜狗导航: java还没装呢: http://www.oracle.com/technetwork/java/javase/downloads/jdk8-downlo ...