python之(re)正则表达式下

知识储备：

\w 匹配任何字母/数字，下划线

正则表达式进阶：

re.match('com', 'comwww.runcomoob')

re.search('\dcom', 'www.4comrunoob.5com')

一旦匹配成功，就返回一个match object 对象，对象拥有下列方法；

group()  返回被re 匹配的字符串

start()  返回匹配开始的位置

end()    返回匹配结束的位置(返回结果是索引加1，和分片一样，不包括组的结束位置)

span() 返回一个元组包含匹配（开始，结束）的位置

match() 只匹配起始位置

s = re.match('com', 'www.runcoomoob')

print(s)   #None

print(s.span())   #注意位置，不是0－3

Traceback (most recent call last):

  File "C:/Users/Administrator/PycharmProjects/laonanhai/day6_test/s9.py", line 15, in <module>

    print(s.span())   #注意位置，不是0－3

AttributeError: 'NoneType' object has no attribute 'span'

search() 注意前面的找到则不再往后找

s2 = re.search('com', 'www.runcomoocomb')

print(s2)

#<_sre.SRE_Match object; span=(7, 10), match='com'>  注意前面的找到则不再往后找

sub/subn 替换 re.sub(pattern, repl, string, max) max 最大替换次数

s3 = re.sub("g.t", "have", "I get A, I got B, I gut C", 2)

print(s3)    #I have A, I have B, I gut C

s4 = re.subn("g.t", "have", "I get A, I got B, I gut C")

print(s4)    #('I have A, I have B, I gut C', 2)   多了替换次数

　re.split() 分割

s5 = re.split('\d+', 'one1two2three3four4')

print(s5)   #['one', 'two', 'three', 'four', '']    注意最后是''

把那些经常使用的正则表达式编译成正则表达式对象，可以提高一定的效率！

text = 'JGood is a handsome boy, he is cool, clever, and so on...'

regex = re.compile(r'\w*oo\w*')    #regex 是对象

print(regex.findall(text))         #['JGood', 'cool']

正则分组

正则分组：去已经匹配到的数据中再匹配数据（这句话超超重要！！）
举例：

# 无分组

origin = "has fkdghggfhh"

r = re.match("h\w+", origin)

print(r.group())      # 获取匹配到的所有结果

print(r.groups())     # 获取模型中匹配到的分组结果

print(r.groupdict())  # 获取模型中匹配到的分组结果

# has

# ()

# {}

import re

m = re.search("(?P<year>[0-9]{4})", "test 2017abc")

print(m)

print(m.group())

print(m.groups())

print(m.group("year"))

输出:

<_sre.SRE_Match object; span=(5, 9), match=''>

2017

('',)

2017

search()  分组和match()一样，只是找的方式不同

# search()  分组也一样，只是找的方式不同

origin = "has fkdghggfhh"

r = re.match("h(?P<name>\w+)", origin)   #给字典添加key,注意括号！！

print(r.group())      # 获取匹配到的所有结果

print(r.groups())     # 获取模型中匹配到的分组结果

print(r.groupdict())  # 获取模型中匹配到的分组中所有执行了key的组

# has

# ('as',)

# {'name': 'as'}

下面是示例，自己看看肯定看得懂的啦

origin = "has fkdghggfhh hal"

#r = re.findall("(h\w+)", origin)    #无用分组   ['has', 'hggfhh', 'hal']

#r = re.findall("h(\w+)", origin)    #只拿分组里面的东西  ['as', 'ggfhh', 'al']

origin = "hasbbcc fkdghggbbccfhhbbcc halbbcc"

r = re.findall("h(\w+)bbc", origin)  #['as', 'ggbbcfhh', 'al']

r = re.findall("h(\w+)b(bc)c", origin)

print(r)    #[('as', 'bc'), ('ggbbccfhh', 'bc'), ('al', 'bc')]

接下来讲一个蛮重要的点

split() 与正则分组

# 无分组

origin = "hello alex bcd alex lge alex acd 19"

r = re.split("alex", origin, 1)

print(r)        #['hello ', ' bcd alex lge alex acd 19']

# 有分组

origin = "hello alex bcd alex lge alex acd 19"

r1 = re.split("(alex)", origin, 1)

print(r1)   #['hello ', 'alex', ' bcd alex lge alex acd 19']

r2 = re.split("al(ex)", origin, 1)   #重要

print(r2)   #['hello ', 'ex', ' bcd alex lge alex acd 19']

欢迎转发！
This is zcl‘s article! Thanks for your support!
文章出处：http://www.cnblogs.com/0zcl
作者：zcl

python之(re)正则表达式下的更多相关文章

python基础之正则表达式
正则表达式语法正则表达式 (或 RE) 指定一组字符串匹配它;在此模块中的功能让您检查一下,如果一个特定的字符串匹配给定的正则表达式 (或给定的正则表达式匹配特定的字符串,可归结为同一件事). 正则 ...
python之(re)正则表达式上
python正则表达式知识预备正则表达式使用反斜杠" \ "来代表特殊形式或用作转义字符,这里跟Python的语法冲突,因此,Python用" \\\\ "表 ...
Python::re 模块 -- 在Python中使用正则表达式
前言这篇文章,并不是对正则表达式的介绍,而是对Python中如何结合re模块使用正则表达式的介绍.文章的侧重点是如何使用re模块在Python语言中使用正则表达式,对于Python表达式的语法和详细 ...
python的re正则表达式模块学习
python中re模块的用法 Python 的 re 模块(Regular Expression 正则表达式)提供各种正则表达式的匹配操作,在文本解析.复杂字符串分析和信息提取时是一个非常有用的工 ...
Python基础之正则表达式指南
本文介绍了Python对于正则表达式的支持,包括正则表达式基础以及Python正则表达式标准库的完整介绍及使用示例.本文的内容不包括如何编写高效的正则表达式.如何优化正则表达式,这些主题请查看其他教程 ...
Python系列之正则表达式详解
Python 正则表达式模块 (re) 简介 Python 的 re 模块(Regular Expression 正则表达式)提供各种正则表达式的匹配操作,和 Perl 脚本的正则表达式功能类似,使用 ...
【转载】Python中的正则表达式教程
本文http://www.cnblogs.com/huxi/archive/2010/07/04/1771073.html 正则表达式经常被用到,而自己总是记不全,转载一份完整的以备不时之需. 1. ...
Python中的正则表达式教程
本文http://www.cnblogs.com/huxi/archive/2010/07/04/1771073.html 正则表达式经常被用到,而自己总是记不全,转载一份完整的以备不时之需. 1. ...
[Python]网络爬虫（七）：Python中的正则表达式教程
转自:http://blog.csdn.net/pleasecallmewhy/article/details/8929576#t4 接下来准备用糗百做一个爬虫的小例子. 但是在这之前,先详细的整理一 ...

随机推荐

Linux安装Node.js
安装环境:Ubuntu:x86_64 Node.js 官网:https://nodejs.org 下载Node.js: wget https://nodejs.org/dist/v4.4.3/node ...
【HTTP劫持和DNS劫持】实际JS对抗
1.对于DIV注入的,可以初始化时检查全部html代码. 检测是否被劫持比较简单,但对抗就略麻烦,这个在说完第2点之后再解释. 2.对于js注入,可以在window监听DOMNodeInserted事 ...
Macaca自动化测试之PC端测试
Macaca是一套完整的自动化测试解决方案.由阿里巴巴公司开源: http://macacajs.github.io/macaca/ 特点: 同时支持PC端和移动端(Android.iOS)自动化测试 ...
MySQL学习（一）MySQLWorkbench（MySQL可视化工具）下载，安装，测试连接，以及注意事项
PS:MySQLWorkbench是MYSQL自带的可视化工具,无论使用哪个可视化工具,其实大同小异,如果想以后走的更远的话,可以考虑使用命令行操作数据库MYSQL.可视化工具让我们初学者更能理解数据 ...
OpenFlow消息
☞Openflow消息总共分为三大类: 1.Controller‐to‐Switch 控制器至交换机消息此类消息由控制器主动发出  Features 用来获取交换机特性  Con ...
[Java 进阶]Java中的国际化
背景知识现代软件开发,往往做出的应用程序不止给一个国家的人去使用.不同国家的人往往存在语言文字不通的问题.由此产生了国际化(internationalization).多语言(multi-langu ...
AngularJS中的方法参数的问题
在使用AngularJS开发的过程中出现了如下的问题,一次贴记录下. 感觉也不能说是AngularJS的语法,应该说是JS里面的处理流程应该就是这样子,我现在想通过前端页面传递值到后端(通过方法传递) ...
jquer 事件，选择器，dom操作
一.jQuery简介 jQuery 是一个 JavaScript 库.(其实就是js,就是封装了,语法上有些不一样) jQuery 极大地简化了 JavaScript 编程. jQuery 库位于一个 ...
小米网css3导航下拉菜单代码
效果:http://hovertree.com/texiao/css3/19/ 代码如下: <!doctype html>  <html la ...
解决WebApi入参时多对象的问题
我们的项目是用WebApi提供数据服务,且WebPage跟APP中都有调用到. WebApi提供的接口一多,就发现一个问题,我们项目中有很多接口是接收POST(安全原因,我们采用的是https)请求的 ...