0x01:

部分参考:https://www.cnblogs.com/edwardsun/p/4421773.html

  • match(string[, pos[, endpos]]) | re.match(pattern, string[, flags]):       这个方法将从string的pos下标处起尝试匹配pattern;如果pattern结束时仍可匹配,则返回一个Match对象;如果匹配过程中pattern无法匹配,或者匹配未结束就已到达endpos,则返回None。     pos和endpos的默认值分别为0和len(string);re.match()无法指定这两个参数,参数flags用于编译pattern时指定匹配模式。     注意:这个方法并不是完全匹配。当pattern结束时若string还有剩余字符,仍然视为成功。想要完全匹配,可以在表达式末尾加上边界匹配符'$'。     示例参见2.1小节。
  • search(string[, pos[, endpos]]) | re.search(pattern, string[, flags]):       这个方法用于查找字符串中可以匹配成功的子串。从string的pos下标处起尝试匹配pattern,如果pattern结束时仍可匹配,则返回一个Match对象;若无法匹配,则将pos加1后重新尝试匹配;直到pos=endpos时仍无法匹配则返回None。     pos和endpos的默认值分别为0和len(string));re.search()无法指定这两个参数,参数flags用于编译pattern时指定匹配模式。    
    1
    2
    3
    4
    5
    6
    7
    8
    9
    10
    11
    12
    13
    14
    15
    16
    # encoding: UTF-8
    import re
     
    # 将正则表达式编译成Pattern对象
    pattern = re.compile(r'world')
     
    # 使用search()查找匹配的子串,不存在能匹配的子串时将返回None
    # 这个例子中使用match()无法成功匹配
    match = pattern.search('hello world!')
     
    if match:
        # 使用Match获得分组信息
        print match.group()
     
    ### 输出 ###
    # world
  • split(string[, maxsplit]) | re.split(pattern, string[, maxsplit]):       按照能够匹配的子串将string分割后返回列表。maxsplit用于指定最大分割次数,不指定将全部分割。    
    1
    2
    3
    4
    5
    6
    7
    import re
     
    p = re.compile(r'\d+')
    print p.split('one1two2three3four4')
     
    ### output ###
    # ['one', 'two', 'three', 'four', '']
  • findall(string[, pos[, endpos]]) | re.findall(pattern, string[, flags]):       搜索string,以列表形式返回全部能匹配的子串。    
    1
    2
    3
    4
    5
    6
    7
    import re
     
    p = re.compile(r'\d+')
    print p.findall('one1two2three3four4')
     
    ### output ###
    # ['1', '2', '3', '4']
  • finditer(string[, pos[, endpos]]) | re.finditer(pattern, string[, flags]):       搜索string,返回一个顺序访问每一个匹配结果(Match对象)的迭代器。    
    1
    2
    3
    4
    5
    6
    7
    8
    import re
     
    p = re.compile(r'\d+')
    for m in p.finditer('one1two2three3four4'):
        print m.group(),
     
    ### output ###
    # 1 2 3 4
  • sub(repl, string[, count]) | re.sub(pattern, repl, string[, count]):       使用repl替换string中每一个匹配的子串后返回替换后的字符串。     当repl是一个字符串时,可以使用\id或\g<id>、\g<name>引用分组,但不能使用编号0。     当repl是一个方法时,这个方法应当只接受一个参数(Match对象),并返回一个字符串用于替换(返回的字符串中不能再引用分组)。     count用于指定最多替换次数,不指定时全部替换。    
    1
    2
    3
    4
    5
    6
    7
    8
    9
    10
    11
    12
    13
    14
    15
    import re
     
    p = re.compile(r'(\w+) (\w+)')
    s = 'i say, hello world!'
     
    print p.sub(r'\2 \1', s)
     
    def func(m):
        return m.group(1).title() + ' ' + m.group(2).title()
     
    print p.sub(func, s)
     
    ### output ###
    # say i, world hello!
    # I Say, Hello World!
  • subn(repl, string[, count]) |re.sub(pattern, repl, string[, count]):       返回 (sub(repl, string[, count]), 替换次数)。    
    1
    2
    3
    4
    5
    6
    7
    8
    9
    10
    11
    12
    13
    14
    15
    import re
     
    p = re.compile(r'(\w+) (\w+)')
    s = 'i say, hello world!'
     
    print p.subn(r'\2 \1', s)
     
    def func(m):
        return m.group(1).title() + ' ' + m.group(2).title()
     
    print p.subn(func, s)
     
    ### output ###
    # ('say i, world hello!', 2)
    # ('I Say, Hello World!', 2)

0x02:自己的案例

需要对前端传来的

str数据切分成list

然后传给数据库

原数据:

{"value":"123","isEditing":false,"isActive":false,"isChecked":false},{"value":"2","isEditing":false,"isActive":false,"isChecked":false},{"value":"32","isEditing":false,"isActive":false,"isChecked":false},{"value":"12","isEditing":false,"isActive":false,"isChecked":false},{"value":"12","isEditing":false,"isActive":false,"isChecked":false},{"value":"123","isEditing":false,"isActive":false,"isChecked":false},{"value":"32","isEditing":false,"isActive":false,"isChecked":false},{"value":"23","isEditing":false,"isActive":false,"isChecked":false},{"value":"12","isEditing":false,"isActive":false,"isChecked":false},{"value":"321","isEditing":false,"isActive":false,"isChecked":false},{"value":"21","isEditing":false,"isActive":false,"isChecked":false}]

过滤:

str = text
def checkFilter(keywords,text):
return re.sub('|'.join(keywords),'',str)
keywords = ('\'','"','\[{','\}]','\{')
a = checkFilter(keywords,text)
print (checkFilter(keywords,text))

输出结果:

<class 'str'>
******************
value:123,isEditing:false,isActive:false,isChecked:false},value:2,isEditing:false,isActive:false,isChecked:false},value:32,isEditing:false,isActive:false,isChecked:false},value:12,isEditing:false,isActive:false,isChecked:false},value:12,isEditing:false,isActive:false,isChecked:false},value:123,isEditing:false,isActive:false,isChecked:false},value:32,isEditing:false,isActive:false,isChecked:false},value:23,isEditing:false,isActive:false,isChecked:false},value:12,isEditing:false,isActive:false,isChecked:false},value:321,isEditing:false,isActive:false,isChecked:false},value:21,isEditing:false,isActive:false,isChecked:false

拆分:

b = a.split('},')
print(b)

输出结果:

******************
['value:123,isEditing:false,isActive:false,isChecked:false', 'value:2,isEditing:false,isActive:false,isChecked:false', 'value:32,isEditing:false,isActive:false,isChecked:false', 'value:12,isEditing:false,isActive:false,isChecked:false', 'value:12,isEditing:false,isActive:false,isChecked:false', 'value:123,isEditing:false,isActive:false,isChecked:false', 'value:32,isEditing:false,isActive:false,isChecked:false', 'value:23,isEditing:false,isActive:false,isChecked:false', 'value:12,isEditing:false,isActive:false,isChecked:false', 'value:321,isEditing:false,isActive:false,isChecked:false', 'value:21,isEditing:false,isActive:false,isChecked:false']
******************

源码:

import re
input = open('I:\\python_test\\json_mysql\\jsondata.txt','r')
text=input.read()
print (text)
print ('******************')
print (type(text))
print ('******************')
str = text
def checkFilter(keywords,text):
return re.sub('|'.join(keywords),'',str)
keywords = ('\'','"','\[{','\}]','\{')
a = checkFilter(keywords,text)
print (checkFilter(keywords,text))
print ('******************') b = a.split('},')
print(b)
print ('******************')
print (type(b))
print ('******************')
print (b[0])
print ('******************')
str1 = b[0]
b1 = str1.split(':') print (b1[0])

输出:

[{"value":"","isEditing":false,"isActive":false,"isChecked":false},{"value":"","isEditing":false,"isActive":false,"isChecked":false},{"value":"","isEditing":false,"isActive":false,"isChecked":false},{"value":"","isEditing":false,"isActive":false,"isChecked":false},{"value":"","isEditing":false,"isActive":false,"isChecked":false},{"value":"","isEditing":false,"isActive":false,"isChecked":false},{"value":"","isEditing":false,"isActive":false,"isChecked":false},{"value":"","isEditing":false,"isActive":false,"isChecked":false},{"value":"","isEditing":false,"isActive":false,"isChecked":false},{"value":"","isEditing":false,"isActive":false,"isChecked":false},{"value":"","isEditing":false,"isActive":false,"isChecked":false}]
******************
<class 'str'>
******************
value:123,isEditing:false,isActive:false,isChecked:false},value:2,isEditing:false,isActive:false,isChecked:false},value:32,isEditing:false,isActive:false,isChecked:false},value:12,isEditing:false,isActive:false,isChecked:false},value:12,isEditing:false,isActive:false,isChecked:false},value:123,isEditing:false,isActive:false,isChecked:false},value:32,isEditing:false,isActive:false,isChecked:false},value:23,isEditing:false,isActive:false,isChecked:false},value:12,isEditing:false,isActive:false,isChecked:false},value:321,isEditing:false,isActive:false,isChecked:false},value:21,isEditing:false,isActive:false,isChecked:false
******************
['value:123,isEditing:false,isActive:false,isChecked:false', 'value:2,isEditing:false,isActive:false,isChecked:false', 'value:32,isEditing:false,isActive:false,isChecked:false', 'value:12,isEditing:false,isActive:false,isChecked:false', 'value:12,isEditing:false,isActive:false,isChecked:false', 'value:123,isEditing:false,isActive:false,isChecked:false', 'value:32,isEditing:false,isActive:false,isChecked:false', 'value:23,isEditing:false,isActive:false,isChecked:false', 'value:12,isEditing:false,isActive:false,isChecked:false', 'value:321,isEditing:false,isActive:false,isChecked:false', 'value:21,isEditing:false,isActive:false,isChecked:false']
******************
<class 'list'>
******************
value:123,isEditing:false,isActive:false,isChecked:false
******************
value

2910.1.14-------------------------------------------------------------------------------------------------------

拼接dict类型 json

----------------------------------------------------------------------------------------------------------------

b = a.split('},')
print(b)
print ('******************')
print (type(b))
print ('******************')
print (b[0])
print (type(b[0]))
print ('******************')
lines_json = b[0].replace(',', '","')#替换字符;;;;;具体b[i] for输出到数据库
lines_json1 = lines_json.replace(':','":"')
lines_json2 = ('{"'+lines_json1+'"}')
print (lines_json2)
print ('******************')
j = json.loads(lines_json2)
print (j)
print (j["value"])
print(type(j))  

输出:

******************
<class 'list'>
******************
value:123,isEditing:false,isActive:false,isChecked:false
<class 'str'>
******************
{"value":"","isEditing":"false","isActive":"false","isChecked":"false"}
******************
{'isActive': 'false', 'value': '', 'isEditing': 'false', 'isChecked': 'false'}
123
<class 'dict'>

-------

【python】re库 正则的一些过滤和把str拆分成list案例 以及json dict类型的更多相关文章

  1. 【归纳】正则表达式及Python中的正则库

    正则表达式 正则表达式30分钟入门教程 runoob正则式教程 正则表达式练习题集(附答案) 元字符\b代表单词的分界处,在英文中指空格,标点符号或换行 例子:\bhi\b可以用来匹配hi这个单词,且 ...

  2. python第六天 函数 python标准库实例大全

    今天学习第一模块的最后一课课程--函数: python的第一个函数: 1 def func1(): 2 print('第一个函数') 3 return 0 4 func1() 1 同时返回多种类型时, ...

  3. Python标准库 re

    正则表达式 regular expression 用来匹配一系列符合句法规则的字符串,是一门独立的小型的语言,如果你了解类Unix系统,那么你对正则表达式就一定不陌生.正则表达式的概念最初是由Unix ...

  4. python+paramiko库+svn写的自动化部署脚本

    第一篇博文 直接开门见山的说了. 这是件什么事?:每次部署都是复制本地的文件粘贴到服务器端,因为路径复杂,所以费时且手工容易出漏洞. 一直在想有什么办法可以解决这种,因为以前在微软的一个牛人同事做过一 ...

  5. python匹配ip正则

    python匹配ip正则 #!/usr/bin/env python # -*- coding:utf-8 -*- import re ip_str = "asdad1.1.1.1sdfwe ...

  6. python标准库00 学习准备

    Python标准库----走马观花 python有一套很有用的标准库.标准库会随着python解释器一起安装在你的电脑上的.它是python的一个组成部分.这些标准库是python为你准备的利器,可以 ...

  7. Python标准库的学习准备

    作者:Vamei 出处:http://www.cnblogs.com/vamei 欢迎转载,也请保留这段声明.谢谢! Python标准库是Python强大的动力所在,我们已经在前文中有所介绍.由于标准 ...

  8. Python HTTP库requests中文页面乱码解决方案!

    http://www.cnblogs.com/bitpeng/p/4748872.html Python中文乱码,是一个很大的坑,自己不知道在这里遇到多少问题了.还好通过自己不断的总结,现在遇到乱码的 ...

  9. python第三方库,你要的这里都有

    Python的第三方库多的超出我的想象. python 第三方模块 转 https://github.com/masterpy/zwpy_lst   Chardet,字符编码探测器,可以自动检测文本. ...

随机推荐

  1. union: php/laravel command

    #########Laravel###############2018-01-09 16:46:26 # switch to maintenance mode php artisan down # s ...

  2. TypeError: 'range' object does not support item assignment处理方法

    vectorsum.py#!/usr/bin/env/pythonimport sysfrom datetime import datetimeimport numpy as np # def num ...

  3. 对int数组排序

      // 排序-->小到大1     public void sortArray(int[] targetArr) {         long t = System.currentTimeMi ...

  4. Oracle获取异常的具体出处dbms_utility.format_error_backtrace

    DBMS_UTILITY.FORMAT_ERROR_BACKTRACE :返回当前异常相应的描述,通过它就能知道异常的最初生成处.   系统为最近一次生成的异常设置了一个栈,并跟踪它的传递过程,而这个 ...

  5. 第四范式涂威威:AutoML技术现状与未来展望

    以下内容是对AutoML技术现状与未来展望讲座的总结. 1.机器学习定义 <西瓜书>中的直观定义是:利用经验来改善系统的性能.(这里的经验一般是指数据) Mitchell在<Mach ...

  6. springboot整合redis-sentinel支持Cache注解

    一.前提 已经存在一个redis-sentinel集群,两个哨兵分别如下: /home/redis-sentinel-cluster/sentinel-1.conf port 26379 dir &q ...

  7. Appium系列文章(1)获取appPackage和appActivity

    appPackage和appActivity 进行appium自动化测试非常重要的两个参数,我们所测试的APP不同,这两个参数肯定也是不一样的.那如何快速的获取这APP的这两个参数呢? 通过cmd命令 ...

  8. python模块:logging

    # Copyright 2001-2016 by Vinay Sajip. All Rights Reserved. # # Permission to use, copy, modify, and ...

  9. ADO.NET MSSSQLServer 操作简要总结

    1).数据库操作首先应该是链接,链接的方式有多种,不论怎样实现最终都是把链接字符串赋值给实现了 继承自DbConnection 类的SqlConnection类实例的ConnectionString属 ...

  10. jsonp(对,通俗易懂)

    jsonp是啥玩意儿呢 ?你猜! 此感叹号意味着以下内容要说正事儿了!!!!! 由于浏览器为了安全限制(他要怎样他说了算,此处不扯远了):只能允许来自同服务器,同域名的同端口号下请求数据(同源),是的 ...