python中正则表达式的使用方法


Posted in Python onFebruary 25, 2018

本文主要关于python的正则表达式的符号与方法。

findall: 找寻所有匹配,返回所有组合的列表
search: 找寻第一个匹配并返回
sub: 替换符合规律的内容,并返回替换后的内容
.:匹配除了换行符以外的任意字符

a = 'xy123'
b = re.findall('x...',a)
print(b)
# ['xy12']

*:匹配前一个字符0次或者无限次

a = 'xyxy123'
b = re.findall('x*',a)
print(b)
# ['x', '', 'x', '', '', '', '', '']

?:匹配前一个字符0次或者1次

a = 'xy123'
b = re.findall('x?',a)
print(b)
# ['x', '', '', '', '', '']

.*:贪心算法

b = re.findall('xx.*xx',secret_code)
print(b)
# ['xxIxxfasdjifja134xxlovexx23345sdfxxyouxx']

.*?:非贪心算法

c = re.findall('xx.*?xx',secret_code)
print(c)
# ['xxIxx', 'xxlovexx', 'xxyouxx']

():括号内结果返回

d = re.findall('xx(.*?)xx',secret_code)
print(d)
for each in d:
  print(each)
# ['I', 'love', 'you']
# I
# love
# you

re.S使得.的作用域包括换行符”\n”

s = '''sdfxxhello
xxfsdfxxworldxxasdf'''

d = re.findall('xx(.*?)xx',s,re.S)
print(d)
# ['hello\n', 'world']

对比findall与search的区别

s2 = 'asdfxxIxx123xxlovexxdfd'
f = re.search('xx(.*?)xx123xx(.*?)xx',s2).group(2)
print(f)
f2 = re.findall('xx(.*?)xx123xx(.*?)xx',s2)
print(f2[0][1])
# love
# love

虽然两者结果相同,但是search是搭配group来得到第二个匹配,而findall的结果是[(‘I', ‘love')],包含元组的列表,所以需要f2[0][1]来引入。

sub的使用

s = '123rrrrr123'
output = re.sub('123(.*?)123','123%d123'%789,s)
print(output)
# 123789123

例如我们需要将文档中的所有的png图片改变路径,即需要找到所有的 .png 结尾,再将其都加上路径,

import re

def multiply(m):
  # Convert group 0 to an integer.
  v = m.group(0)
  print(v)
  # Multiply integer by 2.
  # ... Convert back into string and return it.
  print('basic/'+v)
  return 'basic/'+v

结果如下

>>>autoencoder.png
  basic/autoencoder.png
  RNN.png
  basic/RNN.png
  rnn_step_forward.png
  basic/rnn_step_forward.png
  rnns.png
  basic/rnns.png
  rnn_cell_backprop.png
  basic/rnn_cell_backprop.png
  LSTM.png
  basic/LSTM.png
  LSTM_rnn.png
  basic/LSTM_rnn.png
  attn_mechanism.png
  basic/attn_mechanism.png
  attn_model.png
  basic/attn_model.png

仿照上面案例,我们可以方便的对我们的任务进行定制。

subn相比sub,subn返回元组,第二个元素表示替换发生的次数:

import re

def add(m):
  # Convert.
  v = int(m.group(0))
  # Add 2.
  return str(v + 1)

# Call re.subn.
result = re.subn("\d+", add, "1 2 3 4 5")

print("Result string:", result[0])
print("Number of substitutions:", result[1])
>>>
Result string: 11 21 31 41 51
Number of substitutions: 5
Python 相关文章推荐
Python常用内置函数总结
Feb 08 Python
Python3结合Dlib实现人脸识别和剪切
Jan 24 Python
python实现单链表中删除倒数第K个节点的方法
Sep 28 Python
pygame游戏之旅 游戏中添加显示文字
Nov 20 Python
python安装numpy和pandas的方法步骤
May 27 Python
python SQLAlchemy 中的Engine详解
Jul 04 Python
Pycharm+django2.2+python3.6+MySQL实现简单的考试报名系统
Sep 05 Python
win7下 python3.6 安装opencv 和 opencv-contrib-python解决 cv2.xfeatures2d.SIFT_create() 的问题
Oct 24 Python
Python日志处理模块logging用法解析
May 19 Python
Python实现自动签到脚本功能
Aug 20 Python
Django haystack实现全文搜索代码示例
Nov 28 Python
详解Python requests模块
Jun 21 Python
python爬虫爬取淘宝商品信息(selenum+phontomjs)
Feb 24 #Python
python正则表达式爬取猫眼电影top100
Feb 24 #Python
python爬虫获取淘宝天猫商品详细参数
Jun 23 #Python
python按综合、销量排序抓取100页的淘宝商品列表信息
Feb 24 #Python
python2.7+selenium2实现淘宝滑块自动认证功能
Feb 24 #Python
Python 中Pickle库的使用详解
Feb 24 #Python
Python使用Selenium+BeautifulSoup爬取淘宝搜索页
Feb 24 #Python
You might like
PHPWind 发帖回帖Api PHP版打包下载
2010/02/08 PHP
php中神奇的fastcgi_finish_request
2011/05/02 PHP
用mysql_fetch_array()获取当前行数据的方法详解
2013/06/05 PHP
PHP实现的连贯操作、链式操作实例
2014/07/08 PHP
javascript 时间比较实现代码
2009/10/28 Javascript
javascript跨域刷新实现代码
2011/01/01 Javascript
jquery绑定事件不生效的解决方法
2014/02/11 Javascript
javascript实现验证身份证号的有效性并提示
2015/04/30 Javascript
js读取并解析JSON类型数据的方法
2015/11/14 Javascript
jquery采用oop模式class类的使用示例
2016/01/22 Javascript
javascript正则表达式之分组概念与用法实例
2016/06/16 Javascript
Bootstrap源码解读下拉菜单(4)
2016/12/23 Javascript
手动初始化Angular的模块与控制器
2016/12/26 Javascript
Vue数据驱动模拟实现5
2017/01/13 Javascript
jQuery Autocomplete简介_动力节点Java学院整理
2017/07/17 jQuery
JS实现点击按钮可实现编辑功能
2018/07/03 Javascript
基于vue开发微信小程序mpvue-docs跳转页面功能
2019/04/10 Javascript
JavaScript中BOM对象原理与用法分析
2019/07/09 Javascript
vue项目中全局引入1个.scss文件的问题解决
2019/08/01 Javascript
vue数据更新UI不刷新显示的解决办法
2020/08/06 Javascript
[57:53]DOTA2上海特级锦标赛主赛事日 - 2 败者组第二轮#3OG VS VP
2016/03/03 DOTA
python数据类型判断type与isinstance的区别实例解析
2017/10/31 Python
python字符串Intern机制详解
2019/07/01 Python
Python在cmd上打印彩色文字实现过程详解
2019/08/07 Python
python词云库wordCloud使用方法详解(解决中文乱码)
2020/02/17 Python
Django+Uwsgi+Nginx如何实现生产环境部署
2020/07/31 Python
哥伦比亚最大的网上商店:Linio哥伦比亚
2016/09/25 全球购物
波兰品牌内衣及泳装网上商店:Astratex.pl
2017/02/03 全球购物
捷克鲜花配送:Florea.cz
2018/10/29 全球购物
幸福家庭事迹材料
2014/02/03 职场文书
奖学金感谢信
2015/01/21 职场文书
语文教师个人工作总结
2015/02/06 职场文书
催款律师函范文
2015/05/27 职场文书
宝宝满月宴答谢词
2015/09/30 职场文书
2016教师学习党章心得体会
2016/01/15 职场文书
html用代码制作虚线框怎么做? dw制作虚线圆圈的技巧
2022/12/24 HTML / CSS