时间:2021-05-23
正则表达式,又称规则表达式,通常被用来检索、替换那些符合某个模式(规则)的文本。
正则表达式是对字符串操作的一种逻辑公式,就是用事先定义好的一些特定字符、及这些特定字符的组合,组成一个“规则字符串”,这个“规则字符串”用来表达对字符串的一种过滤逻辑。
1.表示字符
2.预定义字符集(可写在字符集[]中)
3.表示数量
4.表示边界
5.匹配分组
6.特殊构造(不作为分组)
在 Python中,我们可以使用内置的 re 模块来使用正则表达式。与大多数编程语言相同,正则表达式里使用'\'作为转义字符,这就可能造成反斜杠困扰。Python里的原生字符串很好地解决了这个问题,只需要在字符串前面加上'r'前缀。
re模块的一般使用步骤:
1.compile函数
compile 函数用于编译正则表达式,生成一个 Pattern 对象。必须传入的第一个参数是'规则字符串',另外可以通过第二个参数(flags)来指定匹配模式。
常见的匹配模式:
2.Pattern 对象的一些常用方法
match方法
match 方法用于查找字符串的头部(也可以指定起始位置),它是一次匹配,只要找到了一个匹配的结果就返回,而不是查找所有匹配的结果。
它的一般使用形式如下:
match(string[, pos[, endpos]])其中,string 是待匹配的字符串,pos 和 endpos 是可选参数,指定字符串的起始和终点位置,默认值分别是 0 和 len (字符串长度)。因此,当你不指定 pos 和 endpos 时,match 方法默认匹配字符串的头部。
当匹配成功时,返回一个 Match 对象,如果没有匹配上,则返回 None。
Match对象常用的方法:
通过一些例子来熟悉一下:
In [1]: import reIn [2]: pattern = re.compile(r"(\w+) (\d+)")In [3]: m = pattern.match('hello 123')In [4]: m.group(1)Out[4]: 'hello'In [5]: m.group(1,2)Out[5]: ('hello', '123')In [6]: m.group()Out[6]: 'hello 123'In [7]: m.groups()Out[7]: ('hello', '123')In [8]: m.start(1)Out[8]: 0In [9]: m.start(2)Out[9]: 6In [10]: m.end(1)Out[10]: 5In [11]: m.span(1)Out[11]: (0, 5)In [12]: m.span(2)Out[12]: (6, 9)search方法
search 方法用于查找字符串的任何位置,它也是一次匹配,只要找到了一个匹配的结果就返回,而不是查找所有匹配的结果
它的一般使用形式如下:
search(string[, pos[, endpos]])其中,string 是待匹配的字符串,pos 和 endpos 是可选参数,指定字符串的起始和终点位置,默认值分别是 0 和 len (字符串长度)。
看看例子
>>> import re>>> pattern = re.compile('\d+')>>> m = pattern.search('one12twothree34four') # 这里如果使用 match 方法则不匹配>>> m<_sre.SRE_Match object at 0x10cc03ac0>>>> m.group()'12'>>> m = pattern.search('one12twothree34four', 10, 30) # 指定字符串区间>>> m<_sre.SRE_Match object at 0x10cc03b28>>>> m.group()'34'>>> m.span()(13, 15)findall方法
上面的 match 和 search 方法都是一次匹配,只要找到了一个匹配的结果就返回。然而,在大多数时候,我们需要搜索整个字符串,获得所有匹配的结果。
findall 方法的使用形式如下:
findall(string[, pos[, endpos]])其中,string 是待匹配的字符串,pos 和 endpos 是可选参数,指定字符串的起始和终点位置,默认值分别是 0 和 len (字符串长度)。
findall 以列表形式返回全部能匹配的子串,如果没有匹配,则返回一个空列表。
看个例子:
import re#re模块提供一个方法叫compile模块,提供我们输入一个匹配的规则#然后返回一个pattern实例,我们根据这个规则去匹配字符串pattern = re.compile(r'\d+\.\d*')#通过partten.findall()方法就能够全部匹配到我们得到的字符串result = pattern.findall("123.141593, 'bigcat', 232312, 3.15")#findall 以 列表形式 返回全部能匹配的子串给resultfor item in result: print(item)运行结果:
123.141593
3.15
finditer方法
finditer 方法的行为跟 findall 的行为类似,也是搜索整个字符串,获得所有匹配的结果。但它返回一个顺序访问每一个匹配结果(Match 对象)的迭代器。
举例:
In [1]: import reIn [2]: pattern = re.compile(r"\d+")In [3]: iter = pattern.finditer('hello123world456 haha789')In [4]: iterOut[4]: <callable_iterator at 0x7fb824fe2a90>In [5]: for m in iter: ...: print(m.group()) ...: 123456789split方法
split 方法按照能够匹配的子串将字符串分割后返回列表
它的使用形式如下:
split(string[, maxsplit])其中,maxsplit 用于指定最大分割次数,不指定将全部分割。
举个例子:
In [1]: import reIn [2]: pattern = re.compile(r"[\d\s]")In [3]: pattern.split('hello1word2aaa bbb')Out[3]: ['hello', 'word', 'aaa', 'bbb']In [4]: pattern.split('hello1word2aaa bbb',2)Out[4]: ['hello', 'word', 'aaa bbb']sub方法
sub 方法用于替换。
它的使用形式如下
sub(repl, string[, count])其中,repl 可以是字符串也可以是一个函数:
到此这篇关于python中re模块知识点总结的文章就介绍到这了,更多相关python中re模块的使用内容请搜索以前的文章或继续浏览下面的相关文章希望大家以后多多支持!
声明:本页内容来源网络,仅供用户参考;我单位不保证亦不表示资料全面及准确无误,也不保证亦不表示这些资料为最新信息,如因任何原因,本网内容或者用户因倚赖本网内容造成任何损失或损害,我单位将不会负任何法律责任。如涉及版权问题,请提交至online#300.cn邮箱联系删除。
本文是requireJS的一些知识点的总结,配上多页面应用中的实例分析。本案例的目录结构如下:requireJSAPI的三个主要函数:define(创建模块),
第一个知识点:表单的属性及总结第二个知识点:H5新增的表单控件和属性以及总结第一个知识点:我们常见的表单验证有哪些呢 text 文本框标签 passwor
这次用Python实现的是一个接球打砖块的小游戏,需要导入pygame模块,有以下两条经验总结:1.多父类的继承2.碰撞检测的数学模型知识点稍后再说,我们先看看
知识点图像模块(Image.Image)Image模块的功能Image模块的方法ImageChops模块ImageColor模块基础使用图像模块Image.Im
小小最近学习到了js的几种循环方式,对这几种循环方式进行总结。以及对模块化的相关知识点进行总结,循环方式循环方式分为好几种循环方式,分别是for循环,forEa