python正则表达式非贪婪模式 python正则贪婪匹配

转载

mob6454cc7203e2 2024-08-23 09:07:32

文章标签 python正则表达式非贪婪模式 python非贪婪匹配正则 python 模式匹配 文章分类 Python 后端开发

上一篇python正则匹配次数大家应该也发现了，除了？其他匹配次数规则都是尽可能多的匹配

那如果只想匹配1次怎么办呢，这就是正则中非贪婪模式的概念了

原理就是利用？与其他匹配次数规则进行组合

单个匹配规则：


* = {0,}表示匹配0-n次
+ = {1,}表示匹配1-n次
？= {0,1}表示匹配0-1次
三者可组合成非贪婪模式匹配次数解析：*？ +?  ??
简而言之：它们必须结合左右的子串进行匹配，左边正则必须非空，右边正则可以为空，中心思想就是在匹配到右边的正则之前尽可能少次匹配左边的正则
match是从头开始匹配，找到第一个符合条件的子字符串
?? =(reg1?)?reg2 = (reg1{0,1}){0,1}reg2
In [149]: re.match(r'\w??\d','123wer123')　　# 第一个\d即数字之前，\w只能匹配0-1次； 这里第一个\d之前可匹配\w 0次，返回第一个数字
Out[149]: 
In [150]: re.match(r'\w??\d','w123wer123')　　# 第一个\d数字之前，\w只能i匹配0-1次；这里第一个\d之前\w匹配到一次，返回一个字母+第一个数字
Out[150]: 
In [151]: re.match(r'\w??\d','wx123wer123')　　# 第一个\d数字之前，\w只能匹配0-1次； 这里\d前面匹配到\w 2次，match失败，返回None
In [152]: re.match(r'\w??\d','wxwer') #\d至少匹配1次； 这里\d没匹配到，所以最终match失败，返回None
In [153]: re.match(r'\w??','wxwer')　　#　\w只能匹配0-1次；这里选少的匹配0次
Out[153]: 
*? =(reg1*)?reg2 = (reg1{0,}){0,1}reg2
In [154]: re.match(r'\w*?\d','123wer123') # 第一个\d前\w只能匹配0-n次； 这里\d前可匹配0次\w, 返回第一个数字
Out[154]: 
In [155]: re.match(r'\w*?\d','wx123wer123')　　# 第一个\d前\w只能匹配0-n次；这里\d前匹配2次\w， 返回2个字母+一个数字
Out[155]: 
In [156]: re.match(r'\w*?\d','wxe')　　#\d至少要匹配一次；这里\d没有匹配项，最终匹配失败，返回None
In [157]: re.match(r'\w*?','wxe')　　# \w只能匹配0-n次； 这里最少匹配0次
Out[157]: 
+? =(reg1+)?reg2 = (reg1{1,}){0,1}reg2
In [160]: re.match(r'\w+?\d','%123wer123')　　# 第一个\d前\w匹配只能匹配1-n次；这里第一个\d前\w只匹配到0次，最终match失败，返回None
In [161]: re.match(r'\w+?\d','wsx123wer123')　　#第一个\d前\w只能匹配1-n次；这里第一个\d前\w最少匹配3次，最后返回三个字母+第一个数字
Out[161]: 
In [162]: re.match(r'\w+?\d','wsxwer')　　# \d必须至少匹配到一次；这里\d匹配0次，最终匹配失败，返回None
In [163]: re.match(r'\w+?','wsxwer')　　# \w只能匹配1-n次；这里\w最少可匹配1次，即返回第一个字母
Out[163]: 
In [165]: re.match(r'w+?\w','wsxwer')　　# 第一个\w之前，w只能出现1-n次；这里w最少可匹配到一次，所以返回w+第一个字母
Out[165]: 
In [27]: re.match(r'aw+?\w','awwsxwer')　　# 第一个字母必须是a，在a和\w之间，w可出现1-n次； 这里w最少可匹配到1次
Out[27]:

本文章为转载内容，我们尊重原作者对文章享有的著作权。如有内容错误或侵权问题，欢迎原作者联系我们进行内容更正或删除文章。