python re的findall和finditer的区别详解-偶像资源网

python正则模块re中findall和finditer两者相似，但却有很大区别。

两者都可以获取所有的匹配结果，这和search方法有着很大的区别，同时不同的是一个返回list，一个返回一个MatchObject类型的iterator

假设我们有这样的数据：其中数字代表电话号，xx代表邮箱类型

content = \'\'\'email:12345678@163.com
email:2345678@163.com
email:345678@163.com
\'\'\'

需求：（正则没有分组）提取所有的邮箱信息

result_finditer = re.finditer(r\"\\d+@\\w+.com\", content)
#由于返回的为MatchObject的iterator，所以我们需要迭代并通过MatchObject的方法输出
for i in result_finditer :
  print i.group()

result_findall = re.findall(r\"\\d+@\\w+.com\", content)
#返回一个[] 直接输出or或者循环输出
print result_findall
for i in result_findall :
  print i

需求：（正则有分组）提取出来所有的电话号码和邮箱类型

result_finditer = re.finditer(r\"(\\d+)@(\\w+).com\", content)
#正则有两个分组，我们需要分别获取分区，分组从0开始，group方法不传递索引默认为0，代表了整个正则的匹配结果
for i in result_finditer :
  phone_no = i.group(1)
  email_type = i.group(2)

result_findall = re.findall(r\"(\\d+)@(\\w+).com\", content)
#此时返回的虽然为[]，但不是简单的[],而是一个tuple类型的list 
#如：[(\'12345678\', \'163\'), (\'2345678\', \'163\'), (\'345678\', \'163\')]
for i in result_findall :
  phone_no = i[0]
  email_type = i[1]

命名分组和非命名分组的情况是一样的。

findall注意点：

1.当正则没有分组是返回的就是正则的匹配

re.findall(r\"\\d+@\\w+.com\", content)
[\'2345678@163.com\', \'2345678@163.com\', \'345678@163.com\']

2.有一个分组返回的是分组的匹配而不是整个正则的匹配

re.findall(r\"(\\d+)@\\w+.com\", content)
[\'2345678\', \'2345678\', \'345678\']

3.多个分组时将分组装到tuple中返回

re.findall(r\"(\\d+)@(\\w+).com\", content)
[(\'2345678\', \'163\'), (\'2345678\', \'163\'), (\'345678\', \'163\')]

因此假如我们需要拿到整个正则和每个分组的匹配，使用findall我们需要将整个正则作为一个分组

re.findall(r\"((\\d+)@(\\w+).com)\", content)
[(\'2345678@163.com\', \'2345678\', \'163\'), (\'2345678@163.com\', \'2345678\', \'163\'), (\'345678@163.com\', \'345678\', \'163\')]

而使用finditer我们无需手动将整个正则用()括起来group()代表整个正则的匹配

实际中我们根据我们的需求选择方法既可。

版权声明 1 本网站名称：偶像资源网
2 本站永久网址：https://www.ox520.com
3 本网站的文章部分内容可能来源于网络，仅供大家学习与参考，如有侵权，请联系站长 QQ593098775进行删除处理。
4 本站一切资源不代表本站立场，并不代表本站赞同其观点和对其真实性负责。
5 本站一律禁止以任何方式发布或转载任何违法的相关信息，访客发现请向站长举报
6 本站资源大多存储在云盘，如发现链接失效，请联系我们我们会第一时间更新。

THE END

python re的findall和finditer的区别详解

请登录后发表评论