Python正则表达式高级使用方法汇总

脚本专栏 2026/6/25 佚名

3 2 1

正则表达式是一个以简单直观的方式匹配指定文本信息从而达到查找、替换等操作的目的。正则表达式以其简单而高效的特点使得其在数据分析和数据验证方面应用广泛。

对于简单的正则表达式可以直接百度之，这里重点引荐下‘特殊'操作。

1.非贪婪模式 - {x,y}"htmlcode">

> m = re.search(r'(\d{3})-(\d{5})','029-25642') > m.group() '029-25642' > m.groups() ('029', '25642') > m.group(2) '25642'

可以通过m.groups()看到分组匹配结果，通过m.group(index)查看具体编号的分组结果（编号从1开始，0是完整的匹配）。那分组有什么用呢，好像也没什么特殊的含义，不急，下面会用到。

3.引用分组（回溯） - \N

有这么一种情况，比如假设我要找出一个html文本中的所有<a></a>标签，怎么办？试试这样：

> re.search(r'<(\w+)>.+</(\w+)>','<a>this is a demo</e>')
<_sre.SRE_Match object; span=(0, 21), match='<a>this is a demo</e>'>

奇怪的事情来了，为什么<a></e>被匹配成功了，显然结果并不是想要的，那怎么才能只匹配<a></a>而过滤掉其他的呢（比如<a></e>）？答案就是引用分组，例：

> re.search(r'<(\w+)>.+</\1>','<a>this is a demo</e><p>demo two</p>')
<_sre.SRE_Match object; span=(21, 36), match='<p>demo two</p>'>　　

这里\1是关键，意思就是当前位置匹配的结果需要和第一个分组匹配的结果一致，或者说第一个分组的匹配结果期望在这里再次出现。以此类推。该方法最多只能匹配前99个分组。

4.分组命名 - ("htmlcode">

> m = re.search(r'(?P<first_name>\d{3})-(?P<second_name>\d{4})','029-8967') > m.group('first_name') '029' > m.groupdict() {'first_name': '029', 'second_name': '8967'}

当然，命名分组仍然是编号分组，依然可以使用编号进行查找分组。

5.先行断言 - X(?!Y)、X(?=Y)

假设有这么一种情况，要查找所有163信箱的文本，也就是@163.com结尾的所有email账号信息，也就是说不要@163.com这部分，但是其还要参与匹配。这就用到了先行断言，也即基于之后的内容是否存在接收或拒绝一个匹配，而不需要接下来的内容作为匹配的一部分。例：

> re.search(r'h(?!e)','hello home!')
<_sre.SRE_Match object; span=(6, 7), match='h'>

h(?!e)表示匹配h，而且h后面不能是e，此处匹配成功的是home，但是只返回h

> re.search(r'h(?=e)','hello home!')
<_sre.SRE_Match object; span=(0, 1), match='h'>

h(?=e)表示匹配he，此处匹配成功的是hello，但是只返回h

6.标记

不区分大小写：re.IGNORECASE（简写re.I）-使得正则表达式不区分大小写

点匹配换行符：re.DOTALL（简写re.S）-使得 . 符号可以匹配换行符

多行模式：re.MULTILINE（简写re.M）-使得^$字符可以匹配任意行的开始与结束

详细模式：re.VERBOSE（简写re.X）-使得正则表达式可以换行书写，且可以加入注释

调试模式：re.DEBUG-将调试信息输出到sys.stderr

使用多个标记时，使用|分隔，如re.S|re.M

以上就是本文的全部内容，希望对大家的学习有所帮助，也希望大家多多支持。

python,正则表达式,用法

标签：
python,正则表达式,用法

免责声明：本站文章均来自网站采集或用户投稿，网站不提供任何软件下载或自行开发的软件！如有用户或公司发现本站内容信息存在侵权行为，请邮件告知！ 858582#qq.com

上一篇
 关于tf.matmul() 和tf.multiply() 的区别说明

下一篇
 将tf.batch_matmul替换成tf.matmul的实现

白云城资源网 Copyright www.dyhadc.com

评论“Python正则表达式高级使用方法汇总”

Python正则表达式高级使用方法汇总

暂无“Python正则表达式高级使用方法汇总”评论...

www.dyhadc.com 白云城资源网

129,905影音资源

244,626技术资源

111,817软件资源

578,645站长资源

最新文章

转载一个别人收藏的精典网站Ruby,HIBERNATE

2026/6/25
56

可与Spreadsheets媲美的在线表格系统:EditG

2026/6/25
34

cygwin使用心得

2026/6/25
73

脚本的DVD开发

2026/6/25
28

局域网设置自动配置脚本文件的写法与用途

2026/6/25
15

站点导航
抖音极速版红果短剧哔哩哔哩王者荣耀和平精英腾讯视频爱奇艺 QQ音乐咸鱼之王逆水寒三国志战略版梦幻西游金铲铲之战捕鱼大作战原神英雄联盟手游网易云音乐崩坏星穹铁道酷狗音乐蛋仔派对

Python正则表达式高级使用方法汇总

python,正则表达式,用法

关于tf.matmul() 和tf.multiply() 的区别说明

将tf.batch_matmul替换成tf.matmul的实现

评论“Python正则表达式高级使用方法汇总”

P70系列延期，华为新旗舰将在下月发布

更新日志

友情链接