您现在的位置是：首页 > 后端

当前栏目

Python基础（9）--正则表达式

Python 正则表达式基础 --

2023-09-14 08:58:00 时间

据上所述，".*"为最大匹配，能匹配源字符串所有能匹配的字符串。".* "为最小匹配，只匹配第一次出现的字符串。如：d.*g能匹配任意以d开头，以g结尾的字符串，如"debug"和"debugging"，甚至"dog is walking"。而d.* g只能匹配"debug"，在"dog is walking"字符串中，则只匹配到"dog "。

在一些更复杂的匹配中，我们可用到组和运算符。

组和运算符

有一组特殊的字符序列，用来匹配具体的字符类型或字符环境。如\b匹配字符边界，food\b匹配"food"、"zoofood"，而和"foodies"不匹配。

特殊字符序列

( =...) 如果所提供的文本与下一个正则表达式元素匹配，这之间没有多余的文本就匹配。这允许在一个表达式中进行超前操作，而不影响正则表达式其余部分的分析。如"Martin"其后紧跟"Brown"，则"Martin( =Brown)"就只与"Martin"匹配。
( =...) 如果字符串当前位置的前缀字符串是给定文本，就匹配，整个表达式就在当前位置终止。如( =abc)def表达式与"abcdef"匹配。这种匹配是对前缀字符数量的精确匹配。

通过re模块，我们就可在python中利用正则式对字符串进行搜索、抽取和替换操作。如：re.search()函数能执行一个基本的搜索操作，它能返回一个MatchObject对象。re.findall()函数能返回匹配列表。

 import re

 a="this is my re module test"

 obj = re.search(r.*is,a)

 print obj

 _sre.SRE_Match object at 0xb7d7a218 

 obj.group()

this is

 re.findall(r.*is,a)

[this is]

MatchObject对象方法

m.group([group,...]) 返回匹配的文本，是个元组。此文本是与给定group或由其索引数字定义的组匹配的文本，如果没有组定组名，则返回所有匹配项。
m.groups([default]) 返回一个元组，该元组包含模式中与所有组匹配的文本。如果给出default参数，default参数值就是与给定表达式不匹配的组的返回值。default参数的默认取值为None。
m.groupdict([default]) 返回一个字典，该字典包含匹配的所有子组。如果给出default参数，其值就是那些不匹配组的返回值。default参数的默认取值为None。
m.span([group]) 返回两元素组，此元组等价于关于一给定组或一个完整匹配表达式的(m.start(group),m.end(group)))列表

使用sub()或subn()函数可在字符串上执行替换操作。sub()函数的基本格式如下：

sub(pattern,replace,string[,count])

示例

 str = The dog on my bed

 rep = re.sub(dog,cat,str)

 print rep

The cat on my bed

replace参数可接受函数。要获得替换的次数，可使用subn()函数。subn()函数返回一个元组，此元组包含替换了的文本和替换的次数。

如果需用同一个正则式进行多次匹配操作，我们可把正则式编译成内部语言，提高处理速度。编译正则式用compile()函数来实现。compile()函数的基本格式如下：

compile(str[,flags])

str表示需编译的正则式串，flags是修饰标志符。正则式被编译后生成一个对象，该对象有多种方法和属性。

正则式对象方法/属性

built-in method append of list object at 0xb7d4a52c handler(cc) #相当于li.append(cc) [a,b,c,cc] result = handler(bb) [a,b,c,cc,bb] print result None
Python实用技术一：正则表达式用以表示“此处必须出现一个某某范围内的字符”，或者“此处必须出现一一个字符，但不可以是某某范围内的字符” ，但不可以十某某范围内的字符。

猜你喜欢

ps进程命令
Struts2(接受表单参数)请求数据自动封装和数据类型转换
推荐收藏：Pytorch深度学习建模流程总结
DOM元素全屏显示解决方案（续）
Python爬虫登录后token处理
[Python] Scatter Plot for daily return
Jenkins 流水线语法进阶 Groovy 01 本地配置Groovy开发环境
kaggle bike sharing program R code tranlated from python code ranked 9th
一篇文章带你全面了解“电脑”内外组成
Android Layout: TableLayout
体检流程质控
覆盖和覆盖D2D通信网络的传输容量分析（Matlab代码实现）
JS动态改变select选择变更option的index值
菜鸡发现腾讯视频bug
【2017"百度之星"程序设计大赛 - 初赛（A）】小C的倍数问题
非连续内存分配（分页、分段、段页式内存管理）

相关主题

python Gunicorn
python 数据结构篇
【Python】正则表达式
python正则表达式1
Python_11-正则表达式
python_88_xml模块
Python--基础一
python 实例四
Python——字典
Python--元组tuple

zl程序教程

当前栏目

Python基础（9）--正则表达式

相关文章