今天给大家介绍一下Python中常用的正则表达式处理函数。 Python的正则表达式主要有两种方法来完成模式匹配:“搜索”和“匹配”
re.match
re.match 尝试从字符串的开头匹配全部或部分模式,例如:下面的示例匹配第一个单词。
import re
text = "PythonTab.com is a good Python website"
m = re.match(r"(\w+)\s", text)
if m:
print m.group(0), '\n', m.group(1)
else:
re.match的函数原型为:re.match(pattern, string, flags)
第一个参数是一个正则表达式,这里是"(\w+)\s",如果匹配成功则返回一个Match,否则返回一个None;
第二个参数表示要匹配的字符串;
第三个参数为标致位,用于控制正则表达式的匹配方式,如:是否区分大小写、多行匹配等。
注意:能匹配的前提是开头必须满足匹配条件
re.search
re.search 函数在字符串中查找模式匹配,直到找到第一个匹配项,如果字符串不匹配则返回 None。
import re
text = "PythonTab.com is a good Python website"
m = re.search(r'\Pyt(on)n\s', text)
if m:
print m.group(0), m.group(1)
else:
print 'not search'
re.search的函数原型为: re.search(pattern, string, flags)
每个参数的含意与re.match一样。
re.match和re.search的区别:re.match只匹配字符串的开头。如果字符串开头与正则表达式不匹配,则匹配失败,函数返回None;而 re.search 匹配整个字符串,直到找到一个匹配项。
re.sub
re.sub 用于替换字符串中的匹配项。以下示例将字符串中的空格 ' ' 替换为 '-' :
import re
text = "PythonTab.com is a good Python website"
print re.sub(r'\s+', '-', text)
re.sub的函数原型为:re.sub(pattern, repl, string, count)
其中第二个函数是替换后的字符串;本例中为'-'
第四个参数是指替换的次数。默认为 0,表示替换每个匹配项。
re.sub 还允许使用函数复杂地处理匹配项的替换。如:re.sub(r'\s', lambda m: '[' + m.group(0) + ']', text, 0);用“[]”替换字符串中的空格“”。
re.split
可以使用re.split来分割字符串,如:re.split(r'\s+', text);按空格将字符串拆分为单词列表。
re.findall
re.findall 可以得到一个字符串中所有匹配的字符串。如:re.findall(r'\w*oo\w*', text);获取字符串中所有包含 'oo' 的单词。
re.compile
可以将正则表达式编译成正则表达式对象。将经常使用的正则表达式编译成正则表达式对象,可以提高一定的效率。下面是一个正则表达式对象的例子:
import re
text = "PythonTab is a good Python website"
regex = re.compile(r'\w*on\w*')
print regex.findall(text) #查找所有包含'on'的单词
print regex.sub(lambda m: '[' + m.group(0) + ']', text) #将字符串中含有'on'的单词用[]括起来。
本文为原创文章,版权归知行编程网所有,欢迎分享本文,转载请保留出处!
你可能也喜欢
- ♥ 如何使用python类11/07
- ♥ 探究python生成器原理12/06
- ♥ python包和文件夹有什么区别09/13
- ♥ 如何在python中计算乘法10/03
- ♥ 如何转换python字符串大小写11/26
- ♥ python默认参数的使用方法01/05
内容反馈