知行编程网知行编程网  2023-01-07 02:30 知行编程网 隐藏边栏  1 
文章评分 0 次,平均分 0.0
导语: 本文主要介绍了关于伸手党必备之Python正则表达式常用函数的相关知识,希望可以帮到处于编程学习途中的小伙伴

外出必备的Python正则表达式常用函数

今天给大家介绍一下Python中常用的正则表达式处理函数。 Python的正则表达式主要有两种方法来完成模式匹配:“搜索”和“匹配”


re.match

re.match 尝试从字符串的开头匹配全部或部分模式,例如:下面的示例匹配第一个单词。

import re
text = "PythonTab.com is a good Python website"
m = re.match(r"(\w+)\s", text)
if m:
print m.group(0), '\n', m.group(1)
else:


re.match的函数原型为:re.match(pattern, string, flags)

第一个参数是一个正则表达式,这里是"(\w+)\s",如果匹配成功则返回一个Match,否则返回一个None;

第二个参数表示要匹配的字符串;

第三个参数为标致位,用于控制正则表达式的匹配方式,如:是否区分大小写、多行匹配等。

注意:能匹配的前提是开头必须满足匹配条件


re.search

re.search 函数在字符串中查找模式匹配,直到找到第一个匹配项,如果字符串不匹配则返回 None。

import re
text = "PythonTab.com is a good Python website"
m = re.search(r'\Pyt(on)n\s', text)
if m:
print m.group(0), m.group(1)
else:
print 'not search'


re.search的函数原型为: re.search(pattern, string, flags)

每个参数的含意与re.match一样。

re.match和re.search的区别:re.match只匹配字符串的开头。如果字符串开头与正则表达式不匹配,则匹配失败,函数返回None;而 re.search 匹配整个字符串,直到找到一个匹配项。


re.sub

re.sub 用于替换字符串中的匹配项。以下示例将字符串中的空格 ' ' 替换为 '-' :

import re
text = "PythonTab.com is a good Python website"
print re.sub(r'\s+', '-', text)


re.sub的函数原型为:re.sub(pattern, repl, string, count)

其中第二个函数是替换后的字符串;本例中为'-'

第四个参数是指替换的次数。默认为 0,表示替换每个匹配项。

re.sub 还允许使用函数复杂地处理匹配项的替换。如:re.sub(r'\s', lambda m: '[' + m.group(0) + ']', text, 0);用“[]”替换字符串中的空格“”。


re.split

可以使用re.split来分割字符串,如:re.split(r'\s+', text);按空格将字符串拆分为单词列表。


re.findall

re.findall 可以得到一个字符串中所有匹配的字符串。如:re.findall(r'\w*oo\w*', text);获取字符串中所有包含 'oo' 的单词。


re.compile

可以将正则表达式编译成正则表达式对象。将经常使用的正则表达式编译成正则表达式对象,可以提高一定的效率。下面是一个正则表达式对象的例子:

import re
text = "PythonTab is a good Python website"
regex = re.compile(r'\w*on\w*')
print regex.findall(text)   #查找所有包含'on'的单词
print regex.sub(lambda m: '[' + m.group(0) + ']', text) #将字符串中含有'on'的单词用[]括起来。

本文为原创文章,版权归所有,欢迎分享本文,转载请保留出处!

知行编程网
知行编程网 关注:1    粉丝:1
这个人很懒,什么都没写
扫一扫二维码分享