Python元字元的用法執行個體解析,python用法執行個體
反斜線的作用:
要想將一個元字元^當一個一般字元處理,加反斜線
例如:
>>>import re>>>r=r'\^abc'>>>re.findall(r,'^abc ^abc ^abc')['^abc','^abc','^abc']
\d匹配任何十進位數,它相當於類[0-9].
\D匹配任何非數字字元,它相當於類[^0-9]
\s匹配任何空白字元,他相當於類[\t\n\r\f\v]
\S匹配任何非空白字元,它相當於類[^\t\n\r\f\v]
\w匹配任何字母數字字元,它相當於類[a-zA-Z0-9_]
\W匹配任何非字母數字字元,它相當於類[^a-zA-Z0-9_]
>>>r=r'[0-9]'>>>re.findall(r,'1234567890')['1','2','3','4','5','6','7','8','9','0']>>>r=r'\d'>>>re.findall(r,'1234567890')['1','2','3','4','5','6','7','8','9','0']
>>>r=r'^010-\d\d\d\d\d\d\d\d'>>>re.findall(r,'010-87654321')['010-87654321']>>>re.findall(r,'010-8765432')[]>>>r=r'^010-\d{8}'#重複八次>>>re.findall(r,'010-12345678')['^010-12345678']
星號的作用:(*)
將前面的一個字元匹配零次或更多次。
>>>r=r'ab*'>>>re.findall(r,'a')['a']>>>re.findall(r,'ab')['ab']>>>re.findall(r,'abbbbbb')['abbbbbb']
加號的作用:(+)
表示匹配一次或更多次。
>>>r=r'ab+'>>>re.findall(r,'a')[]>>>re.findall(r,'ab')['ab']>>>re.findall(r,'abbbb')['abbbb']
電話號碼中間的“-”問題:(可有可無)
>>>r=r'^010-*\d{8}'>>>re.findall(r,'010-12345678')['010-12345678']>>>re.findall(r,'01012345678')['01012345678']>>>re.findall(r,'010---12345678')['010---12345678']
問號的作用:(?)
匹配一次或零次;
>>>r=r'^010-?\d{8}$'>>>re.findall(r,'010--12345678')[]>>>re.findall(r,'010-12345678')['010-12345678']>>>re.findall(r,'01012345678')['01012345678']
做最小模式比對:
貪婪模式比對如下:
>>>r=r'ab+'>>>re.findall(r,'abbbbbbbbbbb')['abbbbbbbbbbb']
非貪婪模式比對,用問號做最小匹配,如下:
>>>r=r'ab+?'>>>re.findall(r,'abbbbbbbbbbb')['ab']>>>r=r'ab*?'>>>re.findall(r,'abbbbbbbbbbbb')['a']
花括弧的用法:({m,n})
其中m和n是十進位整數。該限定符的意思是至少有m個重複,至多有n個重複。
>>>r=r'a{1,3}'#表示a重複一到三次>>>re.findall(r,'a')['a']>>>re.findall(r,'aa')['aa']>>>re.findall(r,'aaa')['aaa']>>>re.findall(r,'aaaa')['aaa','a']
分組:“(”和“)”
>>> import re>>> email=r'\w{3}@\w+(\.com|\.cn)'#定義正則,(\.com|\.cn)表示一個分組;分組中做**或**操作,要麼是.com,要麼是.cn>>> re.match(email,'www@owolf.com')#進行匹配<_sre.SRE_Match object; span=(0, 13), match='www@owolf.com'>>>> re.match(email,'www@owolf.cn')<_sre.SRE_Match object; span=(0, 12), match='www@owolf.cn'>>>> re.match(email,'www@owolf.org')>>> #返回空值>>> re.findall(email,'www@owolf.com')['.com'] #做匹配的時候優先返回分組中的資料>>> re.findall(email,'www@owolf.cn')['.cn']>>>
>>> s='''ajhfa kasjf owolf english=chinese yes no printlafl int=456 yes floatint=789 yesowolf english=france yes aklfl'''#定義字串>>> r=r'owolf english=.+ yes' #定義正則>>> re.findall(r,s) #匹配正則['owolf english=chinese yes', 'owolf english=france yes'] >>> r=r'owolf english=(.+) yes'>>> re.findall(r,s)['chinese', 'france'] #利用分組優先返回分組中的資料,在爬蟲中經常應用
總結
以上就是本文關於Python元字元的用法執行個體解析的全部內容,希望對大家有所協助。感興趣的朋友可以繼續參閱本站其他相關專題,如有不足之處,歡迎留言指出。感謝朋友們對本站的支援!