Python元字元的用法執行個體解析,python用法執行個體

來源:互聯網
上載者:User

Python元字元的用法執行個體解析,python用法執行個體

反斜線的作用:

要想將一個元字元^當一個一般字元處理,加反斜線

例如:

>>>import re>>>r=r'\^abc'>>>re.findall(r,'^abc ^abc ^abc')['^abc','^abc','^abc']

\d匹配任何十進位數,它相當於類[0-9].
\D匹配任何非數字字元,它相當於類[^0-9]
\s匹配任何空白字元,他相當於類[\t\n\r\f\v]
\S匹配任何非空白字元,它相當於類[^\t\n\r\f\v]
\w匹配任何字母數字字元,它相當於類[a-zA-Z0-9_]
\W匹配任何非字母數字字元,它相當於類[^a-zA-Z0-9_]

>>>r=r'[0-9]'>>>re.findall(r,'1234567890')['1','2','3','4','5','6','7','8','9','0']>>>r=r'\d'>>>re.findall(r,'1234567890')['1','2','3','4','5','6','7','8','9','0']
>>>r=r'^010-\d\d\d\d\d\d\d\d'>>>re.findall(r,'010-87654321')['010-87654321']>>>re.findall(r,'010-8765432')[]>>>r=r'^010-\d{8}'#重複八次>>>re.findall(r,'010-12345678')['^010-12345678']

星號的作用:(*)

將前面的一個字元匹配零次或更多次。

>>>r=r'ab*'>>>re.findall(r,'a')['a']>>>re.findall(r,'ab')['ab']>>>re.findall(r,'abbbbbb')['abbbbbb']

加號的作用:(+)

表示匹配一次或更多次。

>>>r=r'ab+'>>>re.findall(r,'a')[]>>>re.findall(r,'ab')['ab']>>>re.findall(r,'abbbb')['abbbb']

電話號碼中間的“-”問題:(可有可無)

>>>r=r'^010-*\d{8}'>>>re.findall(r,'010-12345678')['010-12345678']>>>re.findall(r,'01012345678')['01012345678']>>>re.findall(r,'010---12345678')['010---12345678']

問號的作用:(?)

匹配一次或零次;

>>>r=r'^010-?\d{8}$'>>>re.findall(r,'010--12345678')[]>>>re.findall(r,'010-12345678')['010-12345678']>>>re.findall(r,'01012345678')['01012345678']

做最小模式比對:

貪婪模式比對如下:

>>>r=r'ab+'>>>re.findall(r,'abbbbbbbbbbb')['abbbbbbbbbbb']

非貪婪模式比對,用問號做最小匹配,如下:

>>>r=r'ab+?'>>>re.findall(r,'abbbbbbbbbbb')['ab']>>>r=r'ab*?'>>>re.findall(r,'abbbbbbbbbbbb')['a']

花括弧的用法:({m,n})

其中m和n是十進位整數。該限定符的意思是至少有m個重複,至多有n個重複。

>>>r=r'a{1,3}'#表示a重複一到三次>>>re.findall(r,'a')['a']>>>re.findall(r,'aa')['aa']>>>re.findall(r,'aaa')['aaa']>>>re.findall(r,'aaaa')['aaa','a']

分組:“(”和“)”

>>> import re>>> email=r'\w{3}@\w+(\.com|\.cn)'#定義正則,(\.com|\.cn)表示一個分組;分組中做**或**操作,要麼是.com,要麼是.cn>>> re.match(email,'www@owolf.com')#進行匹配<_sre.SRE_Match object; span=(0, 13), match='www@owolf.com'>>>> re.match(email,'www@owolf.cn')<_sre.SRE_Match object; span=(0, 12), match='www@owolf.cn'>>>> re.match(email,'www@owolf.org')>>>  #返回空值>>> re.findall(email,'www@owolf.com')['.com']      #做匹配的時候優先返回分組中的資料>>> re.findall(email,'www@owolf.cn')['.cn']>>> 
>>> s='''ajhfa kasjf owolf english=chinese yes  no printlafl int=456 yes floatint=789 yesowolf english=france yes  aklfl'''#定義字串>>> r=r'owolf english=.+ yes' #定義正則>>> re.findall(r,s)    #匹配正則['owolf english=chinese yes', 'owolf english=france yes']     >>> r=r'owolf english=(.+) yes'>>> re.findall(r,s)['chinese', 'france'] #利用分組優先返回分組中的資料,在爬蟲中經常應用

總結

以上就是本文關於Python元字元的用法執行個體解析的全部內容,希望對大家有所協助。感興趣的朋友可以繼續參閱本站其他相關專題,如有不足之處,歡迎留言指出。感謝朋友們對本站的支援!

聯繫我們

該頁面正文內容均來源於網絡整理,並不代表阿里雲官方的觀點,該頁面所提到的產品和服務也與阿里云無關,如果該頁面內容對您造成了困擾,歡迎寫郵件給我們,收到郵件我們將在5個工作日內處理。

如果您發現本社區中有涉嫌抄襲的內容,歡迎發送郵件至: info-contact@alibabacloud.com 進行舉報並提供相關證據,工作人員會在 5 個工作天內聯絡您,一經查實,本站將立刻刪除涉嫌侵權內容。

A Free Trial That Lets You Build Big!

Start building with 50+ products and up to 12 months usage for Elastic Compute Service

  • Sales Support

    1 on 1 presale consultation

  • After-Sales Support

    24/7 Technical Support 6 Free Tickets per Quarter Faster Response

  • Alibaba Cloud offers highly flexible support services tailored to meet your exact needs.