本文來說說Python的Regex。
廢話不多說了,先開始最簡單的:
'.':可以匹配除分行符號以外的任意單個字元(就是個點)。
'*'可以匹配前面的子運算式零次或多次(就是個星號)。
所以上面兩個的組合'.*'(點星)就是匹配除分行符號以外的所有。
'+':重複一次或更多次。
'?':重複零次或一次。
'\d':匹配一個數字字元。等價於 [0-9]。
'\w'匹配包括底線的任何單詞字元。等價於'[A-Za-z0-9_]'。
'/s'匹配任何空白字元,包括空格、定位字元、換頁符等等。等價於 [ \f\n\r\t\v]
'^'匹配輸入字串的開始位置。
'$'匹配輸入字串的結束位置。
上面這幾個超級常用,當然常用的還有很多,需要的時候請查手冊。
這樣描述不夠直觀,直接敲實驗。想在Python裡使用Regex很簡單,直接匯入re即可:
>>> import re
>>>
先試試匹配所有:
>>> vlan = 'switchport access vlan 612'>>> ljds = re.search('.*',vlan).group()>>> ljds'switchport access vlan 612'
再試試匹配數字:
>>> ljds = re.search('\d',vlan).group()>>> ljds'6'
因為'/d'是匹配一個數字,所以如果要匹配這裡的‘612’,三個數字,可以加上'{3}':
>>> ljds = re.search('\d{3}',vlan).group()>>> ljds
'612'
同理,如果要匹配13個字元(包括空格):
>>> ljds = re.search('[\w\s]{13}',vlan).group()>>> ljds'switchport ac'
這裡還想提一下Regex的量詞裡面涉及到貪婪和非貪婪模式,貪婪就是取最大值,儘可能多的匹配。非貪婪就正好相反(預設是貪婪模式)。舉例說明:
剛才上面是匹配13個字元,如果寫成匹配2到10個字元就寫成:'[\w\s]{2,10}'即可,那麼到底匹配的是2個還是10個呢?因為預設是貪婪模式,它會最大的匹配:
>>> ljds = re.search('[\w\s]{2,10}',vlan).group()>>> ljds'switchport'
在量詞後面加個問號'?',就切換到了非貪婪模式,即最小匹配:
>>> ljds = re.search('[\w\s]{2,10}?',vlan).group()>>> ljds'sw'
接下來介紹一下“捕獲”了:
(exp):匹配exp。
(?=exp):匹配exp前面的位置。
(?<=exp):匹配exp後面的位置。
>>> vlan = 'switchport access vlan 612'
最基礎的:
>>> ljds = re.search('(access)',vlan).group()>>> ljds'access'
匹配'access'之前的任一字元:
>>> ljds = re.search('.*(?=access)',vlan).group()>>> ljds'switchport '
匹配'vlan'之後的任一字元:
>>> ljds = re.search('(?<=vlan).*',vlan).group()>>> ljds' 612'
OK,學到這裡,再看看之前捕獲路由器名稱的Regex:
DeviceName = re.search('.*(?=#show run)',telreply).group()
以上就是PythonRegex【1】的內容,更多相關內容請關注topic.alibabacloud.com(www.php.cn)!