Python Regex的進階用法_python

來源:互聯網
上載者:User

對於Python來說,學習正則就要學習模組re的使用方法。本文將展示一些大家都應該掌握的進階技巧。

編譯正則對象

re.compile函數根據一個模式字串和可選的標誌參數產生一個Regex對象。該對象擁有一系列方法用於Regex匹配和替換。用法上略有區別,舉個例子, 匹配一個字串可用如下方式:

如果使用compile,將變成:

為什麼要這麼用呢?其實就是為了提高正則匹配的速度,重複利用Regex對象。我們對比一下2種方式的效率:

可以看到第二種方式要快很多。在實際的工作中你會發現越多的使用編譯好的Regex對象,效果就越好。

分組(group)

你可能已經見過對匹配的內容進行分組的用法了:

通過對要匹配的對象添加括弧,就可以精確的對應符合的結果了。我們還可以進行嵌套的分組:

分組可以滿足需求,但是有時候可讀性很差,那可以對分組進行命名:

現在可讀性就非常高了。

字串匹配

學過sed的同學可能見過如下替換用法:

這個\1表示前面正則匹配到的結果。上面的sed也就是給匹配到的結果加上中括弧。

在re模組中也存在這樣的用法:

用命名分組也是可以的:

附近匹配(Look around)

re模組也支援附近匹配,看看例子就懂了:

正則匹配的時候使用函數

之前我們看到的大部分內容都是匹配的是一個運算式,但是有時候需求要複雜得多,尤其是在替換的時候。

舉個例子,通過Slack的API能擷取聊天記錄,比如下面這句:

其中<@U1EAT8MG9>和<@U0K1MF23Z>是2個真實的使用者,但是被Slack封裝了,需要通過其他介面擷取這個對應關係,

其結果類似這樣:

在解析對應關係之後,還希望吧角括弧也去掉,替換後的結果是「@xiaoming, @laolin 嗯 確實是這樣的 」

用正則怎麼實現呢?

所以pattern當然也可以是一個函數

聯繫我們

該頁面正文內容均來源於網絡整理,並不代表阿里雲官方的觀點,該頁面所提到的產品和服務也與阿里云無關,如果該頁面內容對您造成了困擾,歡迎寫郵件給我們,收到郵件我們將在5個工作日內處理。

如果您發現本社區中有涉嫌抄襲的內容,歡迎發送郵件至: info-contact@alibabacloud.com 進行舉報並提供相關證據,工作人員會在 5 個工作天內聯絡您,一經查實,本站將立刻刪除涉嫌侵權內容。

A Free Trial That Lets You Build Big!

Start building with 50+ products and up to 12 months usage for Elastic Compute Service

  • Sales Support

    1 on 1 presale consultation

  • After-Sales Support

    24/7 Technical Support 6 Free Tickets per Quarter Faster Response

  • Alibaba Cloud offers highly flexible support services tailored to meet your exact needs.