LINUXRegex

來源:互聯網
上載者:User

標籤:linu

  Regex(Regular Expression)是一種字串處理的標準,對於系統管理員來說,正則是一門必修技。例如:系統產生資料量太大,身為系統管理員每天去看這麼多的資訊資料,從千百行的資料裡面找出一行有問題的資訊,怎麼辦? 這個時候,我們就可以透過Regex的功能,將這些登入的資訊進行處理,僅取出有問題的資訊來進行分析,如此一來,你的系統管理工作將會更加直觀,簡便!    

  Regex中我們常使用的命令,三劍客:grep、sed、awk。通常使用三劍客結合正則的特殊字元,來完成我們需要的操作。


選項與參數:-A :後面可加數字,為 after 的意思,除了列出該行外,後續的 n 行也列出來;-B :後面可加數字,為 befer 的意思,除了列出該行外,前面的 n 行也列出來;-C  :類似-A -B ,接數字,前後的n行列印;--color=auto 可將正確的那個擷取資料列出顏色;(使用alias grep=‘grep --color=auto‘ ,添加到~/.bashrc永久生效)-i  :忽略匹配字元的大小寫;-v  :將未被匹配的行列印;-n  :輸出行號;-o  :僅列印匹配的欄位而不是行,用來統計匹配到多少次-E  :此時相當於egrep,使用擴充的Regex

介紹玩grep常用選項後,結合grep來看看基礎正則常用的特殊字元。


Regex特殊字元歸納

  • ^word 意義:待搜尋的字串(word)在行首!

 範例:搜尋行首為 # 開始的那一行,並列出行號 

grep -n ‘^#‘ filename 


  • word$ 意義:待搜尋的字串(word)在行尾!

 範例:將行尾為 ! 的那一行列印出來,並列出行號 

grep -n ‘!$‘ filename 

  • ^$ 意義:空白行,開頭之後就是結尾當然是空行了!


  • . 意義:代表『一定有一個任意位元組』的字元!

 範例:搜尋的字串可以是 (eve) (eae) (eee) (e e), 但不能僅有 (ee) !亦即 e 與 e 中間『一定』僅有一個位元組,而空白位元組也是位元組! 

grep -n ‘e.e‘ filename 


  • \ 意義:跳脫字元,將特殊符號的特殊意義去除!

 範例:搜尋含有單引號 ‘ 的那一行! 

grep -n \‘ filename 


  • * 意義:重複零個到無窮多個的前一個 RE 字元

 範例:找出含有 (es) (ess) (esss) 等等的字串,注意,因為 * 可以是 0 個,所以 es 也是符合帶搜尋字串。另外,因為 * 為重複『前一個 RE 字元』的符號, 因此,在 * 之前必須要緊接著一個 RE 字元喔!例如任意位元組則為 『.*』 ! 

grep -n ‘ess*‘ filename


  • [list] 意義:位元組集合的 RE 字元,裡面列出想要擷取的位元組!

 範例:搜尋含有 (gl) 或 (gd) 的那一行,需要特別留意的是,在 [] 當中『謹代表一個待搜尋的位元組』, 例如『 a[afl]y 』代表搜尋的字串可以是 aay, afy, aly 即 [afl] 代表 a 或 f 或 l 的意思! 

grep -n ‘g[ld]‘ filename 


  • [n1-n2] 意義:位元組集合的 RE 字元,裡面列出想要擷取的位元組範圍!

 範例:搜尋含有任一數字的那一行!需特別留意,在位元組集合 [] 中的減號 - 是有特殊意義的,他代表兩個位元組之間的所有連續位元組!但這個連續與否與 ASCII 編碼有關,因此,你的編碼需要配置正確(在 bash 當中,需要確定 LANG 與 LANGUAGE 的變數是否正確!) 例如所有大寫位元組則為 [A-Z] 

grep -n ‘[A-Z]‘ filename 


  • [^list] 意義:位元組集合的 RE 字元,裡面列出不要的字串或範圍!

 範例:搜尋的字串可以是 (oog) (ood) 但不能是 (oot) ,那個 ^ 在 [] 內時,代表的意義是『反向選擇』的意思。 例如,我不要大寫位元組,則為 [^A-Z]。但是,需要特別注意的是,如果以 grep -n [^A-Z] regular_express.txt 來搜尋,卻發現該檔案內的所有行都被列出,為什嗎?因為這個 [^A-Z] 是『非大寫位元組』的意思, 因為每一行均有非大寫位元組,例如第一行的 "Open Source" 就有 p,e,n,o.... 等等的小寫字 

grep -n ‘oo[^t]‘ filename 


  • \{n,m\} 意義:連續 n 到 m 個的『前一個 RE 字元』

 意義:若為 \{n\} 則是連續 n 個的前一個 RE 字元,

 意義:若是 \{n,\} 則是連續 n 個以上的前一個 RE 字元! 範例:在 g 與 g 之間有 2 個到 3 個的 o 存在的字串,亦即 (goog)(gooog) 

grep -n ‘go\{2,3\}g‘ filename 


  • \<和\> 意義:

    \<後面接的字元必須是一個單詞最前部分;

    \>前面接的字元必須是一個單詞的最後部分;

    注意:一個單詞定義的是:字母、數字、底線的組合

    所以\<word\>必須是單獨的word單詞才會匹配,其他符號如: ()/等都會視為單詞分割號

  • 分組\( \) 意義:

    小括弧的內容作為整體,如\(ab\)* 匹配0個到無窮個ab

    範例:test檔案內容如下:

    love:lover

    love:liker

    like:lover

    like:liker

    如何取出1和4行?

    在使用分組功能時,我們可以通過\1 \2 \3 ...來引用,所以:

    grep ‘\(.*\):\1r‘ test


本文出自 “SweetSmile” 部落格,請務必保留此出處http://daizhancheng.blog.51cto.com/9708457/1632044

LINUXRegex

聯繫我們

該頁面正文內容均來源於網絡整理,並不代表阿里雲官方的觀點,該頁面所提到的產品和服務也與阿里云無關,如果該頁面內容對您造成了困擾,歡迎寫郵件給我們,收到郵件我們將在5個工作日內處理。

如果您發現本社區中有涉嫌抄襲的內容,歡迎發送郵件至: info-contact@alibabacloud.com 進行舉報並提供相關證據,工作人員會在 5 個工作天內聯絡您,一經查實,本站將立刻刪除涉嫌侵權內容。

A Free Trial That Lets You Build Big!

Start building with 50+ products and up to 12 months usage for Elastic Compute Service

  • Sales Support

    1 on 1 presale consultation

  • After-Sales Support

    24/7 Technical Support 6 Free Tickets per Quarter Faster Response

  • Alibaba Cloud offers highly flexible support services tailored to meet your exact needs.