python解析基於xml格式的記錄檔,pythonxml記錄檔

來源:互聯網
上載者:User

python解析基於xml格式的記錄檔,pythonxml記錄檔

大家中午好,由於過年一直還沒回到狀態,好久沒分享一波小知識了,今天,繼續給大家分享一波Python解析日誌的小指令碼。

首先,同樣的先看看日誌是個啥樣。

都是xml格式的,是不是看著就頭暈了??沒事,我們先來分析一波。

1.每一段開頭都是catalina-exec,那麼我們就按catalina-exec來分,分了之後,他們就都是一段一段的了。

2.然後,我們再在已經分好的一段段裡面分,找出你要分割的關鍵字,因為是xml的,所以,接下來的工作就簡單了,都是一個頭一個尾的。

3.但是還有一個問題,有可能有的裡面沒有你想要的關鍵字,所以你要判斷下,如果沒有這個欄位,那麼我就把這個欄位設定為空白。

思路清晰了,代碼自然而然就簡單了。

接下來我們就看看代碼

#coding:utf-8 import re #文本所在TXT檔案 file = 'iag_interface.log' #分割一段 xml1='catalina-exec' xml2='catalina-exec' #關鍵字reqtimestamp time1 = '<timestamp>' time2 = '</timestamp>' #關鍵字functionid functionid1 = '<functionid>' functionid2 = '</functionid>' #關鍵字transid transid1='<transid>' transid2='</transid>' #關鍵字siappid siappid1='<siappid>' siappid2='</siappid>' #關鍵字userid userid1='<userid>' userid2='</userid>' #關鍵字mobnum mobnum1='<mobnum>' mobnum2='</mobnum>' f = open(file,'r',encoding= 'utf-8') #f = open(file,'r') #for (num,value) in enumerate(f):  #print("line number",num,"is:",value) buff = f.read() #清除分行符號,請取消下一行注釋 #buff = buff.replace('\n','') pat = re.compile(time1+'(.*?)'+time2,re.S) pat1 = re.compile(functionid1+'(.*?)'+functionid2,re.S) pat2 = re.compile(transid1+'(.*?)'+transid2,re.S) pat3 = re.compile(siappid1+'(.*?)'+siappid2,re.S) pat4 = re.compile(userid1+'(.*?)'+userid2,re.S) pat5 = re.compile(mobnum1+'(.*?)'+mobnum2,re.S) pat6=re.compile(xml1+'(.*?)'+xml2,re.S) result6 = pat6.findall(buff) print(len(result6)) x = open("logfx.txt", 'w') x.write("===========================開始資料================================="+"\n") x.write("time"+"\t"+"functionid"+"\t"+"transid"+"\t"+"siappid"+"\t"+"userid"+"\t"+"mobnum"+"\n") for i in range(0,len(result6)):  result = pat.findall(result6[i])  result1 = pat1.findall(result6[i])  result2 = pat2.findall(result6[i])  result3 = pat3.findall(result6[i])  result4 = pat4.findall(result6[i])  result5 = pat5.findall(result6[i])  if len(result)==0:   result.append("空")  if len(result1)==0:   result1.append("空")  if len(result2)==0:   result2.append("空")  if len(result3)==0:   result3.append("空")  if len(result4)==0:   result4.append("空")  if len(result5)==0:   result5.append("空")  #print(result[0],"=",result1[0],"=",result2[0],"=",result3[0],"=",result4[0],"=",result5[0])  x.write("timestamp:"+result[0]+"\t"+result1[0]+"\t"+result2[0]+"\t"+result3[0]+"\t"+result4[0]+"\t"+"mobnum:"+result5[0]+"\n") x.write("===========================結束資料================================="+"\n")  print("執行完畢!組建檔案logfx.txt") x.close() 

運行下代碼

python解析基於xml格式的記錄檔把所有資料運行成功了。接下來查看檔案

好了。

以上就是本文的全部內容,希望對大家的學習有所協助,也希望大家多多支援幫客之家。

聯繫我們

該頁面正文內容均來源於網絡整理,並不代表阿里雲官方的觀點,該頁面所提到的產品和服務也與阿里云無關,如果該頁面內容對您造成了困擾,歡迎寫郵件給我們,收到郵件我們將在5個工作日內處理。

如果您發現本社區中有涉嫌抄襲的內容,歡迎發送郵件至: info-contact@alibabacloud.com 進行舉報並提供相關證據,工作人員會在 5 個工作天內聯絡您,一經查實,本站將立刻刪除涉嫌侵權內容。

A Free Trial That Lets You Build Big!

Start building with 50+ products and up to 12 months usage for Elastic Compute Service

  • Sales Support

    1 on 1 presale consultation

  • After-Sales Support

    24/7 Technical Support 6 Free Tickets per Quarter Faster Response

  • Alibaba Cloud offers highly flexible support services tailored to meet your exact needs.