urlparse模組(python模組)

來源:互聯網
上載者:User

標籤:urlparse python

一、urlparse模組簡介

    urlparse模組主要是把url拆分為6部分,並返回元組。並且可以把拆分後的部分再組成一個url。主要有函數有urljoin、urlsplit、urlunsplit、urlparse等。


二、urljoin函數使用

    urljoin主要是拼接URL,它以base作為其基地址,然後與url中的相對位址相結合組成一個絕對URL地址。函數urljoin在通過為URL基地址附加新的檔案名稱的方式來處理同一位置處的若干檔案的時候格外有用。需要注意的是,如果基地址並非以字元/結尾的話,那麼URL基地址最右邊部分就會被這個相對路徑所替換。如果希望在該路徑中保留末端目錄,應確保URL基地址以字元/結尾。

輸入代碼:

import urlparse#urljoin函數是合併欄位名和相對路徑的urljoin = urlparse.urljoin(‘http://www.sina.cn/cc‘,‘file/down.php‘)print urljoinurljoin1 = urlparse.urljoin(‘http://www.sina.cn/cc/‘,‘file/down.php‘)print urljoin1



代碼運行結果:

C:\Python27\python.exe C:/Users/Lee/Desktop/d/PycharmProjects/untitled/test.py

http://www.sina.cn/file/down.php

http://www.sina.cn/cc/file/down.php


三、urlparse函數和urlsplit函數使用

    主要是分析urlstring,返回一個包含5個字串項目的元組:協議、位置、路徑、查詢、片段。allow_fragments為False時,該元組的組後一個項目總是空,不管urlstring有沒有片段,省略項目的也是空。urlsplit()和urlparse()差不多

輸入代碼:

import urlparse

url = ‘http://www.baidu.com/good/index.php?id=18‘

#urlsplit函數是把一個url查分出對應部分
result = urlparse.urlsplit(url)
print result
#顯示協議
print result.scheme
#顯示網域名稱
print result.netloc
#顯示相對路徑
print result.path
#顯示查詢參數
print result.query



代碼運行結果:

C:\Python27\python.exe C:/Users/Lee/Desktop/d/PycharmProjects/untitled/test.py

SplitResult(scheme=‘http‘, netloc=‘www.baidu.com‘, path=‘/good/index.php‘, query=‘id=18‘, fragment=‘‘)

http

www.baidu.com

/good/index.php

id=18









urlparse模組(python模組)

聯繫我們

該頁面正文內容均來源於網絡整理,並不代表阿里雲官方的觀點,該頁面所提到的產品和服務也與阿里云無關,如果該頁面內容對您造成了困擾,歡迎寫郵件給我們,收到郵件我們將在5個工作日內處理。

如果您發現本社區中有涉嫌抄襲的內容,歡迎發送郵件至: info-contact@alibabacloud.com 進行舉報並提供相關證據,工作人員會在 5 個工作天內聯絡您,一經查實,本站將立刻刪除涉嫌侵權內容。

A Free Trial That Lets You Build Big!

Start building with 50+ products and up to 12 months usage for Elastic Compute Service

  • Sales Support

    1 on 1 presale consultation

  • After-Sales Support

    24/7 Technical Support 6 Free Tickets per Quarter Faster Response

  • Alibaba Cloud offers highly flexible support services tailored to meet your exact needs.