python—網路爬蟲(Requests庫主要方法解析)

來源:互聯網
上載者:User

標籤:選項   nbsp   **kwargs   資料   時間   構造   完全   .com   put   

Requests庫主要方法解析
requests.request() 構造一個請求,支撐以下各方法的基礎方法

requests.request(method, url, **kwargs)
method: 請求方式,對應get/put/post等七種
url:擬擷取頁面的url連結
**kwargs: 控制訪問的參數共13個。
  requests.request(‘GET‘, url, **kwargs)
  requests.request(‘HEAD‘, url, **kwargs)
  requests.request(‘POST‘, url, **kwargs)
  requests.request(‘PUT‘, url, **kwargs)
  requests.request(‘PATCH‘, url, **kwargs)
  requests.request(‘DELETE‘, url, **kwargs)
  requests.request(‘OPTIONS‘, url, **kwargs)
其中,OPTIONS只是一種與http通訊的一個參數,與http協議無關,通常很少用到

requests.request(method, url, **kwargs)
**kwargs: 控制訪問的參數,均為可選項
params: 字典或位元組序列,作為參數增加到url中
>>> kv={‘key1‘:‘value1‘,‘key2‘:‘value2‘}
>>> r=requests.request(‘GET‘,‘http://python123.io/ws‘,params=kv)
>>> print(r.url)
http://python123.io/ws?key1=value1&key2=value2

data:字典、位元組序列或檔案對象,作為Request的內容
>>> kv={‘key1‘:‘value1‘,‘key2‘:‘value2‘}
>>> r=requests.request(‘POST‘,‘http://python123.io/ws‘,data=kv)
>>> body=‘主體內容‘
>>> r.requests.request(‘POST‘,‘http://python123.io/ws‘,data=body)

json:JSON格式的資料,作為Request的內容
>>> kv={‘key1‘:‘value1‘}
>>> r=requests.request(‘POST‘,‘http://python123.io/ws‘,json=kv)

headers:字典,HTTP定製頭
>>>hd={‘user-agent‘:‘Chrome/10‘}
>>>r=requests.request(‘POST‘,‘http://python123.io/ws‘,headers=hd)

cookies:字典或CookieJar, Request中的cookie
auth:元組,支援HTTP認證功能
files:字典類型,傳輸檔案
>>>fs={‘file‘:open(‘data.xls‘,‘rb‘)
>>>r=requests.request(‘POST‘,‘http://python123.io/ws‘, files=fs)

timeout:設定逾時間,秒為單位
>>>r=requests.request(‘GET‘,‘http://www.baidu.com‘,timeout=10)

proxies:字典類型,設定訪問Proxy 伺服器,可以增加登入認證
>>>pxs={‘http‘:‘http://user:[email protected]:1234‘, ‘https‘:‘https://10.10.10.1:4321‘ }
>>>r=requests.request(‘GET‘,‘http://www.baidu.com‘,proxies=pxs)

allow_redirects: True/False, 預設為True, 重新導向開關
stream: True/False,預設為True,擷取內容立即下載開關
varify:  True/False,預設為True,認證SSL認證開關
cert:本地SSL憑證路徑

requests.request(method,url,**kwargs)
**kwargs:控制訪問的參數(13個),均為可選項
params
data
json
headers
cookies
auth
files
timeout
proxies
allow_redirects
stream
verify
cert

requests.get(url, params=None,**kwargs)
url:擬擷取頁面的url連結
params:url中的額外參數,字典或位元組流格式,可選。
**kwargs: 12個控制訪問參數(就是request裡面對應的除了params參數之外的對應參數)

requests.head(url,**kwargs)
url:擬擷取頁面的url連結
**kwargs:13個控制訪問的參數(與request完全一樣)

requests.post(url,data=None, json=None,**kwargs)
url:擬擷取頁面的url連結
data:字典、位元組序列或檔案,Request的內容
json:JSON格式的資料,Request的內容
**kwargs:11個控制訪問的參數

requests.put(url,data=None,**kwargs)
url:擬擷取頁面的url連結
data:字典、位元組序列或檔案,Request的內容
**kwargs: 12個控制訪問參數。

requests.patch(url,data=None,**kwargs)
url:擬擷取頁面的url連結
data:字典、位元組序列或檔案,Request的內容
**kwargs:12個控制訪問參數。

requests.delete(url,**kwargs)
url:擬擷取頁面的url連結
**kwargs:13個控制訪問的參數。

python—網路爬蟲(Requests庫主要方法解析)

聯繫我們

該頁面正文內容均來源於網絡整理,並不代表阿里雲官方的觀點,該頁面所提到的產品和服務也與阿里云無關,如果該頁面內容對您造成了困擾,歡迎寫郵件給我們,收到郵件我們將在5個工作日內處理。

如果您發現本社區中有涉嫌抄襲的內容,歡迎發送郵件至: info-contact@alibabacloud.com 進行舉報並提供相關證據,工作人員會在 5 個工作天內聯絡您,一經查實,本站將立刻刪除涉嫌侵權內容。

A Free Trial That Lets You Build Big!

Start building with 50+ products and up to 12 months usage for Elastic Compute Service

  • Sales Support

    1 on 1 presale consultation

  • After-Sales Support

    24/7 Technical Support 6 Free Tickets per Quarter Faster Response

  • Alibaba Cloud offers highly flexible support services tailored to meet your exact needs.