零基礎寫python爬蟲之爬蟲架構Scrapy安裝配置_python

來源:互聯網
上載者:User

前面十章爬蟲筆記陸陸續續記錄了一些簡單的Python爬蟲知識,
用來解決簡單的貼吧下載,績點運算自然不在話下。
不過要想批量下載大量的內容,比如知乎的所有的問答,那便顯得遊刃不有餘了點。
於是乎,爬蟲架構Scrapy就這樣出場了!
Scrapy = Scrach+Python,Scrach這個單詞是抓取的意思,

Scrapy的官網地址:點我點我。

那麼下面來簡單的示範一下Scrapy的安裝流程。
具體流程參照:http://www.jb51.net/article/48607.htm
友情提醒:一定要按照Python的版本下載,要不然安裝的時候會提醒找不到Python。建議大家安裝32位是因為有些版本的必備軟體64位不好找。

1.安裝Python(建議32位)

建議安裝Python2.7.x,3.x貌似還不支援。
安裝完了記得配置環境,將python目錄和python目錄下的Scripts目錄添加到系統內容變數的Path裡。
在cmd中輸入python如果出現版本資訊說明配置完畢。

2.安裝lxml

lxml是一種使用 Python 編寫的庫,可以迅速、靈活地處理 XML。點擊這裡選擇對應的Python版本安裝。

3.安裝setuptools

用來安裝egg檔案,點擊這裡下載python2.7的對應版本的setuptools。

4.安裝zope.interface

可以使用第三步下載的setuptools來安裝egg檔案,現在也有exe版本,點擊這裡下載。

5.安裝Twisted

Twisted是用Python實現的基於事件驅動的網路引擎架構,點擊這裡下載。

6.安裝pyOpenSSL

pyOpenSSL是Python的OpenSSL介面,點擊這裡下載。

7.安裝win32py

提供win32api,點擊這裡下載

8.安裝Scrapy

終於到了激動人心的時候了!安裝了那麼多小組件之後終於輪到主角登場。
直接在cmd中輸入easy_install scrapy斷行符號即可。

9.檢查安裝

開啟一個cmd視窗,在任意位置執行scrapy命令,得到下列頁面,表示環境配置成功。

聯繫我們

該頁面正文內容均來源於網絡整理,並不代表阿里雲官方的觀點,該頁面所提到的產品和服務也與阿里云無關,如果該頁面內容對您造成了困擾,歡迎寫郵件給我們,收到郵件我們將在5個工作日內處理。

如果您發現本社區中有涉嫌抄襲的內容,歡迎發送郵件至: info-contact@alibabacloud.com 進行舉報並提供相關證據,工作人員會在 5 個工作天內聯絡您,一經查實,本站將立刻刪除涉嫌侵權內容。

A Free Trial That Lets You Build Big!

Start building with 50+ products and up to 12 months usage for Elastic Compute Service

  • Sales Support

    1 on 1 presale consultation

  • After-Sales Support

    24/7 Technical Support 6 Free Tickets per Quarter Faster Response

  • Alibaba Cloud offers highly flexible support services tailored to meet your exact needs.