Time of Update: 2017-02-27
下午群友們上了一個題,下面貼上來圖:只不過了一會,各路大神的答案開始噴湧出來,下面貼下各種答案:1: for i in {111..999..111}2: do3:4: for j in {1..9..1}5: do6: c=`expr $i / $j`7:8:
Time of Update: 2017-02-27
首先要說明這其實是一個不可能完成的任務,至少不是一片博文就能完成的任務。避免浪費看到標題而滿心期待同道的時間。主要是想以Apache為藍本,通過Python指令碼的方式一步一步實現Apache的核心功能。進而瞭解Python網路編程以及有關於Web服務效能相關的方方面面。閑言少敘,直接上代碼!import
Time of Update: 2017-02-27
寒假期間學習了python,現在基本上就能上手使用它來解決project euler裡面的題目了,用python真的是沒得說的,一個字“贊”。在C++中需要用一大堆代碼實現的演算法,在python中,只需要那麼短短几行。而且還有驚豔的運行速度。借用《可愛的python》裡面的一句話:“人生苦短,我用python”。【project euler 055】求經過一系列規則不能得到迴文數的數的個數。題目在此:If we take 47, reverse
Time of Update: 2017-02-27
儘管Python事實上並不是一門純函數式程式設計語言,但它本身是一門多範型語言,並給了你足夠的自由利用函數式編程的 便利。函數式風格有著各種理論與實際上的好處(你可以在Python的文檔中找到這個列表):形式上可證模組性組合性易於調試及測試雖然這份列表已經描述得夠清楚了,但我還是很喜歡Michael O.Church在他的文章“函數式程式極少腐壞(Functional programs rarely rot)”中對函數式編程的優點所作的描述。我在PyCon UA 2
Time of Update: 2017-02-27
Django的特點Django的主要目的是簡便、快速地開發資料庫驅動的網站——動態網站。它強調代碼複用,多個組件可以方便地以“外掛程式”形式服務於整個架構,因此它有許多功能強大的第三方外掛程式。Django強調快速開發,用Django開發一個Web網站非常迅速。Django的實際應用Django最著名的應用是Google App Engine,Google App Engine 是一種讓您可以在 Google
Time of Update: 2017-02-27
1、什麼是網路爬蟲網路爬蟲是現代搜尋引擎技術的一種非常核心、基礎的技術,網路就好比是一張蜘蛛網,網路爬蟲就像是一隻蜘蛛,在網路間‘爬來爬去’,搜尋有用的資訊。2、抓取Proxy 伺服器的網路爬蟲本文介紹用python實現抓取Proxy
Time of Update: 2017-02-27
Django Web架構簡介Django 項目是一個 python[1]定製架構,它源自一個線上新聞 Web 網站,於 2005 年以開源的形式被釋放出來。Django 架構的核心組件有:用於建立模型的對象關係映射為終端使用者設計的完美管理介面一流的 URL
Time of Update: 2017-02-27
Python 提供了幾個用於多線程編程的模組,包括thread, threading 和Queue 等。thread 和threading 模組允許程式員建立和管理線程。thread 模組提供了基本的線程和鎖的支援,而threading提供了更進階別,功能更強的線程管理的功能。Queue
Time of Update: 2017-02-27
1、lambda()lambda()是Python裡的匿名函數,其文法如下:lambda [arg1[, arg2, ... argN]]: expression下面是個1+2=3的例子>>> fun = lambda x,y:x+y>>> fun(1,2)3>>> (lambda x,y:x+y)(1,2)32、filter()filter(function,
Time of Update: 2017-02-27
大多數編譯型語言,變數在使用前必須先聲明,其中的 C 語言更加苛刻:變數聲明必須位於代碼塊最開始,且在任何其他語句之前。其它語言,像C++和Java,允許“隨時隨地”聲明變數,比如,變數聲明可以在代碼塊的中間,不過仍然必須在變數被使用前聲明變數的名字和類型。在Python 中,無需此類顯式變數聲明語句,變數在第一次被賦值時自動聲明,Python 中不但變數名無需事先聲明,而且也無需型別宣告。Python
Time of Update: 2017-02-27
1. 首先,通過wget下載Python安裝包[root@TDDBA ~]# wget http://www.python.org/ftp/python/2.7.3/Python-2.7.3.tgz2. 解壓該檔案[root@TDDBA python]# tar -zxvf Python-2.7.3.tgz[root@TDDBA python]# lsPython-2.7.3 Python-2.7.3.tgz3. 配置安裝路徑[root@TDDBA Python-2.7.3]# ./
Time of Update: 2017-02-27
1. Socket基礎用戶端與伺服器串連有兩種方式:TCP和UDP,TCP是連線導向的方式(三向交握、四次揮手等),可靠但耗資源,而UDP採用無串連方式,不可靠但速度快。這裡面的學問很多,但大部分人知道這些就足夠了2. 一個簡單的TCP例子(阻塞方式)不管是Python還是其它語言,Socket編程幾乎都有一個固定模板,下面看一個簡單例子,用於計算階乘和,比如用戶端發送5,伺服器端返回5!+4!+3!+2!+1!。Server端Python代碼:import socket sock =
Time of Update: 2017-02-27
百度貼吧的爬蟲製作和糗百的爬蟲製作原理基本相同,都是通過查看源碼扣出關鍵資料,然後將其儲存到本地txt檔案。項目內容:用Python寫的百度貼吧的網路爬蟲。使用方法:建立一個BugBaidu.py檔案,然後將代碼複製到裡面後,雙擊運行。程式功能:將貼吧中樓主發布的內容打包txt儲存到本地。原理解釋:首先,先瀏覽一下某一條貼吧,點擊只看樓主並點擊第二頁之後url發生了一點變化,變成了:http://tieba.baidu.com/p/2296712428?see_lz=1&pn=1可以看出
Time of Update: 2017-02-27
項目內容:用Python寫的糗事百科的網路爬蟲。使用方法:建立一個Bug.py檔案,然後將代碼複製到裡面後,雙擊運行。程式功能:在命令提示行中瀏覽糗事百科。原理解釋:首先,先瀏覽一下糗事百科的首頁:http://www.qiushibaike.com/hot/page/1可以看出來,連結中page/後面的數字就是對應的頁碼,記住這一點為以後的編寫做準備。然後,右擊查看頁面源碼:觀察發現,每一個段子都用center標記,其中class必為content,title是發帖時間,我們只需要用Regex
Time of Update: 2017-02-27
接下來準備用糗百做一個爬蟲的小例子。但是在這之前,先詳細的整理一下Python中的Regex的相關內容。Regex在Python爬蟲中的作用就像是老師點名時用的花名冊一樣,是必不可少的神兵利器。一、
Time of Update: 2017-02-27
# -*- coding: utf-8 -*- #--------------------------------------- # 程式:百度貼吧爬蟲 # 版本:0.1 # 作者:why # 日期:2013-05-14 # 語言:Python 2.7 # 操作:輸入帶分頁的地址,去掉最後面的數字,設定一下起始頁數和終點頁數。 # 功能:下載對應頁碼內的所有頁面並儲存為html檔案。 #--------------------------------
Time of Update: 2017-02-27
前面說到了urllib2的簡單入門,下面整理了一部分urllib2的使用細節。1.Proxy 的設定urllib2 預設會使用環境變數 http_proxy 來設定 HTTP Proxy。如果想在程式中明確控制 Proxy 而不受環境變數的影響,可以使用代理。建立test14來實現一個簡單的代理Demo:import urllib2 enable_proxy = Trueproxy_handler = urllib2.ProxyHandler({"http" :
Time of Update: 2017-02-27
在開始後面的內容之前,先來解釋一下urllib2中的兩個個方法:info and
Time of Update: 2017-02-27
先來說一說HTTP的異常處理問題。當urlopen不能夠處理一個response時,產生urlError。不過通常的Python APIs異常如ValueError,TypeError等也會同時產生。HTTPError是urlError的子類,通常在特定HTTP
Time of Update: 2017-02-27
所謂網頁抓取,就是把URL地址中指定的網路資源從網路流中讀取出來,儲存到本地。類似於使用程式類比IE瀏覽器的功能,把URL作為HTTP請求的內容發送到伺服器端, 然後讀取伺服器端的響應資源。在Python中,我們使用urllib2這個組件來抓取網頁。urllib2是Python的一個擷取URLs(Uniform Resource Locators)的組件。它以urlopen函數的形式提供了一個非常簡單的介面。最簡單的urllib2的應用代碼只需要四行。我們建立一個檔案urllib2_test01