Time of Update: 2017-01-19
先來說一說HTTP的異常處理問題。當urlopen不能夠處理一個response時,產生urlError。不過通常的Python APIs異常如ValueError,TypeError等也會同時產生。HTTPError是urlError的子類,通常在特定HTTP
Time of Update: 2017-01-19
版本號碼:Python2.7.5,Python3改動較大,各位另尋教程。所謂網頁抓取,就是把URL地址中指定的網路資源從網路流中讀取出來,儲存到本地。 類似於使用程式類比IE瀏覽器的功能,把URL作為HTTP請求的內容發送到伺服器端, 然後讀取伺服器端的響應資源。在Python中,我們使用urllib2這個組件來抓取網頁。urllib2是Python的一個擷取URLs(Uniform Resource
Time of Update: 2017-01-19
我第一次接觸爬蟲這東西是在今年的5月份,當時寫了一個部落格搜尋引擎,所用到的爬蟲也挺智能的,起碼比電影來了這個站用到的爬蟲水平高多了!回到用Python寫爬蟲的話題。Python一直是我主要使用的指令碼語言,沒有之一。Python的語言簡潔靈活,標準庫功能強大,平常可以用作計算機,文本編碼轉換,圖片處理,批量下載,批量處理文本等。總之我很喜歡,也越用越上手,這麼好用的一個工具,一般人我不告訴他。。。因為其強大的字串處理能力,以及urllib2,cookielib,re,threading這些模組
Time of Update: 2017-01-19
複製代碼 代碼如下:#!/usr/bin/env python##-*- coding: utf-8 -*- import os print
Time of Update: 2017-01-19
複製代碼 代碼如下:import randomprint random.random()擷取一個小於1的浮點數複製代碼 代碼如下:import randomrandom.randint(1,10)擷取一個從1到10的整數複製代碼 代碼如下:import randomprint random.uniform(0,2)擷取一個大於0小於2的浮點數複製代碼 代碼如下:import randomprint random.randrange(1,10,4)擷取一個從1到10步長為4的隨機數複製代碼
Time of Update: 2017-01-19
本文執行個體講述了python擷取Linux下檔案版本資訊、公司名和產品名的方法,分享給大家供大家參考。具體如下:區別於前文所述。本例是在linux下得到檔案版本資訊,主要是通過pefile模組解析檔案 中的字串得到的。代碼如下: def _get_company_and_product(self, file_path): """ Read all properties of the given file return them as a dictionary.
Time of Update: 2017-01-19
本文執行個體講述了python實現調用其他python指令碼的方法,分享給大家供大家參考。具體方法如下:該執行個體調用目前的目錄下的md5get.py指令碼。代碼如下:import os import logging import subprocess log = logging.getLogger("Core.Analysis.Processing") INTERPRETER = "/usr/bin/python" if not os.path.exists(INTERPRETER):
Time of Update: 2017-01-19
哦,這就是真正牛X的程式員。不過,他也僅僅是牛X罷了,還不是大神。大神程式員是什麼樣兒呢?他是掃地僧,大隱隱於市。先搞清楚這些名詞再說別的:迴圈(loop),指的是在滿足條件的情況下,重複執行同一段代碼。比如,while語句。迭代(iterate),指的是按照某種順序逐個訪問列表中的每一項。比如,for語句。遞迴(recursion),指的是一個函數不斷調用自身的行為。比如,以編程方式輸出著名的費伯納西數列。遍曆(traversal),指的是按照一定的規則訪問樹形結構中的每個節點,而且每個節點都
Time of Update: 2017-01-19
不是說while就不用,比如前面所列舉而得那個猜數字遊戲,在商務邏輯上,用while就更容易理解(當然是限於那個遊戲的業務需要而言)。另外,在某些情況下,for也不是簡單地把對象中的元素遍曆一遍,比如有有隔一個取一個的要求,等等。在編寫代碼的實踐中,為了對付迴圈中的某些要求,需要用一些其它的函數,比如前面已經介紹過的range就是一個被看做迴圈中的計數器的好東西。range在《有容乃大的list(4)》中,專門對range()這個內建函數做了詳細介紹,看官可以回到那節教程複習一番。這裡重點是複習
Time of Update: 2017-01-19
廢話少說,上幹活。for的基本操作for是用來迴圈的,是從某個對象那裡依次將元素讀取出來。看下面的例子,將已經學習過的資料對象用for迴圈一下,看看哪些能夠使用,哪些不能使用。同時也是複習一下過往的內容。複製代碼 代碼如下:>>> name_str = "qiwsir">>> for i in name_str: #可以對str使用for迴圈... print
Time of Update: 2017-01-19
在python中,它也有這個含義,不過有點區別的是,“當...時候”這個條件成立在一段範圍或者時間間隔內,從而在這段時間間隔內讓python做好多事情。就好比這樣一段情景:while 年齡大於60歲:-------->當年齡大於60歲的時候 退休 -------->凡是符合上述條件就執行的動作展開想象,如果製作一道門,
Time of Update: 2017-01-19
基本語句結構複製代碼 代碼如下:if 判斷條件1: 執行語句1……elif 判斷條件2: 執行語句2……elif 判斷條件3: 執行語句3……else:
Time of Update: 2017-01-19
本文執行個體講述了python中pycurl庫的用法,分享給大家供大家參考。該執行個體代碼實現從指定網址讀取網頁,主要是pycurl庫的使用。具體實現方法如下:#定義一個類class CallBack: """ for pycurl """ def __init__(self): """Constructor""" self.data = "" def func(self, data): self.data = self.data + data
Time of Update: 2017-01-19
本文執行個體講述了python採用getopt解析命令列輸入參數的方法,分享給大家供大家參考。具體執行個體代碼如下:import getopt import sys config = { "input":"", "output":".", } #getopt三個選項,第一個一般為sys.argv[1:],第二個參數為短參數,如果參數後面必須跟值,須加:,第三個參數為長參數 #是一個列表, opts, args = getopt.getopt(sys.argv[1:], 'hi:
Time of Update: 2017-01-19
本文執行個體講述了Python實現115網盤自動下載的方法。分享給大家供大家參考。具體實現方法如下:執行個體中的1.txt,是網頁http://bbs.pediy.com/showthread.php?t=144788另存新檔1.txt通過每3秒鐘複製一個下載連結到粘貼板,複製時會自動調用115用戶端下載,每下載10個檔案會手工輸入一個字元,防止一下下載太多,卡死機器具體代碼如下:import re, os, timeimport webbrowserimport urllib if
Time of Update: 2017-01-19
本文執行個體講述了python開啟網頁和暫停方法。分享給大家供大家參考。具體實現代碼如下:import webbrowserimport os webbrowser.open_new_tab("http://www.jb51.net/")os.system("pause")#運行windows的pause 命令,等待使用者輸入i = 0 while i<100: if downloadUrlList == None: break
Time of Update: 2017-01-19
1. 手動製作python的exe可執行程式Python沒有內建一個編譯為exe的功能。給python程式的部署帶來不少的麻煩。所以就會出現一些py2exe之類的很不錯的工具,用於自動把.py檔案編譯為.exe檔案。最近抽空研究了一下手動實作類別似py2exe的功能,希望加強對python的瞭解。結果還相當不錯。把結果記錄下來,與大家共用。1.1. 原理文中所描述的方法,基於python的以下幾個功能 1)
Time of Update: 2017-01-19
總是記不住API。昨晚寫的時候用到了這些,但是沒記住,於是就索性整理一下吧:python中對檔案、檔案夾(檔案操作函數)的操作需要涉及到os模組和shutil模組。得到當前工作目錄,即當前Python指令碼工作的目錄路徑:
Time of Update: 2017-01-19
使用input和raw_input都可以讀取控制台的輸入,但是input和raw_input在處理數字時是有區別的當輸入為純數字時:input返回的是數實值型別,如int,floatraw_inpout返回的是字串類型,string類型輸入字串為運算式input會計算在字串中的數字運算式,而raw_input不會。如輸入“57 + 3”:input會得到整數60raw_input會得到字串”57 + 3”python input的實現看python
Time of Update: 2017-01-19
Django 1.10中文文檔-第一個應用Part3-視圖和模板,djangopart3-本教程上接Django 1.10中文文檔-第一個應用Part2-模型和管理網站。我們將繼續開發網頁投票這個應用,主要講如何建立一個對使用者開放的介面。概覽視圖是Django應用中的一“類”網頁,它通常使用一個特定的函數提供服務,並且具有一個特定的模板。例如,在部落格應用中,可能有以下視圖:部落格首頁 ——