Time of Update: 2017-01-19
1.背景項目需求,要求獲得github的repo的api,以便可以提取repo的資料進行分析。研究了一天,終於解決了這個問題,雖然效率還是比較低下。因為github的那個顯示repo的api,列出了每個repo的詳細資料,而且是json格式的。現在貌似還沒有找到可以分析多個json格式資料的方法,所以用的是比較蠢得splite加re的方法。如果大家有更好的方法,不發留言討論!2.代碼import reimport osdef GetUrl(num): str = os.popen("curl -
Time of Update: 2017-01-19
OK,首先寫一個python socket的server段,對開放三個連接埠:10000,10001,10002.krondo的例子中是每個server綁定一個連接埠,測試的時候需要分別開3個shell,分別運行.這太麻煩了,就分別用三個Thread來運行這些services.import optparse import os import socket import time from threading import Thread import StringIO txt = '''111
Time of Update: 2017-01-19
python中,遍曆dict的方法有四種。但這四種遍曆的效能如何呢?我做了如下的測試l = [(x,x) for x in xrange(10000)]d = dict(l)from time import clockt0=clock()for i in d: t = i + d[i]t1=clock()for k,v in d.items(): t = k + vt2=clock()for k,v in d.iteritems(): t = k + vt3=clock()for k,v in
Time of Update: 2017-01-19
前提:isp得支援web登入的方式。說明:每個ISP的登入頁面不一樣,不過我估計演算法都是一樣的,於是解決方案應該也是相似的,只是表單的key可能不太一樣。首先,分析登入頁面。頁面head鑲嵌了<script>標籤,所有的提交相關的指令碼都在這裡。頁面關鍵區段是兩個表單:f1和f0。整個f0是看不見的,但是點擊f1的提交時,會直接調用f0的提交而不是提交自己。表單的table布局就不吐槽了...部分HTML<form name="f1" method="post"
Time of Update: 2017-01-19
快速入門import repattern = 'this'text = 'Does this text match the pattern?'match = re.search(pattern, text)s = match.start()e = match.end()print('Found "{0}"\nin "{1}"'.format(match.re.pattern, match.string))print('from {0} to {1} ("{2}")'.format( s,
Time of Update: 2017-01-19
具體的 websocket 介紹可見 http://zh.wikipedia.org/wiki/WebSocket 這裡,介紹如何使用 Python 與前端 js 進行通訊。websocket 使用 HTTP 協議完成握手之後,不通過 HTTP 直接進行 websocket 通訊。於是,使用 websocket 大致兩個步驟:使用 HTTP 握手,通訊。js 處理 websocket 要使用 ws 模組; Python 處理則使用 socket 模組建立 TCP 串連即可,比一般的
Time of Update: 2017-01-19
首先,要明白encode()和decode()的區別 encode()的作用是將Unicode編碼的字串轉換為其他編碼格式。例如: st1.encode("utf-8") 這句話的作用是將Unicode編碼的st1編碼為utf-8編碼的字串decode()的作用是把其他編碼格式的字串轉換成Unicode編碼的字串。例如: st2.decode("utf-8")
Time of Update: 2017-01-19
問題提出: 有時候我們採集網頁,處理完畢後將字串儲存到檔案或者寫入資料庫,這時候需要制定字串的編碼,如果採集網頁的編碼是gb2312,而我們的資料庫是utf-8的,這樣不做任何處理直接插入資料庫可能會亂碼(沒測試過,不知道資料庫會不會自動轉碼),我們需要手動將gb2312轉換成utf-8。首先我們知道,python裡的字元預設是ascii碼,英文當然沒問題啦,碰到中文的時候立馬給跪。不知道你還記不記得,python裡列印中文漢字的時候需要在字串前面加
Time of Update: 2017-01-19
完整代碼下載:http://xiazai.jb51.net/201407/tools/python-migong.rar最近研究了下迷宮的產生演算法,然後做了個簡單的線上迷宮遊戲。遊戲地址和對應的開源項目地址可以通過上面的連結找到。開源項目中沒有包含服務端的代碼,因為服務端的代碼實在太簡單了。下面將簡單的介紹下隨機迷宮的產生演算法。一旦理解後你會發現這個演算法到底有多簡單。1.將迷宮地圖分成多個房間,每個房間都有四面牆。2.讓“人”從地圖任意一點A出發,開始在迷宮裡遊盪。從A房間的1/2/3/4
Time of Update: 2017-01-19
python中對檔案、檔案夾(檔案操作函數)的操作需要涉及到os模組和shutil模組。得到當前工作目錄,即當前Python指令碼工作的目錄路徑:
Time of Update: 2017-01-19
代碼如下:#coding:gbkimport urllib2,urllib,cookielib,re''' 通用的登陸DZ論壇 參數說明parms: username:使用者名稱(必填), password :密碼(必填), domain:網站網域名稱,注意格式必須是:http://www.xxx.xx/(必填), answer:問題答案, questionid:問題ID, referer:跳轉地址 這裡使用了可變關鍵字參數(相關資訊可參考手冊)'''def
Time of Update: 2017-01-19
這是用來快速學習 Python Socket 通訊端編程的指南和教程。Python 的 Socket 編程跟 C 語言很像。Python 官方關於 Socket 的函數請看 http://docs.python.org/library/socket.html基本上,Socket 是任何一種電腦網路通訊中最基礎的內容。例如當你在瀏覽器地址欄中輸入 www.jb51.net 時,你會開啟一個通訊端,然後串連到 www.jb51.net 並讀取響應的頁面然後然後顯示出來。而其他一些聊天用戶端如
Time of Update: 2017-01-19
用python和numpy處理資料次數比較多,寫了幾個小函數,可以方便地讀寫資料:# -*- coding: utf-8 -*-#----------------------------------------------------------------------# FileName:gettxtdata.py#功能:讀取字串和檔案中的數值資料(浮點數)#主要提供類似matlab中的dlmread和dlmwrite函數#同時提供loadtxtdata和savetxtdata函數#Data:
Time of Update: 2017-01-19
python郵件清單裡有人發表言論說“python3在10內都無法普及”。在我看來這樣的觀點有些過於悲觀,python3和python2雖然不相容,但他們之間差別並沒很多人想像的那麼大。你只需要對自己的代碼稍微做些修改就可以很好的同時支援python2和python3的。下面我將簡要的介紹一下如何讓自己的python代碼如何同時支援python2和python3。一、放棄python 2.6之前的python版本python
Time of Update: 2017-01-19
首先要介紹的是 Python Imaging Library,使用方法如下:複製代碼 代碼如下:from PIL import Imagefrom PIL.ExifTags import TAGSdef get_exif_data(fname): """Get embedded EXIF data from image file.""" ret = {} try: &
Time of Update: 2017-01-19
目標是把騰訊新聞首頁上所有新聞爬取下來,獲得每一篇新聞的名稱、時間、來源以及本文。接下來分解目標,一步一步地做。步驟1:將首頁上所有連結爬取出來,寫到檔案裡。python在擷取html方面十分方便,寥寥數行代碼就可以實現我們需要的功能。複製代碼 代碼如下: def getHtml(url): page = urllib.urlopen(url) html =
Time of Update: 2017-01-19
python編程中常用的12種基礎知識總結:Regex替換,遍曆目錄方法,列表按列排序、去重,字典排序,字典、列表、字串互轉,時間對象操作,命令列參數解析(getopt),print 格式化輸出,進位轉換,Python調用系統命令或者指令碼,Python 讀寫檔案。1、Regex替換目標: 將字串line中的 overview.gif 替換成其他字串複製代碼 代碼如下:>>> line = '<IMG ALIGN="middle" SRC=\'#\'"
Time of Update: 2017-01-19
SNS什麼的我是一直無愛的,這次蛋疼寫了個登入開心網(kaixin001)並向所有好友發送站內訊息的指令碼。開心網在登入的時候做了一些處理,並不傳原始密碼,從js分析到的結果是:登入時會產生一個隨機的key,然後用這個key和原始密碼進行xxtea加密,把加密後的結果再進行sha1加密。之後post這個key以及加密後的密碼進行登入驗證。以下是很簡陋的指令碼內容:#coding: utf-8"""開心網操作指令碼Author: piglei2007@gmail.comVersion: 1.0""
Time of Update: 2017-01-19
好吧,我承認我是對晚上看到一張合適的票轉讓但打過電話去說已經被搞走了這件事情感到蛋疼。直接上檔案吧。#coding: utf-8'''春運查詢火車票轉讓資訊Author: piglei2007@gmail.comDate: 2011.01.25'''import reimport osimport timeimport urlparseimport datetimeimport tracebackimport urllib2import
Time of Update: 2017-01-19
分享一下剛遇到的一個小問題,我有一段類似於這樣的python代碼:複製代碼 代碼如下:# coding: utf-8class A(object): @property def _value(self):# raise