Time of Update: 2016-10-18
#! /usr/bin/env python# coding=utf-8 from time import timedef logged(when): def log(f,*args,**kargs): print("called: function:%s,args:%r,kargs:%r"%(f,args,kargs)) def pre_logged(f): def wrapper(*args,**kargs):
Time of Update: 2016-10-18
使用python類比登陸百度#!/usr/bin/python# -*- coding: utf-8 -*- import re;import cookielib;import urllib;import urllib2;import optparse; #------------------------------------------------------------------------------# check all cookies in cookiesDict is
Time of Update: 2016-10-18
機器學習常用到python的自然語言處理架構NLTK,這個是機器學習的常用包,在使用過程中會遇到不少問題。我會和大家分享在這其中的一些經驗。今天閑來說一下安裝,在安裝中出現的download錯誤。>>> import nltk>>> nltk.download()NLTK Downloader--------------------------------------------------------------------------- d) Download l) List
Time of Update: 2016-10-18
接著上一篇文章 機器學習之nltk download出錯:Error connecting to server: [Errno -2] ,下面說一下 nltk測試包的安裝及要注意的事項>>> import nltk>>> nltk.download()NLTK Downloader--------------------------------------------------------------------------- d) Download l) List
Time of Update: 2016-10-18
機器學習中很重要的應用情境就是機器自動分類,而分類的關鍵是詞幹提取。所以我們要用到snowball。下面說一下snowball 提取詞乾的兩種方法。兩種方法:方法一:>>> from nltk import SnowballStemmer>>> SnowballStemmer.languages # See which languages are supported('danish', 'dutch', 'english',
Time of Update: 2016-10-18
def get_first_letter(char): char=char.encode('GBK') if charb"\xd7\xf9": return "" if char return "a" if char return "b" if char return "c" if char return "d" if char return "e" if char
Time of Update: 2016-10-18
今天來弄一個後台破解的Python小程式,哈哈,直接上代碼吧,都有注釋~~# -*- coding: utf-8 -*-# 利用python 寫的多線程爆破後台使用者名稱+密碼(自備字典),比較實用,即使是在資訊安全這麼重視的今天,還是有人不加驗證碼或者異常訪問限制之類的登陸驗證方式,這樣就很# 容易被弱口令爆破工具拿下,(本代碼僅限學習實用,禁止進行web攻擊,不承擔法律責任)import urllib2import urllibimport httplibimport threading
Time of Update: 2016-10-18
日誌沒錯,就是日誌。再多強調在你的應用裡保留足量的日誌的重要性也不為過。你應當對重要的內容打日誌。如果你的日誌打的足夠好的話,單看日誌你就能發現問題所在。那樣可以節省你大量的時間。如果一直以來你都在代碼裡亂用 print
Time of Update: 2016-10-18
(ob1 is ob2) 等價於 (id(ob1) == id(ob2)) 首先id函數可以獲得對象的記憶體位址,如果兩個對象的記憶體位址是一樣的,那麼這兩個對象肯定是一個對象。和is是等價的。Python原始碼為證。static PyObject * cmp_outcome(int op, register PyObject *v, register PyObject *w){ int res = 0; switch (op) { case PyCmp_IS: res = (v == w)
Time of Update: 2016-10-18
近期學了一點Python,然後正好有一個手機同步工具方面的預研工作要完成。要實現PC與手機的通訊,首先要找到他們的通訊協定,還好的是Android有完善的協議:ADBADB的代碼是開源的,而且支援Windows平台,有現成的DLL可以調用:AdbWinApi.dll,AdbWinUsbApi.dll好了,可以用VC搞定,但我想用Python試一下,於是開始了苦逼的查資料+實驗的過程。實驗過程就不多說了,由於上面的兩個DLL都是用C實現的,提供的標頭檔也是C語言的,所以有了下面這個python測試
Time of Update: 2016-10-18
今天來實現一個約瑟夫環演算法,下面是一道新浪的面試題:m只猴子圍坐成一個圈,按順時針方向從1到m編號。然後從1號猴子開始沿順時針方向從1開始報數,報到n的猴子出局,再從剛出局猴子的下一個位置重新開始報數,如此重複,直至剩下一個猴子,它就是大王。設計並編寫程式,實現如下功能:(1)要求由使用者輸入開始時的猴子數m、報數的最後一個數n。(2)給出當選猴王的初始編號。這道題是典型的約瑟夫環問題,“猴子選大王”問題。注意:本執行個體在python2.7下測試通過,未在python3下測試,有興趣的同學可
Time of Update: 2016-10-18
最近被多線程給坑了下,沒意識到類變數在多線程下是共用的,還有一個就是沒意識到 記憶體釋放問題,導致越累越大1.python 類變數 在多線程情況 下的 是共用的2.python 類變數 在多線程情況 下的 釋放是不完全的3.python 類變數 在多線程情況 下沒釋放的那部分 記憶體 是可以重複利用的import threading import time class Test: cache = {} @classmethod def
Time of Update: 2016-10-18
根據字典檔案,使用python進行暴力破解,程式很簡單註:針對沒有驗證碼的情況執行個體代碼:#encoding=utf-8import httplib,urllibconn = httplib.HTTPConnection("www.xxx.cn")f=open("dict.txt")while 1: pwd=f.readline().strip() if not pwd: print '字典已比對完。' break params =
Time of Update: 2016-10-18
一個簡單的python查詢百度關鍵詞排名的函數,特點:1、UA隨機2、操作簡單方便,直接getRank(關鍵詞,網域名稱)就可以了3、編碼轉化。編碼方面應該沒啥問題了。4、結果豐富。不僅有排名,還有搜尋結果的title,URL,快照時間,符合SEO需求缺點:單線程,速度慢#coding=utf-8 import requestsimport BeautifulSoupimport reimport random def decodeAnyWord(w): try:
Time of Update: 2016-10-18
mrjob 可以讓用 Python 2.5+ 來編寫 MapReduce 作業,並在多個不同平台上運行,你可以:使用純 Python 編寫多步的 MapReduce 作業在本機上進行測試在 Hadoop 叢集上運行使用 Amazon Elastic MapReduce (EMR) 在雲上運行pip 的安裝方法非常簡單,無需配置,直接運行:pip install mrjob代碼執行個體:from mrjob.job import MRJobclass MRWordCounter(MRJob):
Time of Update: 2016-10-18
把pydev開發的一個上傳項目部署到測試環境時1、提示找不到我寫的模組解決方案:在項目入口增加代碼#在項目的PYTHONPATH 添加來源目錄PROJECT_DIR = os.path.dirname(__file__)PROJECT_ROOT_DIR = os.path.dirname(PROJECT_DIR)if not PROJECT_ROOT_DIR in sys.path:sys.path.append(PROJECT_ROOT_DIR)if not PROJECT_DIR in
Time of Update: 2016-10-18
PHP 有變數函數這一用法(見 http://www.php.net/manual/en/functions.variable-functions.php)即有一字串變數現在想用這個變數的值做為某函數名來調用代碼如下:def bar(): return 'bar'foo = 'bar'foo() #此處想調用 bar() 不知道 Python
Time of Update: 2016-10-18
產生項目scrapy提供一個工具來產生項目,產生的項目中預置了一些檔案,使用者需要在這些檔案中添加自己的代碼。開啟命令列,執行:scrapy startproject tutorial,產生的項目類似下面的結構tutorial/ scrapy.cfg tutorial/ __init__.py items.py pipelines.py settings.py spiders/ __init__.py
Time of Update: 2016-10-18
python去除html標籤,自己寫的,若有不足請指正:#! /usr/bin/env python#coding=utf-8# blueel 2013-01-19from HTMLParser import HTMLParser class MLStripper(HTMLParser): def __init__(self): self.reset() self.fed = [] def handle_data(self, d):
Time of Update: 2016-10-18
class A(object): # A must be new-style class def __init__(self): print "enter A" print "leave A" class B(C): # A --> C def __init__(self): print "enter B" super(B, self).__init__() print "leave B"在我們的印象中,對於super(B, self).__