Python守護進程的實現

來源:互聯網
上載者:User

Daemon情境

考慮如下情境:你編寫了一個python服務程式,並且在命令列下啟動,而你的命令列會話又被終端所控制,python服務成了終端程式的一個子進程。因此如果你關閉了終端,這個命令列程式也會隨之關閉。

要使你的python服務不受終端影響而常駐系統,就需要將它變成守護進程。

守護進程就是Daemon程式,是一種在系統後台執行的程式,它獨立於控制終端並且執行一些周期任務或觸發事件,通常被命名為"d"字母結尾,如常見的httpd、syslogd、systemd和dockerd等。

代碼實現

python可以很簡潔地實現守護進程,下面給出代碼和相應注釋。這份代碼穩定運行在我本地電腦的一個守護進程(自製鬧鐘)裡,暫時沒出過問題。

# coding=utf8import osimport sysimport atexitdef daemonize(pid_file=None):    """    建立守護進程    :param pid_file: 儲存進程id的檔案    :return:    """    # 從父進程fork一個子進程出來    pid = os.fork()    # 子進程的pid一定為0,父進程大於0    if pid:        # 退出父進程,sys.exit()方法比os._exit()方法會多執行一些重新整理緩衝工作        sys.exit(0)    # 子進程預設繼承父進程的工作目錄,最好是變更到根目錄,否則回影響檔案系統的卸載    os.chdir('/')    # 子進程預設繼承父進程的umask(檔案許可權掩碼),重設為0(完全控制),以免影響程式讀寫檔案    os.umask(0)    # 讓子進程成為新的交談群組長和進程組長    os.setsid()    # 注意了,這裡是第2次fork,也就是子進程的子進程,我們把它叫為孫子進程    _pid = os.fork()    if _pid:        # 退出子進程        sys.exit(0)    # 此時,孫子進程已經是守護進程了,接下來重新導向標準輸入、輸出、錯誤的描述符(是重新導向而不是關閉, 這樣可以避免程式在 print 的時候出錯)    # 重新整理緩衝區先,小心使得萬年船    sys.stdout.flush()    sys.stderr.flush()    # dup2函數原子化地關閉和複製檔案描述符,重新導向到/dev/nul,即丟棄所有輸入輸出    with open('/dev/null') as read_null, open('/dev/null', 'w') as write_null:        os.dup2(read_null.fileno(), sys.stdin.fileno())        os.dup2(write_null.fileno(), sys.stdout.fileno())        os.dup2(write_null.fileno(), sys.stderr.fileno())    # 寫入pid檔案    if pid_file:        with open(pid_file, 'w+') as f:            f.write(str(os.getpid()))        # 註冊退出函數,進程異常退出時移除pid檔案        atexit.register(os.remove, pid_file)

概括一下守護進程的編寫步驟:

1、fork出子進程,退出父進程

2、子進程變更工作目錄(chdir)、檔案許可權掩碼(umask)、進程組和交談群組(setsid)

3、子進程fork孫子進程,退出子進程

4、孫子進程重新整理緩衝,重新導向標準輸入/輸出/錯誤(一般到/dev/null,意即丟棄)

5、(可選)pid寫入檔案

理解幾個要點

為什麼要fork兩次

第一次fork,是為了脫離終端控制的魔爪。父進程之所以退出,是因為終端敲擊鍵盤、或者關閉時給它發送了訊號;而fork出來的子進程,在父進程自殺後成為孤兒進程,進而被作業系統的init進程接管,因此脫離終端控制。

所以其實,第二次fork並不是必須的(很多開源項目裡的代碼就沒有fork兩次)。只不過出于謹慎考慮,防止進程再次開啟一個控制終端。因為子進程現在是交談群組長了(對話期的首次進程),有能力開啟控制終端,再fork一次,孫子進程就不能開啟控制終端了。

檔案描述符

Linux是“一切皆檔案”,檔案描述符是核心為已開啟的檔案所建立的索引,通常是非負整數。進程通過檔案描述符執行IO操作。

每個進程有自己的檔案描述符表,因此相同的描述符可能指向同一個檔案,也可能指向不同檔案;來自不同進程的不同的描述符,當然也有可能指向同一個檔案。

預設情況下,0代表標準輸入,1代表標準輸出,2代表標準錯誤。

umask許可權掩碼

我們知道,在Linux中,任何一個檔案都有讀(read)、寫(write)和執行(execute)的三種使用許可權。其中,讀的許可權用數字4代表,寫入權限是2,執行許可權是1。命令ls -l可以查看檔案許可權,r/w/x分別表示具有讀/寫/執行許可權。

任何檔案,也都有使用者(User),使用者組(Group),其他組(Others)三種身份許可權。一般用3個數字表示檔案許可權,例如754:

7,是User許可權,即檔案擁有者許可權

5,是Group許可權,擁有者所在使用者組的組員所具有的許可權

4,是Others許可權,即其他組使用者的許可權啦

而umask是為了控制預設許可權,防止建立檔案或檔案夾具有全權。

系統一般預設為022(使用命令umask查看),表示預設建立檔案的許可權是644,檔案夾是755。你應該可以看出它們的規律,就是檔案許可權和umask的相加結果為666(笑),檔案夾許可權和umask的相加結果為777。

進程組

每個進程都屬於一個進程組(PG,Process Group),進程組可以包含多個進程。

進程組有一個進程組長(Leader),進程組長的ID(PID, Process ID)就作為整個進程組的ID(PGID,Process Groupd ID)。

交談群組

登陸終端時,就會創造一個會話,多個進程組可以包含在一個會話中。而建立會話的進程,就是交談群組長。

已經是交談群組長的進程,不可以再調用setsid()方法建立會話。因此,上面代碼中,子進程可以調用setsid(),而父進程不能,因為它本身就是交談群組長。

另外,sh(Bourne Shell)不支援會話機制,因為會話機制需要shell支援工作控制(Job Control)。

守護進程與後台進程

通過&符號,可以把命令放到後台執行。它與守護進程是不同的:

1、守護進程與終端無關,是被init進程收養的孤兒進程;而後台進程的父進程是終端,仍然可以在終端列印

2、守護進程在關閉終端時依然堅挺;而後台進程會隨使用者退出而停止,除非加上nohup

3、守護進程改變了會話、進程組、工作目錄和檔案描述符,後台進程直接繼承父進程(shell)的

換句話說:守護進程就是默默地奮鬥打拚的有為青年,而後台進程是默默繼承老爸資產的富二代。

聯繫我們

該頁面正文內容均來源於網絡整理,並不代表阿里雲官方的觀點,該頁面所提到的產品和服務也與阿里云無關,如果該頁面內容對您造成了困擾,歡迎寫郵件給我們,收到郵件我們將在5個工作日內處理。

如果您發現本社區中有涉嫌抄襲的內容,歡迎發送郵件至: info-contact@alibabacloud.com 進行舉報並提供相關證據,工作人員會在 5 個工作天內聯絡您,一經查實,本站將立刻刪除涉嫌侵權內容。

A Free Trial That Lets You Build Big!

Start building with 50+ products and up to 12 months usage for Elastic Compute Service

  • Sales Support

    1 on 1 presale consultation

  • After-Sales Support

    24/7 Technical Support 6 Free Tickets per Quarter Faster Response

  • Alibaba Cloud offers highly flexible support services tailored to meet your exact needs.