Python3 中文檔案讀寫方法,python3讀寫

來源:互聯網
上載者:User

Python3 中文檔案讀寫方法,python3讀寫

字串在Python內部的表示是Unicode編碼,因此,在做編碼轉換時,通常需要以Unicode作為中間編碼,即先將其他編碼的字串解碼(decode)成Unicode,再從Unicode編碼(encode)成另一種編碼。

在新版本的python3中,取消了unicode類型,代替它的是使用unicode字元的字串類型(str),字串類型(str)成為基礎類型如下所示,而編碼後的變為了位元組類型(bytes) 但是兩個函數的使用方法不變:

  decode    encodebytes ------> str(unicode)------>bytes
u = '中文' #指定字串類型對象u str = u.encode('gb2312') #以gb2312編碼對u進行編碼,獲得bytes類型對象str u1 = str.decode('gb2312')#以gb2312編碼對字串str進行解碼,獲得字串類型對象u1 u2 = str.decode('utf-8')#如果以utf-8的編碼對str進行解碼得到的結果,將無法還原原來的字串內容

檔案讀取問題

假如我們讀取一個檔案,檔案儲存時,使用的編碼格式,決定了我們從檔案讀取的內容的編碼格式,例如,我們從記事本建立一個文字檔test.txt, 編輯內容,儲存的時候注意,編碼格式是可以選擇的,例如我們可以選擇gb2312,那麼使用python讀取檔案內容,方式如下:

f = open('test.txt','r')s = f.read() #讀取檔案內容,如果是不識別的encoding格式(識別的encoding類型跟使用的系統有關),這裡將讀取失敗'''假設檔案儲存時以gb2312編碼儲存'''u = s.decode('gb2312') #以檔案儲存格式對內容進行解碼,獲得unicode字串'''下面我們就可以對內容進行各種編碼的轉換了'''str = u.encode('utf-8')#轉換為utf-8編碼的字串strstr1 = u.encode('gbk')#轉換為gbk編碼的字串str1str1 = u.encode('utf-16')#轉換為utf-16編碼的字串str1

codecs進行檔案的讀取

python給我們提供了一個包codecs進行檔案的讀取,這個包中的open()函數可以指定編碼的類型:

import codecs f = codecs.open('text.text','r+',encoding='utf-8')#必須事Crowdsourced Security Testing道檔案的編碼格式,這裡檔案編碼是使用的utf-8 content = f.read()#如果open時使用的encoding和檔案本身的encoding不一致的話,那麼這裡將將會產生錯誤 f.write('你想要寫入的資訊') f.close()

以上這篇Python3 中文檔案讀寫方法就是小編分享給大家的全部內容了,希望能給大家一個參考,也希望大家多多支援幫客之家。

聯繫我們

該頁面正文內容均來源於網絡整理,並不代表阿里雲官方的觀點,該頁面所提到的產品和服務也與阿里云無關,如果該頁面內容對您造成了困擾,歡迎寫郵件給我們,收到郵件我們將在5個工作日內處理。

如果您發現本社區中有涉嫌抄襲的內容,歡迎發送郵件至: info-contact@alibabacloud.com 進行舉報並提供相關證據,工作人員會在 5 個工作天內聯絡您,一經查實,本站將立刻刪除涉嫌侵權內容。

A Free Trial That Lets You Build Big!

Start building with 50+ products and up to 12 months usage for Elastic Compute Service

  • Sales Support

    1 on 1 presale consultation

  • After-Sales Support

    24/7 Technical Support 6 Free Tickets per Quarter Faster Response

  • Alibaba Cloud offers highly flexible support services tailored to meet your exact needs.