python3對文本和位元據做了區分。文本是Unicode編碼,str類型,用於顯示。二進位類型是bytes類型,用於儲存和傳輸。bytes是byte的序列,而str是unicode的序列。本文主要介紹了python string類型 bytes類型 bytearray類型,需要的朋友可以參考下,希望能協助到大家。
一、str類型:
>>> s = u'你好' >>> s '你好' >>> type(s) <class 'str'>
bytes類型:
>>> b = b'abc' >>> b b'abc' >>> type(b) <class 'bytes'>
二、str和bytes之間的轉換關係:str-->encode()-->bytes-->decode()-->str
轉換方式一:encode(),decode()
>>> a = u'你好' >>> b = a.encode('utf-8') >>> b b'\xe4\xbd\xa0\xe5\xa5\xbd' >>> type(b) <class 'bytes'> >>> new_a = b.decode('utf-8') >>> new_a '你好' >>> type(new_a) <class 'str'>
轉換方式二:bytes(),str()
>>> a = u'你好' >>> b= bytes(a, encoding='utf-8') >>> b b'\xe4\xbd\xa0\xe5\xa5\xbd' >>> type(b) <class 'bytes'> >>> new_a = str(b, encoding='utf-8') >>> new_a '你好' >>> type(new_a) <class 'str'>
三、bytearray類型
bytearray類是range 0 < = x < 256的一個可變序列。
可選的源參數可以用幾種不同的方式來初始化數組:
•如果它是一個字串,那麼您還必須給出編碼(以及可選的錯誤)參數;bytearray()然後使用str.encode()將字串轉換為位元組。
•如果它是一個整數,那麼數組將具有這個大小,並將用null位元組初始化。
•如果它是符合緩衝區介面的對象,則將使用對象的唯讀緩衝區來初始化位元組數組。
•如果它是可迭代的,那麼它必須是range 0 < = x < 256的整數的迭代,它被用作數組的初始內容
•如果沒有參數,則建立一個大小為0的數組。
當源參數是一個字串時:
>>> b = bytearray(u'你好', encoding='utf-8') >>> b bytearray(b'\xe4\xbd\xa0\xe5\xa5\xbd') >>> type(b) <class 'bytearray'>
當源參數是一個整數時:
>>> b = bytearray(5) >>> b bytearray(b'\x00\x00\x00\x00\x00') >>> type(b) <class 'bytearray'>
當源參數是一個可迭代對象,那麼這個迭代對象的元素都必須符合0 <= x < 256:
>>> b = bytearray([1, 2, 3, 4, 255]) >>> b bytearray(b'\x01\x02\x03\x04\xff') >>> type(b) <class 'bytearray'
四、bytes和bytearray區別
bytes是不可變的,同str。bytearray是可變的,同list。
>>> b = bytearray() >>> b bytearray(b'') >>> b.append(10) >>> b bytearray(b'\n') >>> b.append(100) >>> b bytearray(b'\nd') >>> b.remove(100) >>> b bytearray(b'\n') >>> b.insert(0, 150) >>> b bytearray(b'\x96\n') >>> b.extend([1, 3, 5]) >>> b bytearray(b'\x96\n\x01\x03\x05') >>> b.pop(2) 1 >>> b bytearray(b'\x96\n\x03\x05') >>> b.reverse() >>> b bytearray(b'\x05\x03\n\x96') >>> b.clear() >>> b bytearray(b'')
五、bytes和 bytearray轉換
>>> b = b'abcdef' >>> bay = bytearray(b) >>> bay bytearray(b'abcdef') >>> b = bytes(bay) >>> b b'abcdef'
六、bytearray和str轉換
>>> a = 'abcdef' >>> b = bytearray(a, encoding='utf-8') >>> b bytearray(b'abcdef') >>> a = b.decode(encoding='utf-8') >>> a 'abcdef'