標籤:err 大寫 轉義 decode 注釋 其他 檔案 ++ unicode
一、Python中的資料類型主要有以下五種
(1)、整數
(2)、浮點數
(3)、字串 :用‘’或“”括起來的任意文本
(4)、布爾值 :只有True和False兩種值(注意兩個都是大寫),布爾值可以用and 、or和not運算;Python把0、Null 字元串‘‘和None看成 False,其他數值和非Null 字元串都看成 True;
(5)、空值:Python裡的一個特殊值,用None來表示,但None不能理解為0,因為0是有意義的,而None是 一個特殊的空值;
二、Python中如何定義字串我們已經知道用‘’和“”來表示,但其中有時會涉及到逸出字元,所以在這裡再詳細總結一下,哈哈。
(1)、當字串中本身帶有單引號‘’時,我們就選擇用雙引號” “來表示字串;反之,當字串本身帶有雙引號 " "時,我們就用單引號‘’來表示。
(2)、當然,我們也可以選擇另一種方法來代替上面的方法——在字串本身所帶的‘’和""前加反斜線\來解決;
(3)、如果一個字串包含很多需要轉義的字元,對每一個字元都進行轉義會很麻煩,為了避免這種情況,我們可以在字串前面加個首碼 r ,表示這是一個 raw 字串,裡面的字元就不需要轉義了。但是r‘...‘標記法不能表示多行字串,也不能表示包含‘和 "的字串;如果要表示多行字串,可以用‘‘‘...‘‘‘表示,還可以在多行字串前面添加 r ,把這個多行字串也變成一個raw字串:
三、字串還有一個編碼問題。
因為電腦只能處理數字,如果要處理文本,就必須先把文本轉換為數字才能處理。為了統一所有文字的編碼,Unicode應運而生。Unicode把所有語言都統一到一套編碼裡,這樣就不會再有亂碼問題了。
Python在後來添加了對Unicode的支援,以Unicode表示的字串用u‘...‘表示,比如:
print u‘中文‘中文
注意: 不加 u ,中文就不能正常顯示。
轉義:
u‘中文\n日文\n韓文‘
多行:
u‘‘‘第一行第二行‘‘‘
raw+多行:
ur‘‘‘Python的Unicode字串支援"中文","日文","韓文"等多種語言‘‘‘
如果中文字串在Python環境下遇到 UnicodeDecodeError,這是因為.py檔案儲存的格式有問題。可以在第一行添加註釋
# -*- coding: utf-8 -*-
目的是告訴Python解譯器,用UTF-8編碼讀取原始碼。然後用Notepad++ 另存新檔... 並選擇UTF-8格式儲存。
Python變數和資料類型