當前位置：首頁 > 编程语言 > python >内容正文

python

Python的字符串

發布時間：2025/3/20 python 23 豆豆

生活随笔收集整理的這篇文章主要介紹了 Python的字符串小編覺得挺不錯的,現在分享給大家,幫大家做個參考.

對于單個字符的編碼，Python提供了ord()函數獲取字符的整數表示，chr()函數把編碼轉換為對應的字符：

>>> ord('A') 65 >>> ord('中') 20013 >>> chr(66) 'B' >>> chr(25991) '文'

由于Python的字符串類型是str，在內存中以Unicode表示，一個字符對應若干個字節。

1、如果要在網絡上傳輸，或者保存到磁盤上，就需要把str變為以字節為單位的bytes。

Python對bytes類型的數據用帶b前綴的單引號或雙引號表示：

x = b'ABC'

要注意區分’ABC’和b’ABC’，前者是str，后者雖然內容顯示得和前者一樣，但bytes的每個字符都只占用一個字節。

以Unicode表示的str通過encode()方法可以編碼為指定的bytes（為了節約內存），例如：

''' 遇到問題沒人解答？小編創建了一個Python學習交流QQ群：778463939 尋找有志同道合的小伙伴，互幫互助,群里還有不錯的視頻學習教程和PDF電子書！ ''' >>> 'ABC'.encode('ascii') b'ABC' >>> '中文'.encode('utf-8') b'\xe4\xb8\xad\xe6\x96\x87' >>> '中文'.encode('ascii') Traceback (most recent call last):File "<stdin>", line 1, in <module> UnicodeEncodeError: 'ascii' codec can't encode characters in position 0-1: ordinal not in range(128)

純英文的str可以用ASCII編碼為bytes，內容是一樣的，含有中文的str可以用UTF-8編碼為bytes。含有中文的str無法用ASCII編碼，因為中文編碼的范圍超過了ASCII編碼的范圍，Python會報錯。

在bytes中，無法顯示為ASCII字符的字節，用\x##顯示。

2、如果我們從網絡或磁盤上讀取了字節流，那么讀到的數據就是bytes。要把bytes變為str，就需要用decode()方法：

>>> b'ABC'.decode('ascii') 'ABC' >>> b'\xe4\xb8\xad\xe6\x96\x87'.decode('utf-8') '中文'

如果bytes中包含無法解碼的字節，decode()方法會報錯：

>>> b'\xe4\xb8\xad\xff'.decode('utf-8') Traceback (most recent call last):... UnicodeDecodeError: 'utf-8' codec can't decode byte 0xff in position 3: invalid start byte

如果bytes中只有一小部分無效的字節，可以傳入errors='ignore’忽略錯誤的字節：

>>> b'\xe4\xb8\xad\xff'.decode('utf-8', errors='ignore') '中'

要計算str包含多少個字符，可以用len()函數：

''' 遇到問題沒人解答？小編創建了一個Python學習交流QQ群：778463939 尋找有志同道合的小伙伴，互幫互助,群里還有不錯的視頻學習教程和PDF電子書！ ''' >>> len('ABC') 3 >>> len('中文') 2

len()函數計算的是str的字符數，如果換成bytes，len()函數就計算字節數：

>>> len(b'ABC') 3 >>> len(b'\xe4\xb8\xad\xe6\x96\x87') 6 >>> len('中文'.encode('utf-8')) 6

可見，1個中文字符經過UTF-8編碼后通常會占用3個字節，而1個英文字符只占用1個字節。

總結

以上是生活随笔為你收集整理的Python的字符串的全部內容，希望文章能夠幫你解決所遇到的問題。

如果覺得生活随笔網站內容還不錯，歡迎將生活随笔推薦給好友。

上一篇： Python高效率遍历文件夹寻找重复文件
下一篇： python中Json、os、sys、h

日韩av黄I国产麻豆传媒I国产91av视频在线观看I日韩一区二区三区在线看I美女国产在线I麻豆视频国产在线观看I成人黄色短片

python

Python的字符串

總結