本文主要給大家介紹了關於 Python中的字串操作和編碼Unicode的一些知識,下面話不多說,需要的朋友們下面來一起學習吧。 <br>
字串類型<br>
str
:Unicode字串。採用''或r''建構的字串皆為str,單引號可以用雙引號或三引號來取代。無論用哪種方式進行製定,在Python內部儲存時沒有區別。 <br>
bytes
:二進位字串。由於jpg等其他格式的檔案不能用str來顯示,所以才用bytes來表示,bytes的每個位元組為一個0-255的數字。如果列印的時候,Python會把能夠用ASCII表示的部分顯示為ASCII,這樣方便閱讀。 bytes幾乎支援除了格式化以外的所有str的方法,甚至包含了re模組<br>
bytearray()
:二進位可原地變動的字串。
utf-8編碼範圍<br>
#範圍 | 位元組數 | 儲存格式 |
0x0000~0x007F (0 ~ 127) | 1位元組 | 0xxxxxxx |
#0x0080~0x07FF(128 ~ 2047) | 2位元組 | 110xxxxx 10xxxxxx |
0x0800~FFFF(2048 ~ 65535) | ||
<br>
<br>
<br>
- ##' ##3位元組
- 4位元組11110xxx 10xxxxxx 10xxxxxx 10xxxxxx
<br>#0x2000000~0x3FFFFFF
#5位元組<br>
#11110xx 10xxxxxx 10xxxxxx 100xxx 1011110xx 10xxxxxx 10xxxxxx 100xxx 10<br>11110xx 10xxxxxx 10xxxxxx 100xxx 10
1110xxx 0x4000000~0x7FFFFFFF)6位元組
<br>
##1<br>#BOM是byte order marker的縮寫,
#指定編碼寫入時的規則<br>
Python在使用'utf-8 '編碼寫入檔案時不會寫入BOM頭,但如果指定編碼'utf-8-sig'則會迫使Python寫入一個BOM頭。
使用'utf-16-be'不會寫入一個BOM頭,但是採用'utf-16'則會寫入一個BOM頭。 <br>
>>> open('h.txt','w',encoding='utf-8-sig').write('aaa') 3 >>> open('h.txt','rb').read() b'\xef\xbb\xbfaaa' >>> open('h.txt','w',encoding='utf-16').write('bbb') 3 >>> open('h.txt','rb').read() b'\xff\xfeb\x00b\x00b\x00' >>> open('hh.txt','w',encoding='utf-16-be').write('ccc') 3 >>> open('hh.txt','rb').read() b'\x00c\x00c\x00c' >>> open('h.txt','w',encoding='utf-8').write('ddd') 3 >>> open('h.txt','rb').read() b'ddd'
<br>讀取時的規則
如果指定了正確的編碼,那麼BOM會忽略,否則BOM會顯示為亂碼或回傳異常。
<br>
>>> open('h.txt','r').read() '锘縟dd' >>> open('h.txt','r',encoding='utf-8-sig').read() 'ddd'
<br>
chr和ord<br>
>>> ord('中') #20013 >>> chr(20013) #'中'
<br>把Unicode硬編碼進字串中。
'\xhh':以2位元十六進位表示一個字元
<br> '\uhhhh':以4位元十六進位來表示一個字元:
'\Uhhhhhhhh':以8位元十六進位表示一個字元<br>
###>>> s = '> s = ' py\x74h\u4e2don' #'pyth中on'#############str和bytes,bytearray進行轉換################str.encode( encoding='utf-8')###############bytes(s,encoding='utf-8')################ bytes.decode(encoding='utf-8')###############str(B, encoding='utf-8')############ ####bytearray(string, encoding='utf-8')################bytearray(bytes)############文件編碼聲明############Python預設使用utf-8編碼。 ############# -*- coding: latin-1 -*- ###:表示宣告文件為latin-1編碼。 #########幫助函數###############sys.platform #'win32' sys.getdefaultencoding() # 'utf-8' sys.byteorder #'little' s.isalnum() #s表示字符串 s.isalpha() s.isdecimal s.isdigit() s.isnumeric() s.isprintable() s.isspace() s.isidentifier() #如果字符串可以用作变量名,那么返回True s.islower() s.isupper() s.istitle()###################更多Python中的字串操作和編碼Unicode詳解相關文章請關注PHP中文網! ############

Python在遊戲和GUI開發中表現出色。 1)遊戲開發使用Pygame,提供繪圖、音頻等功能,適合創建2D遊戲。 2)GUI開發可選擇Tkinter或PyQt,Tkinter簡單易用,PyQt功能豐富,適合專業開發。

Python适合数据科学、Web开发和自动化任务,而C 适用于系统编程、游戏开发和嵌入式系统。Python以简洁和强大的生态系统著称,C 则以高性能和底层控制能力闻名。

2小時內可以學會Python的基本編程概念和技能。 1.學習變量和數據類型,2.掌握控制流(條件語句和循環),3.理解函數的定義和使用,4.通過簡單示例和代碼片段快速上手Python編程。

Python在web開發、數據科學、機器學習、自動化和腳本編寫等領域有廣泛應用。 1)在web開發中,Django和Flask框架簡化了開發過程。 2)數據科學和機器學習領域,NumPy、Pandas、Scikit-learn和TensorFlow庫提供了強大支持。 3)自動化和腳本編寫方面,Python適用於自動化測試和系統管理等任務。

兩小時內可以學到Python的基礎知識。 1.學習變量和數據類型,2.掌握控制結構如if語句和循環,3.了解函數的定義和使用。這些將幫助你開始編寫簡單的Python程序。

如何在10小時內教計算機小白編程基礎?如果你只有10個小時來教計算機小白一些編程知識,你會選擇教些什麼�...

使用FiddlerEverywhere進行中間人讀取時如何避免被檢測到當你使用FiddlerEverywhere...

Python3.6環境下加載Pickle文件報錯:ModuleNotFoundError:Nomodulenamed...


熱AI工具

Undresser.AI Undress
人工智慧驅動的應用程序,用於創建逼真的裸體照片

AI Clothes Remover
用於從照片中去除衣服的線上人工智慧工具。

Undress AI Tool
免費脫衣圖片

Clothoff.io
AI脫衣器

AI Hentai Generator
免費產生 AI 無盡。

熱門文章

熱工具

Atom編輯器mac版下載
最受歡迎的的開源編輯器

SAP NetWeaver Server Adapter for Eclipse
將Eclipse與SAP NetWeaver應用伺服器整合。

PhpStorm Mac 版本
最新(2018.2.1 )專業的PHP整合開發工具

Dreamweaver CS6
視覺化網頁開發工具

mPDF
mPDF是一個PHP庫,可以從UTF-8編碼的HTML產生PDF檔案。原作者Ian Back編寫mPDF以從他的網站上「即時」輸出PDF文件,並處理不同的語言。與原始腳本如HTML2FPDF相比,它的速度較慢,並且在使用Unicode字體時產生的檔案較大,但支援CSS樣式等,並進行了大量增強。支援幾乎所有語言,包括RTL(阿拉伯語和希伯來語)和CJK(中日韓)。支援嵌套的區塊級元素(如P、DIV),