中文字幕av专区_日韩电影在线播放_精品国产精品久久一区免费式_av在线免费观看网站

溫馨提示×

溫馨提示×

您好,登錄后才能下訂單哦!

密碼登錄×
登錄注冊×
其他方式登錄
點擊 登錄注冊 即表示同意《億速云用戶服務條款》

從零開始學Python:第九課-常用數據結構之字符串

發布時間:2020-08-13 23:57:34 來源:ITPUB博客 閱讀:148 作者:千鋒Python唐小強 欄目:編程語言

接著上期的Python教程講,視頻教程你們私我要的,整理出來了: Python 900集全套視頻教程(全家桶)
https://pan.baidu.com/s/1cU5lDWq9gh0cQ7hCnXUiGA,你們好好學。

第二次世界大戰促使了現代電子計算機的誕生,世界上的第一臺通用電子計算機叫ENIAC(電子數值積分計算機),誕生于美國的賓夕法尼亞大學,占地167平米,重量27噸,每秒鐘大約能夠完成約5000次浮點運算,如下圖所示。ENIAC誕生之后被應用于daodan彈道的計算,而數值計算也是現代電子計算機最為重要的一項功能。

從零開始學Python:第九課-常用數據結構之字符串

隨著時間的推移,雖然數值運算仍然是計算機日常工作中最為重要的組成部分,但是今天的計算機還要處理大量的以文本形式存在的信息。如果我們希望通過Python程序來操作本這些文本信息,就必須要先了解字符串這種數據類型以及與它相關的知識。

從零開始學Python:第九課-常用數據結構之字符串

字符串的定義

所謂 字符串,就是 由零個或多個字符組成的有限序列,一般記為:

從零開始學Python:第九課-常用數據結構之字符串

在Python程序中,如果我們把單個或多個字符用單引號或者雙引號包圍起來,就可以表示一個字符串。字符串中的字符可以是特殊符號、英文字母、中文字符、日文的平假名或片假名、希臘字母、Emoji字符等。

s1 = 
'hello, world!'

s2 = "你好,世界!"
print(s1, s2)
# 以三個雙引號或單引號開頭的字符串可以折行
s3 = '' '
hello,
world!
' ''
print(s3, end= '')

提示:print函數中的end=''表示輸出后不換行,即將默認的結束符\n(換行符)更換為''(空字符)。

轉義字符和原始字符串

可以在字符串中使用\(反斜杠)來表示轉義,也就是說\后面的字符不再是它原來的意義,例如:\n不是代表反斜杠和字符n,而是表示換行;\t也不是代表反斜杠和字符t,而是表示制表符。所以如果字符串本身又包含了'、"、\這些特殊的字符,必須要通過\進行轉義處理。例如需要一個帶單引號或反斜杠的字符串,可以用如下所示的方法進行處理。


#
 頭尾帶單引號的hello, world!

s1 = '\'hello, world!\ ''
print(s1)
# 頭尾帶反斜杠的hello, world!
s2 = '\\hello, world!\\'
print(s2)

Python中的字符串可以r或R開頭,這種字符串被稱為原始字符串,意思是字符串中的每個字符都是它本來的含義,沒有所謂的轉義字符。例如,在字符串'hello\n'中,\n表示換行;而在r'hello\n'中,\n不再表示換行,就是反斜杠和字符n。大家可以運行下面的代碼,看看會輸出什么。

# 字符串s1中\t是制表符,\n是換行符

s1 = '\time up \now'
print(s1)
# 字符串s2中沒有轉義字符,每個字符都是原始含義
s2 = r '\time up \now'
print(s2)

Python中還允許在\后面還可以跟一個八進制或者十六進制數來表示字符,例如\141和\\x61都代表小寫字母a,前者是八進制的表示法,后者是十六進制的表示法。另外一種表示字符的方式是在\\u后面跟Unicode字符編碼,例如\\u9a86\\u660a代表的是中文“駱昊”。運行下面的代碼,看看輸出了什么。


s1 = 
'\141\142\143\\x61\\x62\\x63'

s2 = '\\u9a86\\u660a'
print(s1, s2)

字符串的運算

Python為字符串類型提供了非常豐富的運算符,我們可以使用+運算符來實現字符串的拼接,可以使用*運算符來重復一個字符串的內容,可以使用in和not in來判斷一個字符串是否包含另外一個字符串,我們也可以用[]和[:]運算符從字符串取出某個字符或某些字符。

拼接和重復

下面的例子演示了使用+和*運算符來實現字符串的拼接和重復操作。

s1 = 
'hello' + 
' ' + 
'world'

print(s1)    # hello world
s2 = '!' * 3
print(s2)    # !!!
s1 += s2     # s1 = s1 + s2
print(s1)    # hello world!!!
s1 *= 2      # s1 = s1 * 2
print(s1)    # hello world!!!hello world!!!

用*實現字符串的重復是非常有意思的一個運算符,在很多編程語言中,要表示一個有10個a的字符串,你只能寫成"aaaaaaaaaa",但是在Python中,你可以寫成'a' * 10。你可能覺得"aaaaaaaaaa"這種寫法也沒有什么不方便的,那么想一想,如果字符a要重復100次或者1000次又會如何呢?

比較運算

對于兩個字符串類型的變量,可以直接使用比較運算符比較兩個字符串的相等性或大小。需要說明的是,因為字符串在計算機內存中也是以二進制形式存在的,那么字符串的大小比較比的是每個字符對應的編碼的大小。例如A的編碼是65, 而a的編碼是97,所以'A' < 'a'的結果相當于就是65 < 97的結果,很顯然是True;而'boy' < 'bad',因為第一個字符都是'b'比不出大小,所以實際比較的是第二個字符的大小,顯然'o' < 'a'的結果是False,所以'boy' < 'bad'的結果也是False。如果不清楚兩個字符對應的編碼到底是多少,可以使用ord函數來獲得,例如ord('A')的值是65,而ord('昊')的值是26122。下面的代碼為大家展示了字符串的比較運算。

s1 = 
'a whole new world'

s2 = 'hello world'
print(s1 == s2, s1 < s2)      # False True
print(s2 == 'hello world')    # True
print(s2 == 'Hello world')    # False
print(s2 != 'Hello world')    # True
s3 = '駱昊'
print(ord( '駱'), ord( '昊'))               # 39558 26122
s4 = '王大錘'
print(ord( '王'), ord( '大'), ord( '錘'))    # 29579 22823 38180
print(s3 > s4, s3 <= s4)      # True False

需要強調一下的是,字符串的比較運算比較的是字符串的內容,Python中還有一個is運算符(身份運算符),如果用is來比較兩個字符串,它比較的是兩個變量對應的字符串是否在內存中相同的位置(內存地址),簡單的說就是兩個變量是否對應內存中的同一個字符串。看看下面的代碼就比較清楚is運算符的作用了。


s1 = 
'hello world'

s2 = 'hello world'
s3 = s2
# 比較字符串的內容
print(s1 == s2, s2 == s3)    # True True
# 比較字符串的內存地址
print(s1 is s2, s2 is s3)    # False True

成員運算

Python中可以用in和not in判斷一個字符串中是否存在另外一個字符或字符串,in和not in運算通常稱為成員運算,會產生布爾值True或False,代碼如下所示。

s1 = 
'hello, world'

print( 'wo' in s1)    # True
s2 = 'goodbye'
print(s2 in s1)      # False

獲取字符串長度

獲取字符串長度沒有直接的運算符,而是使用內置函數len,我們在上節課的提到過這個內置函數,代碼如下所示。

s1 = 
'hello, world'

print( len(s1))                  # 12
print( len( 'goodbye, world'))    # 14

索引和切片

如果希望從字符串中取出某個字符,我們可以對字符串進行索引運算,運算符是[n],其中n是一個整數,假設字符串的長度為N,那么n可以是從0到N-1的整數,其中0是字符串中第一個字符的索引,而N-1是字符串中最后一個字符的索引,通常稱之為正向索引;在Python中,字符串的索引也可以是從-1到-N的整數,其中-1是最后一個字符的索引,而-N則是第一個字符的索引,通常稱之為負向索引。注意,因為 字符串是不可變類型,所以不能通過索引運算修改字符串中的字符。

s1 = 
'abc123456'

N = len(s1)

# 獲取第一個字符
print(s1[ 0], s1[-N])    # a a

# 獲取最后一個字符
print(s1[N -1], s1[ -1])  # 6 6

# 獲取索引為 2-7的字符
print(s1[ 2], s1[ -7])    # c c

# 獲取索引為 5-4的字符
print(s1[ 5], s1[ -4])    # 3 3

需要提醒大家注意的是,在進行索引操作時,如果索引越界(正向索引不在0到N-1范圍,負向索引不在-1到-N范圍),會引發IndexError異常,錯誤提示信息為:string index out of range(字符串索引超出范圍)。

如果要從字符串中取出多個字符,我們可以對字符串進行切片,運算符是[i:j:k],其中i是開始索引,索引對應的字符可以取到;j是結束索引,索引對應的字符不能取到;k是步長,默認值為1,表示從前向后獲取相鄰字符的連續切片,所以:k部分可以省略。假設字符串的長度為N,當k > 0時表示正向切片(從前向后獲取字符),如果沒有給出i和j的值,則i的默認值是0,j的默認值是N;當k < 0時表示負向切片(從后向前獲取字符),如果沒有給出i和j的值,則i的默認值是-1,j的默認值是-N - 1。如果不理解,直接看下面的例子,記住第一個字符的索引是0或-N,最后一個字符的索引是N-1或-1就行了。

s1 = 
'abc123456'


# i= 2, j= 5, k= 1的正向切片操作
print(s1[ 2: 5])       # c12

# i= -7, j= -4, k= 1的正向切片操作
print(s1[ -7: -4])     # c12

# i= 2, j= 9, k= 1的正向切片操作
print(s1[ 2:])        # c123456

# i= -7, j= 9, k= 1的正向切片操作
print(s1[ -7:])       # c123456

# i= 2, j= 9, k= 2的正向切片操作
print(s1[ 2:: 2])      # c246

# i= -7, j= 9, k= 2的正向切片操作
print(s1[ -7:: 2])     # c246

# i= 0, j= 9, k= 2的正向切片操作
print(s1[:: 2])       # ac246

# i= 1, j= -1, k= 2的正向切片操作
print(s1[ 1: -1: 2])    # b135

# i= 7, j= 1, k= -1的負向切片操作
print(s1[ 7: 1: -1])    # 54321c

# i= -2, j= -8, k= -1的負向切片操作
print(s1[ -2: -8: -1])  # 54321c

# i= 7, j= -10, k= -1的負向切片操作
print(s1[ 7:: -1])     # 54321cba

# i= -1, j= 1, k= -1的負向切片操作
print(s1[: 1: -1])     # 654321c

# i= 0, j= 9, k= 1的正向切片
print(s1[:])         # abc123456

# i= 0, j= 9, k= 2的正向切片
print(s1[:: 2])       # ac246

# i= -1, j= -10, k= -1的負向切片
print(s1[:: -1])      # 654321cba

# i= -1, j= -10, k= -2的負向切片
print(s1[:: -2])      # 642ca

循環遍歷

如果希望從字符串中取出每個字符,可以使用for循環對字符串進行遍歷,有兩種方式。

方式一:

s1 = 
'hello'

for index in range( len(s1)):
    print(s1[index])

方式二:


s1 = 
'hello'

for ch in s1:
   print(ch)

字符串的方法

在Python中,我們可以通過字符串類型自帶的方法對字符串進行操作和處理,對于一個字符串類型的變量,我們可以用變量名.方法名()的方式來調用它的方法。所謂方法其實就是跟某個類型的變量綁定的函數,后面我們講面向對象編程的時候還會對這一概念詳加說明。

大小寫相關操作

下面的代碼演示了和字符串大小寫變換相關的方法。

s1 = 
'hello, world!'


# 使用capitalize方法獲得字符串首字母大寫后的字符串
print(s1.capitalize())   # Hello, world!
# 使用title方法獲得字符串每個單詞首字母大寫后的字符串
print(s1.title())        # Hello, World!
# 使用 upper方法獲得字符串大寫后的字符串
print(s1. upper())        # HELLO, WORLD!

s2 = 'GOODBYE'
# 使用 lower方法獲得字符串小寫后的字符串
print(s2. lower())        # goodbye

查找操作

如果想在一個字符串中查找有沒有另外一個字符串,可以使用字符串的find或index方法。

s1 = 
'hello, world!'


# find方法從字符串中查找另一個字符串所在的位置
# 找到了返回字符串中另一個字符串首字符的索引
print(s1. find( 'or'))        # 8
# 找不到返回 -1
print(s1. find( 'shit'))      # -1
# index方法與 find方法類似
# 找到了返回字符串中另一個字符串首字符的索引
print(s1.index( 'or'))       # 8
# 找不到引發異常
print(s1.index( 'shit'))     # ValueError: substring not found

在使用find和index方法時還可以通過方法的參數來指定查找的范圍,也就是查找不必從索引為0的位置開始。find和index方法還有逆向查找(從后向前查找)的版本,分別是rfind和rindex,代碼如下所示。

s = 
'hello good world!'


# 從前向后查找字符o出現的位置(相當于第一次出現)
print(s. find( 'o'))       # 4
# 從索引為 5的位置開始查找字符o出現的位置
print(s. find( 'o', 5))    # 7
# 從后向前查找字符o出現的位置(相當于最后一次出現)
print(s.rfind( 'o'))      # 12

性質判斷

可以通過字符串的startswith、endswith來判斷字符串是否以某個字符串開頭和結尾;還可以用is開頭的方法判斷字符串的特征,這些方法都返回布爾值,代碼如下所示。

s1 = 
'hello, world!'


# startwith方法檢查字符串是否以指定的字符串開頭返回布爾值
print(s1.startswith( 'He'))    # False
print(s1.startswith( 'hel'))   # True
# endswith方法檢查字符串是否以指定的字符串結尾返回布爾值
print(s1.endswith( '!'))       # True

s2 = 'abc123456'

# isdigit方法檢查字符串是否由數字構成返回布爾值
print(s2.isdigit())    # False
# isalpha方法檢查字符串是否以字母構成返回布爾值
print(s2.isalpha())    # False
# isalnum方法檢查字符串是否以數字和字母構成返回布爾值
print(s2.isalnum())    # True

格式化字符串

在Python中,字符串類型可以通過center、ljust、rjust方法做居中、左對齊和右對齊的處理。

s1 = 
'hello, world'


# center方法以寬度 20將字符串居中并在兩側填充*
print(s1.center( 20, '*'))  # ****hello, world****
# rjust方法以寬度 20將字符串右對齊并在左側填充空格
print(s1.rjust( 20))        #         hello, world
# ljust方法以寬度 20將字符串左對齊并在右側填充~
print(s1.ljust( 20, '~'))   # hello, world~~~~~~~~

我們之前講過,在用print函數輸出字符串時,可以用下面的方式對字符串進行格式化。


a = 
321

b = 123
print( '%d * %d = %d' % (a, b, a * b))

當然,我們也可以用字符串的方法來完成字符串的格式,代碼如下所示。


a = 
321

b = 123
print( '{0} * {1} = {2}'.format(a, b, a * b))

從Python 3.6開始,格式化字符串還有更為簡潔的書寫方式,就是在字符串前加上f來格式化字符串,在這種以f打頭的字符串中,{變量名}是一個占位符,會被變量對應的值將其替換掉,代碼如下所示。

a = 
321

b = 123
print( f' {a} * {b} = {a * b}')

如果需要進一步控制格式化語法中變量值的形式,可以參照下面的表格來進行字符串格式化操作。

從零開始學Python:第九課-常用數據結構之字符串

修剪操作

字符串的strip方法可以幫我們獲得將原字符串修剪掉左右兩端空格之后的字符串。這個方法非常有實用價值,通常用來將用戶輸入中因為不小心鍵入的頭尾空格去掉,strip方法還有lstrip和rstrip兩個版本,相信從名字大家已經猜出來這兩個方法是做什么用的。


s1 = 
'   jackfrued@126.com  \t\r\n'

# strip方法獲得字符串修剪左右兩側空格之后的字符串
print(s1.strip())    # jackfrued@126.com

其他方法

除了上面講到的方法外,字符串類型還有很多方法,如拆分、合并、編碼、解碼等,這些方法等我們用到的時候再為大家進行續點講解。對于字符串類型來說,還有一個常用的操作是對字符串進行匹配檢查,即檢查字符串是否滿足某種特定的模式。例如,一個網站對用戶注冊信息中用戶名和郵箱的檢查,就屬于模式匹配檢查。實現模式匹配檢查的工具叫做正則表達式,Python語言通過標準庫中的re模塊提供了對正則表達式的支持,我們會在后續的課程中為大家講解這個知識點。

簡單的總結

知道如何表示和操作字符串對程序員來說是非常重要的,因為我們需要處理文本信息,Python中操作字符串可以用拼接、切片等運算符,也可以使用字符串類型的方法。

向AI問一下細節

免責聲明:本站發布的內容(圖片、視頻和文字)以原創、轉載和分享為主,文章觀點不代表本網站立場,如果涉及侵權請聯系站長郵箱:is@yisu.com進行舉報,并提供相關證據,一經查實,將立刻刪除涉嫌侵權內容。

AI

会东县| 锦屏县| 嫩江县| 东平县| 曲阳县| 阿克陶县| 南溪县| 喀喇沁旗| 沙洋县| 余庆县| 沈阳市| 马鞍山市| 临泽县| 疏勒县| 临漳县| 溧水县| 东台市| 兴化市| 泰兴市| 莲花县| 铁岭市| 罗源县| 定远县| 芮城县| 满洲里市| 衡水市| 台北市| 谢通门县| 施秉县| 孙吴县| 福海县| 德兴市| 班玛县| 新沂市| 玉龙| 荣成市| 双柏县| 辽源市| 渭南市| 嘉义县| 贵南县|