Heim >Backend-Entwicklung >Python-Tutorial >Fassen Sie die Analyse regulärer Python-Ausdrücke zusammen und organisieren Sie sie
Dieser Artikel vermittelt Ihnen relevantes Wissen über Python. Er stellt hauptsächlich Probleme im Zusammenhang mit regulären Python-Ausdrücken vor und fasst reguläre Ausdrucksfunktionen, Metazeichen, spezielle Sequenzen, Sammlungssätze, übereinstimmende Objekte usw. zusammen. Ich hoffe, es hilft allen.
Empfohlenes Lernen: Python-Tutorial
Welche Rolle spielen reguläre Ausdrücke? Auf unserer Webseite werden viele Inhalte erfasst, und wir können nicht alle davon abrufen. Da wir nur einen Teil davon benötigen, müssen wir reguläre Ausdrücke verwenden, um den gewünschten Inhalt abzugleichen.
Python verfügt über ein integriertes Paket namens re, das zur Verarbeitung regulärer Ausdrücke verwendet werden kann. Importieren Sie das re-Modul:
import re
Nach dem Import des re-Moduls können Sie mit der Verwendung regulärer Ausdrücke beginnen.
Zum Beispiel: Durchsuchen Sie eine Zeichenfolge, um zu sehen, ob sie mit „The“ beginnt und mit „Spain“ endet:
import re txt = "The rain in Spain"x = re.search("^The.*Spain$", txt)if x: print("匹配成功!")else: print("匹配失败")
Führen Sie Folgendes aus:
Natürlich können Sie dieses Beispiel jetzt nicht verstehen, da die Schritt-für-Schritt-Anleitung Das Tutorial wird Ihnen nicht beibringen, in einem Schritt zum Erfolg zu gelangen.
Die Funktion „findall()“ gibt eine Liste mit allen Übereinstimmungen zurück.
Zum Beispiel: Drucken Sie eine Liste aller Übereinstimmungen aus.
import re txt = "川川菜鸟啊菜鸟啊"x = re.findall("菜鸟", txt)print(x)
Laufende Ergebnisse:
Die Liste enthält die Übereinstimmungen in der Reihenfolge, in der sie gefunden wurden. Wenn keine Übereinstimmung gefunden wird, wird eine leere Liste zurückgegeben:
import re txt = "菜鸟并不菜"x = re.findall("川川", txt)print(x)if (x): print("匹配成功了哟")else: print("找不到这个呀!")
Das Ausführen gibt Folgendes zurück:
Die search()-Funktion durchsucht eine Zeichenfolge nach einer Übereinstimmung und gibt bei einer Übereinstimmung eine Übereinstimmung zurück Objekt. Wenn es mehrere Übereinstimmungen gibt, wird nur das erste Vorkommen der Übereinstimmung zurückgegeben.
Zum Beispiel: Suchen Sie nach dem ersten Leerzeichen in der Zeichenfolge:
import re txt = "菜鸟 呢"x = re.search("\s", txt)print("第一个空格字符位于位置:", x.start())
Laufendes Ergebnis:
Wenn keine Übereinstimmung gefunden wird, gibt None den Wert zurück:
import re txt = "天上飞的是菜鸟"x = re.search("川川", txt)print(x)
Gibt zurück:
Die Die Funktion „split()“ gibt eine Liste mit den bei jeder Übereinstimmung aufgeteilten Zeichenfolgen zurück.
Zum Beispiel: Bei jedem Leerzeichen teilen
import re txt = "菜鸟 学 python"x = re.split("\s", txt)print(x)
Das Ausführen gibt Folgendes zurück:
Sie können die Anzahl der Vorkommen steuern, indem Sie den Parameter „maxsplit“ angeben.
Beispiel: Teilen Sie die Zeichenfolge nur beim ersten Vorkommen:
import re#Split the string at the first white-space character:txt = "飞起来 菜鸟 们"x = re.split("\s", txt, 1)print(x)
Gibt zurück:
Die sub()-Funktion ersetzt Übereinstimmungen durch Text Ihrer Wahl.
Zum Beispiel: Ersetzen Sie nur
import re txt = "学python就找川川菜鸟"x = re.sub("就", "只", txt)print(x)
run:
Sie können die Anzahl der Substitutionen steuern, indem Sie den Zählparameter angeben:
Ersetzen Sie beispielsweise die ersten 2 Vorkommen:
import re txt = "学python就就就川川菜鸟"x = re.sub("就", "只", txt,2)print(x)
return:
[] für eine Reihe von Zeichen
Beispiel: #Alle Kleinbuchstaben zwischen „a“ und „m“ alphabetisch suchen
import re txt = "apple chuanchuan "#按字母顺序查找“a”和“m”之间的所有小写字符x = re.findall("[a-m]", txt)print(x)
Ausführen:
* * stellt dar eine spezielle Sequenz (kann auch zum Escapezeichen von Sonderzeichen verwendet werden)
Zum Beispiel alle Zahlen abgleichen:
import re txt = "我今年20岁了"#查找所有数字字符x = re.findall("\d", txt)print(x)
Laufende Rückgaben:
. kann ein beliebiges Zeichen sein (außer Zeilenumbrüche).
Zum Beispiel: Suche nach einer Sequenz, die mit „he“ beginnt, gefolgt von zwei (willkürlichen) Zeichen und einem „o“
import re txt = "hello world"#搜索以“he”开头、后跟两个(任意)字符和一个“o”的序列x = re.findall("he..o", txt)print(x)
Run gibt Folgendes zurück:
^-Symbol wird zum Starten verwendet übereinstimmen.
import re txt = "川川菜鸟 飞起来了"x = re.findall("^川", txt)if x: print("哇,我匹配到了")else: print("哎呀,匹配不了啊")
Lauf:
$ 符号用于匹配结尾,例如:匹配字符串是否以“world”结尾
import re txt = "hello world"#匹配字符串是否以“world”结尾x = re.findall("world$", txt)if x: print("匹配成功了耶")else: print("匹配不到哦")
运行:
import re txt = "天上飞的是菜鸟,学python找川川菜鸟!"#检查字符串是否包含“ai”后跟 0 个或多个“x”字符:x = re.findall("菜鸟*", txt)print(x)if x: print("匹配到了!")else: print("气死了,匹配不到啊")
运行:
+ 用于匹配一次或者多次出现
例如:检查字符串是否包含“菜鸟”后跟 1 个或多个“菜鸟”字符:
import re txt = "飞起来了,菜鸟们!"#检查字符串是否包含“菜鸟”后跟 1 个或多个“菜鸟”字符:x = re.findall("菜鸟+", txt)print(x)if x: print("匹配到了!")else: print("烦死了,匹配不到")
运行:
{} 恰好指定的出现次数
例如:检查字符串是否包含“川”两个
import re txt = "川川菜鸟并不菜!"#检查字符串是否包含“川”两个x = re.findall("川{2}", txt)print(x)if x: print("匹配到了两次的川")else: print("匹配不到啊,帅哥")
返回:
| 匹配两者任一
例如:匹配字符串菜鸟或者是我了
import re txt = "菜鸟们学会python了吗?串串也是菜鸟啊!"x = re.findall("菜鸟|是我了", txt)print(x)if x: print("匹配到了哦!")else: print("匹配失败")
运行:
\A : 如果指定的字符位于字符串的开头,则返回匹配项。
例如:匹配以菜字符开头的字符
import re txt = "菜鸟在这里"x = re.findall("\A菜", txt)print(x)if x: print("是的匹配到了")else: print("匹配不到")
运行:
\b 返回指定字符位于单词开头或结尾的匹配项 (开头的“r”确保字符串被视为原始字符串)。
例如:匹配爱开头
import re txt = "爱你,川川"x = re.findall(r"\b爱", txt)print(x)if x: print("匹配到了")else: print("匹配不到")
运行:
又例如:匹配川结尾
import re txt = "爱你,川川"x = re.findall(r"川\b", txt)print(x)if x: print("匹配到了")else: print("匹配不到")
运行:
\B 返回存在指定字符但不在单词开头(或结尾)的匹配项 (开头的“r”确保字符串被视为“原始字符串”)
比如我匹配菜鸟:
import re txt = "我是菜鸟我是菜鸟啊"#检查是否存在“ain”,但不是在单词的开头:x = re.findall(r"\菜鸟", txt)print(x)if x: print("匹配到了嘛!!")else: print("匹配不到哇!")
运行:
但是你匹配结尾就会返回空,比如我匹配鸟:
import re txt = "川川菜鸟"#检查是否存在“鸟”,但不是在单词的末尾:x = re.findall(r"鸟\B", txt)print(x)if x: print("匹配到了哦")else: print("找不到")
运行:
\d 返回字符串包含数字(0-9 之间的数字)的匹配项。
例如:
import re txt = "我今年20岁了啊"#检查字符串是否包含任何位数(0-9的数字)x = re.findall("\d", txt)print(x)if x: print("哇哇哇,匹配到数字了")else: print("找不到哦")
运行:
\D 返回字符串不包含数字的匹配项
例如:
import re txt = "我今年20岁"#匹配任何非数字符号x = re.findall("\D", txt)print(x)if x: print("匹配到了,开心!")else: print("匹配不到,生气")
运行:
\s 返回一个匹配字符串包含空白空间字符的匹配项。
例如:
import re txt = "我 是 川 川 菜 鸟"#匹配任何空格字符x = re.findall("\s", txt)print(x)if x: print("匹配到了")else: print("匹配不到啊")
运行:
\S 返回字符串不包含空格字符的匹配项
import re txt = "菜鸟是 我 了"#匹配任意非空字符x = re.findall("\S", txt)print(x)if x: print("匹配到了!")else: print("匹配不到啊")
运行:
返回一个匹配,其中字符串包含任何单词字符(从 a 到 Z 的字符,从 0 到 9 的数字,以及下划线 _ 字符)
例如:
import re txt = "菜鸟啊 是串串呀"#在每个单词字符(从a到z的字符,0-9的数字)返回匹配项,以及下划线_字符):x = re.findall("\w", txt)print(x)if x: print("匹配到了啊")else: print("匹配不到哇")
运行:
返回字符串不包含任何单词字符的匹配项,在每个非单词字符中返回匹配(不在A和Z之间的字符。“!”,“?”空白位等)
例如:
import re txt = "菜鸟 是 我嘛?我不信!!"#在每个非单词字符中返回匹配(不在A和Z之间的字符。“!”,“?”空白位等):x = re.findall("\W", txt)print(x)if x: print("匹配到了!")else: print("匹配不到啊")
运行:
\Z 如果指定的字符位于字符串的末尾,则返回匹配项。
例如:
import re txt = "川川是菜鸟啊"x = re.findall("啊\Z", txt)print(x)if x: print("匹配到了哦!")else: print("匹配不到")
例如集合:[arn]
import re txt = "The rain in Spain"x = re.findall("[arn]", txt)print(x)if x: print("匹配到了!")else: print("匹配不到")
返回任何小写字符的匹配项,按字母顺序在 a 和 n 之间。
例如:
import re txt = "hello wo r l d"x = re.findall("[a-n]", txt)print(x)if x: print("匹配到了!")else: print("匹配不到")
运行:
同样的道理,依次其它情况如下:
[^arn] 返回除 a、r 和 n 之外的任何字符的匹配项
[0123] 返回存在任何指定数字(0、1、2 或 3)的匹配项
[0-9] 返回 0 到 9 之间任意数字的匹配项
[0-5][0-9] 返回 00 到 59 中任意两位数的匹配项
[a-zA-Z] 按字母顺序返回 a 和 z 之间的任何字符的匹配,小写或大写
[+] 在集合中,+, *, ., |, (), $,{} 没有特殊含义,所以 [+] 的意思是:返回字符串中任意 + 字符的匹配项。这个我i举个例子:
import re txt = "5+6=11"#检查字符串是否有任何 + 字符:x = re.findall("[+]", txt)print(x)if x: print("匹配到了")else: print("匹配不到")
运行:
匹配对象是包含有关搜索和结果的信息的对象。注意:如果没有匹配,None将返回值,而不是匹配对象。
直接举个例子:
执行将返回匹配对象的搜索
import re#search() 函数返回一个 Match 对象:txt = "hello world"x = re.search("wo", txt)print(x)
运行:
Match 对象具有用于检索有关搜索和结果的信息的属性和方法:
span()返回一个包含匹配开始和结束位置的元组。 string返回传递给函数的字符串 group()返回字符串中匹配的部分
例如:打印第一个匹配项的位置(开始和结束位置)。正则表达式查找任何以大写“S”开头的单词:
import re#搜索单词开头的大写“S”字符,并打印其位置txt = "The rain in Spain"x = re.search(r"\bS\w+", txt)print(x.span())
运行:
例如:打印传递给函数的字符串
import re#返回字符串txt = "The rain in Spain"x = re.search(r"\bS\w+", txt)print(x.string)
例如:打印字符串中匹配的部分。正则表达式查找任何以大写“S”开头的单词
import re#搜索单词开头的大写“w”字符,并打印该单词:txt = "hello world"x = re.search(r"\bw\w+", txt)print(x.group())
运行:
注意:如果没有匹配,None将返回值,而不是匹配对象。
推荐学习:python教程
Das obige ist der detaillierte Inhalt vonFassen Sie die Analyse regulärer Python-Ausdrücke zusammen und organisieren Sie sie. Für weitere Informationen folgen Sie bitte anderen verwandten Artikeln auf der PHP chinesischen Website!