Python正規表示式-Python教學-PHP中文網

首頁

後端開發

Python教學

Python正規表示式

高洛峰

Oct 19, 2016 pm 04:37 PM

python基礎

正規表示式是搜尋、取代和解析複雜字串的一種強大而標準的方法，Python中的正規相關的東西全在re模組下。

1 常用的匹配

^匹配字串的開始

$匹配字串的結尾

b匹配一個單字的邊界

d匹配任意數字

?D匹配一個非數字字符

d匹配任意數字

?一個匹配一個

可選的x（符合1次或0次x字元）

x*符合0次或多次x

x+符合1次或多次x

x{n,m}至少n次，至多m次x

(a|b|c)要么匹配a，要么匹配b，要么匹配c

(x)一般情況下表示一個記憶組，你可以利用re.search函數返回對象的groups()函數來獲取它的值

2 一般用途

#-------------------------------------------------------------------------------
# coding:        utf-8
# Purpose:正则表达式
#
# Author:      zdk
#
# Created:     26/02/2013
# Copyright:   (c) zdk 2013
#-------------------------------------------------------------------------------
  
import re
if __name__ == &#39;__main__&#39;:
    addr = "100 BROAD ROAD APT.3"
    print(re.sub("ROAD","RD",addr)) # 100 BRD RD APT.3
    print(re.sub(r"\bROAD\b","RD",addr)) # 100 BROAD RD APT.3
    pattern = ".*B.*(ROAD)?"
    print(re.search(pattern,"ROAD")) #None
    print(re.search(pattern,"B")) #<_sre.SRE_Match object at 0x0230F020><span style="background-color:#FAFAFA;font-family:Monaco, &#39;DejaVu Sans Mono&#39;, &#39;Bitstream Vera Sans Mono&#39;, Consolas, &#39;Courier New&#39;, monospace;font-size:1em;line-height:1.5;"> </span>

登入後複製

（1）re.sub("ROAD","RD",addr) 利用re.sub函數對字串addr進行搜索，滿足表達式"ROAD"的用「RD ”替換

（2）re.sub(r"bROADb","RD",addr) ，“b”含義是“單詞的邊界”，在Python中，由於字符“”在字符串中必須轉義，這會變得非常麻煩，所以Python用前綴r表示字串中的所有字元都不轉義。

（3）re.search(pattern,"ROAD") re模組有一個search函數，該函數有兩個參數，一個是正規表示式，一個是字串，search函數傳回一個擁有多種方法可以描述這個匹配的對象，如果沒有發現匹配，則返回None。

3 鬆散正規表示式

上面都是「緊湊」類型的表達式，它比較難以閱讀，即使現在清楚表達式的含義，也不能保證幾個月後還能記得。所以Python允許使用者利用所謂的鬆散正規表示式來完成內聯文檔的需要，和一般的表達式有以下兩個方面的主要區別

忽略空白符。空格符、製表符、回車符不匹配它們本身（如果你想在鬆散正則表達式中匹配一個空格符，你不須在它前面添加一個反斜杠符號對它進行轉義）

忽略註釋。和普通的Python程式碼一樣，註解開始於#符號，結束於行尾。

#松散带有内联注释的正则表达式
    pattern = """
    ^   # begin of string
    M{0,3} # 0 to 3 M
    (CM|CD|D?C{0,3}) #CM or CD or D or D 0 to 3 C
    $   #end of string
    """
    print(re.search(pattern,"MCM",re.VERBOSE)) #<_sre.SRE_Match object at 0x021BAF60>
    print(re.search(pattern,"M99",re.VERBOSE)) #None

登入後複製

（1）當使用鬆散正則表達式時，最重要的一件事是：必須傳遞一個額外的參數re.VERBOSE，它是re模組的一個常數，標誌著待匹配的正則表達式是一個鬆散正規表示式。 pattern的空格和註解都是被忽略的，但同時具有更好的可讀性。

4 個範例研究：解析電話號碼

必須符合下列電話號碼：

800-555-1212

800 555 00-555 -1212

800-555-1212-1234

800-555-1212x1234

800-555-1212 ext.1234

多，我們需要知道的是800為區號，幹線號為555，電話號的其他數字為1212，對於有分機號的，我們需要知道分機號為1234

phonePattern = re.compile(r&#39;&#39;&#39;
    # don&#39;t match beginging of string
(\d{3}) # 3 digits
\D*     #any number of non-digits
(\d{3}) # 3 digits
\D*     #any number of non-digits
(\d{4}) # 4 digits
\D*     #any number of non-digits
(\d*)   #any number of digits
&#39;&#39;&#39;,re.VERBOSE)
print(phonePattern.search(&#39;work 1-(800)555.1212 #1234&#39;).groups()) #(&#39;800&#39;, &#39;555&#39;, &#39;1212&#39;, &#39;1234&#39;)

登入後複製

print(phonePattern.search('work 1-(800)555.1212 # 1234').groups()) #('800', '555', '1212', '1234')

（1）一個鬆散正則表達式如上，首先匹配3個數字區號（不一定從第一個字符開始，所以沒有用^），接著後面匹配任意多個非數字的字符，接著匹配3個數字幹線號，接著匹配任意多個非數字的字符，接著匹配4個數字號碼，接著匹配任意多個非數字的字符，接著匹配任意多個數字的分機號，然後用groups函數分組，得到正確的電話號碼。

本網站聲明

本文內容由網友自願投稿，版權歸原作者所有。本站不承擔相應的法律責任。如發現涉嫌抄襲或侵權的內容，請聯絡admin@php.cn

熱AI工具

熱工具

熱門話題

Java教學

1665

CakePHP 教程

1424

Laravel 教程

1321

PHP教程

1269

C# 教程

1249

Related knowledge

Python vs.C：申請和用例 Apr 12, 2025 am 12:01 AM

Python适合数据科学、Web开发和自动化任务，而C 适用于系统编程、游戏开发和嵌入式系统。Python以简洁和强大的生态系统著称，C 则以高性能和底层控制能力闻名。

Python：遊戲，Guis等 Apr 13, 2025 am 12:14 AM

Python在遊戲和GUI開發中表現出色。 1)遊戲開發使用Pygame，提供繪圖、音頻等功能，適合創建2D遊戲。 2)GUI開發可選擇Tkinter或PyQt，Tkinter簡單易用，PyQt功能豐富，適合專業開發。

Python與C：學習曲線和易用性 Apr 19, 2025 am 12:20 AM

Python更易學且易用，C 則更強大但複雜。 1.Python語法簡潔，適合初學者，動態類型和自動內存管理使其易用，但可能導致運行時錯誤。 2.C 提供低級控制和高級特性，適合高性能應用，但學習門檻高，需手動管理內存和類型安全。

Python和時間：充分利用您的學習時間 Apr 14, 2025 am 12:02 AM

要在有限的時間內最大化學習Python的效率，可以使用Python的datetime、time和schedule模塊。 1.datetime模塊用於記錄和規劃學習時間。 2.time模塊幫助設置學習和休息時間。 3.schedule模塊自動化安排每週學習任務。

Python vs.C：探索性能和效率 Apr 18, 2025 am 12:20 AM

Python在開發效率上優於C ，但C 在執行性能上更高。 1.Python的簡潔語法和豐富庫提高開發效率。 2.C 的編譯型特性和硬件控制提升執行性能。選擇時需根據項目需求權衡開發速度與執行效率。

Python：自動化，腳本和任務管理 Apr 16, 2025 am 12:14 AM

Python在自動化、腳本編寫和任務管理中表現出色。 1)自動化：通過標準庫如os、shutil實現文件備份。 2)腳本編寫：使用psutil庫監控系統資源。 3)任務管理：利用schedule庫調度任務。 Python的易用性和豐富庫支持使其在這些領域中成為首選工具。

Python標準庫的哪一部分是：列表或數組？ Apr 27, 2025 am 12:03 AM

pythonlistsarepartofthestAndArdLibrary，herilearRaysarenot.listsarebuilt-In，多功能，和Rused ForStoringCollections，而EasaraySaraySaraySaraysaraySaraySaraysaraySaraysarrayModuleandleandleandlesscommonlyusedDduetolimitedFunctionalityFunctionalityFunctionality。