我們如何在Python的正規表示式中找到每個匹配的精確位置?
介紹
re模組是我們在Python中使用的正規表示式。文字搜尋和更複雜的文字操作都使用正規表示式。像grep和sed這樣的工具,像vi和emacs這樣的文字編輯器,以及像Tcl、Perl和Python這樣的電腦語言都內建了正規表示式支援。
Python中的re模組提供了用於匹配正規表示式的函數。
定義我們要尋找或修改的文字的正規表示式稱為模式。文字字面量和元字元構成了這個字串。編譯函數用於建立模式。建議使用原始字串,因為正規表示式經常包含特殊字元。 (r字元用於指示原始字串。)這些字元在組合成模式之前不會被解釋。
可以使用其中一個函數將模式應用於文字字串,模式在組裝完成後使用。可用的函式包括Match、Search、Find和Finditer。
使用的語法
在這裡使用的正規表示式函數是:我們使用正規表示式函數來尋找匹配項。
re.match(): Determines if the RE matches at the beginning of the string. If zero or more characters at the beginning of the string match the regular expression pattern, the match method returns a match object. p.finditer(): Finds all substrings where the RE matches and returns them as an iterator. An iterator delivering match objects across all non-overlapping matches for the pattern in a string is the result of the finditer method. re.compile(): Compile a regular expression pattern into a regular expression object, which can be used for matching using its match(), search(), and other methods described below. The expression’s behavior can be modified by specifying a flag's value. Values can be any of the following variables combined using bitwise OR (the | operator). m.start(): m.start() returns the offset in the string at the match's start. m.group(): You may use the multiple-assignment approach to assign each value to a different variable when mo.groups() returns a tuple of values, as in the areaCode, mainNumber = mo.groups() line below. search: It is comparable to re.match() but does not require that we just look for matches at the beginning of the text. The search() function can locate a pattern in the string at any location, but it only returns the first instance of the pattern.
演算法
使用import re導入正規表示式模組。
使用re.compile()函數建立一個正規表示式物件。 (記得使用原始字串。)
將要搜尋的字串傳遞給Regex物件的finditer()方法。這將會傳回一個Match物件。
呼叫Match物件的group()方法傳回實際符合的文字字串。
我們也可以使用span()方法在一個元組中取得起始和結束索引。
範例
#importing re functions import re #compiling [A-Z0-9] and storing it in a variable p p = re.compile("[A-Z0-9]") #looping m times in p.finditer for m in p.finditer('A5B6C7D8'): #printing the m.start and m.group print m.start(), m.group()
輸出
這將產生輸出−
0 A 1 5 2 B 3 6 4 C 5 7 6 D 7 8
程式碼解釋
使用import re導入正規表示式模組。使用re.compile()函數建立一個正規表示式物件(“[A-Z0-9]”)並將其賦值給變數p。使用迴圈遍歷m,並將要搜尋的字串傳遞給正規表示式物件的finditer()方法。這將會傳回一個Match物件。呼叫Match物件的m.group()和m.start()方法以傳回實際匹配文字的字串。
範例
# Python program to illustrate # Matching regex objects # with groups import re phoneNumRegex = re.compile(r'(\d\d\d)-(\d\d\d-\d\d\d\d)') mo = phoneNumRegex.search('My number is 415-555-4242.') print(mo.groups())
輸出
這將產生輸出−
('415', '555-4242')
程式碼解釋
使用import re導入正規表示式模組。使用re.compile()函數建立一個正規表示式物件(r'(\d\d\d)-(\d\d\d-\d\d\d\d)'),並將其賦值給變數phoneNumRegex。將要搜尋的字串傳遞給Regex物件的search()方法,並將其儲存在變數mo中。這將會傳回一個Match物件。呼叫Match物件的mo.groups()方法以傳回實際匹配的文字字串。
結論
Python re模組提供的search()、match()和finditer()方法允許我們匹配正規表示式模式,並且如果匹配成功,它會提供Match物件實例。使用這個Match物件的start()、end()和span()方法來取得關於匹配字串的詳細資訊。
當有很多匹配項時,如果使用findall()將它們全部加載,您可能會面臨記憶體過載的風險。您可以透過使用finditer()方法來獲得所有潛在匹配項的迭代器對象,這將提高效率。
這表示finditer()提供了一個可調用對象,當呼叫時,將結果載入記憶體。
以上是我們如何在Python的正規表示式中找到每個匹配的精確位置?的詳細內容。更多資訊請關注PHP中文網其他相關文章!

熱AI工具

Undresser.AI Undress
人工智慧驅動的應用程序,用於創建逼真的裸體照片

AI Clothes Remover
用於從照片中去除衣服的線上人工智慧工具。

Undress AI Tool
免費脫衣圖片

Clothoff.io
AI脫衣器

Video Face Swap
使用我們完全免費的人工智慧換臉工具,輕鬆在任何影片中換臉!

熱門文章

熱工具

記事本++7.3.1
好用且免費的程式碼編輯器

SublimeText3漢化版
中文版,非常好用

禪工作室 13.0.1
強大的PHP整合開發環境

Dreamweaver CS6
視覺化網頁開發工具

SublimeText3 Mac版
神級程式碼編輯軟體(SublimeText3)

PHP主要是過程式編程,但也支持面向對象編程(OOP);Python支持多種範式,包括OOP、函數式和過程式編程。 PHP適合web開發,Python適用於多種應用,如數據分析和機器學習。

PHP適合網頁開發和快速原型開發,Python適用於數據科學和機器學習。 1.PHP用於動態網頁開發,語法簡單,適合快速開發。 2.Python語法簡潔,適用於多領域,庫生態系統強大。

Python更適合初學者,學習曲線平緩,語法簡潔;JavaScript適合前端開發,學習曲線較陡,語法靈活。 1.Python語法直觀,適用於數據科學和後端開發。 2.JavaScript靈活,廣泛用於前端和服務器端編程。

PHP起源於1994年,由RasmusLerdorf開發,最初用於跟踪網站訪問者,逐漸演變為服務器端腳本語言,廣泛應用於網頁開發。 Python由GuidovanRossum於1980年代末開發,1991年首次發布,強調代碼可讀性和簡潔性,適用於科學計算、數據分析等領域。

VS Code可以在Windows 8上運行,但體驗可能不佳。首先確保系統已更新到最新補丁,然後下載與系統架構匹配的VS Code安裝包,按照提示安裝。安裝後,注意某些擴展程序可能與Windows 8不兼容,需要尋找替代擴展或在虛擬機中使用更新的Windows系統。安裝必要的擴展,檢查是否正常工作。儘管VS Code在Windows 8上可行,但建議升級到更新的Windows系統以獲得更好的開發體驗和安全保障。

VS Code 可用於編寫 Python,並提供許多功能,使其成為開發 Python 應用程序的理想工具。它允許用戶:安裝 Python 擴展,以獲得代碼補全、語法高亮和調試等功能。使用調試器逐步跟踪代碼,查找和修復錯誤。集成 Git,進行版本控制。使用代碼格式化工具,保持代碼一致性。使用 Linting 工具,提前發現潛在問題。

在 Notepad 中運行 Python 代碼需要安裝 Python 可執行文件和 NppExec 插件。安裝 Python 並為其添加 PATH 後,在 NppExec 插件中配置命令為“python”、參數為“{CURRENT_DIRECTORY}{FILE_NAME}”,即可在 Notepad 中通過快捷鍵“F6”運行 Python 代碼。

VS Code 擴展存在惡意風險,例如隱藏惡意代碼、利用漏洞、偽裝成合法擴展。識別惡意擴展的方法包括:檢查發布者、閱讀評論、檢查代碼、謹慎安裝。安全措施還包括:安全意識、良好習慣、定期更新和殺毒軟件。
