javascript正規表示式的分組以及斷言的詳細介紹-js教程-PHP中文網

首頁

web前端

js教程

javascript正規表示式的分組以及斷言的詳細介紹

黄舟

Apr 24, 2017 am 09:19 AM

这篇文章主要介绍了 javascript 正则表达式分组、断言详解的相关资料,需要的朋友可以参考下

javascript 正则表达式分组、断言详解

提示：阅读本文需要有一定的正则表达式基础。

正则表达式中的断言，作为高级应用出现，倒不是因为它有多难，而是概念比较抽象，不容易理解而已，今天就让小菜通俗的讲解一下。

如果不用断言，以往用过的那些表达式，仅仅能获取到有规律的字符串，而不能获取无规律的字符串。

举个例子，比如html源码中有xxx标签，用以前的知识，我们只能确定源码中的和是固定不变的。因此，如果想获取页面标题(xxx)，充其量只能写一个类似于这样的表达式：.*，而这样写匹配出来的是完整的xxx标签，并不是单纯的页面标题xxx。

想解决以上问题，就要用到断言知识。

在讲断言之前，读者应该先了解分组，这有助于理解断言。

分组在正则中用()表示，根据小菜理解，分组的作用有两个：

n 将某些规律看成是一组，然后进行组级别的重复，可以得到意想不到的效果。

n 分组之后，可以通过后向引用简化表达式。

先来看第一个作用，对于IP地址的匹配，简单的可以写为如下形式：

       \d{1,3}.\d{1,3}.\d{1,3}.\d{1,3}

登入後複製

但仔细观察，我们可以发现一定的规律，可以把.\d{1,3}看成一个整体，也就是把他们看成一组，再把这个组重复3次即可。表达式如下：

       \d{1,3}(.\d{1,3}){3}

登入後複製

这样一看，就比较简洁了。

再来看第二个作用，就拿匹配xxx标签来说，简单的正则可以这样写：

       <title>.*</title>

登入後複製

可以看出，上边表达式中有两个title，完全一样，其实可以通过分组简写。表达式如下：

       <(title)>.*</\1>

登入後複製

这个例子实际上就是反向引用的实际应用。对于分组而言，整个表达式永远算作第0组，在本例中，第0组是<(title)>.*，然后从左到右，依次为分组编号，因此，(title)是第1组。

用\1这种语法，可以引用某组的文本内容，\1当然就是引用第1组的文本内容了，这样一来，就可以简化正则表达式，只写一次title，把它放在组里，然后在后边引用即可。

以此为启发，我们可不可以简化刚刚的IP地址正则表达式呢？原来的表达式为\d{1,3}(.\d{1,3}){3}，里边的\d{1,3}重复了两次，如果利用后向引用简化，表达式如下：

       (\d{1,3})(.\1){3}

登入後複製

简单的解释下，把\d{1,3}放在一组里，表示为(\d{1,3})，它是第1组，(.\1)是第2组，在第2组里通过\1语法，后向引用了第1组的文本内容。

经过实际测试，会发现这样写是错误的，为什么呢？

小菜一直在强调，后向引用，引用的仅仅是文本内容，而不是正则表达式！

也就是说，组中的内容一旦匹配成功，后向引用，引用的就是匹配成功后的内容，引用的是结果，而不是表达式。

因此，(\d{1,3})(.\1){3}这个表达式实际上匹配的是四个数都相同的IP地址，比如：123.123.123.123。

至此，读者已经掌握了传说中的后向引用，就这么简单。

接下来说说什么是断言。

所謂斷言，就是指明某個字串前邊或後邊，將會出現滿足某種規律的字串。

就拿文章開篇的例子來說，我們想要的是xxx，它沒有規律，但是它前邊肯定會有，後邊一定會有</ title>，這就夠了。 </p> <p> 想指定xxx前一定會出現<title>，就用正後發斷言，表達式：(?<=<title>).*</p> <p> 一定會出現，就用正先行斷言，表達式：.*(?=)

兩個加在一起，就是(?<=)

這樣就能搭配xxx。

相信讀者看到這，已經蒙了，不用急，待小菜慢慢講來。

其實掌握了規律，就很簡單了，無論是先行還是後發，都是相對於xxx而言的，也就是相對於目標字串而言。

假如目標字串後邊有條件，可以理解為目標字串在前，就用先行斷言，放在目標字串之後。

假如目標字串前邊有條件，可以理解為目標字串在後，就用後發斷言，放在目標字串之前。

假如指定滿足某一條件，為正。

假如指定不符合某個條件，為負。

斷言只是條件，幫你找出真正需要的字串，本身並不會符合！

(?=X )	#零寬度正先行斷言。僅當子表達式 X 在此位置的右側匹配時才繼續匹配。例如，/w+(?=/d) 與後跟數字的單字匹配，而不與該數字匹配。此構造不會回溯。
(?!X)	#零寬度負先行斷言。僅當子表達式 X 不在此位置的右側匹配時才繼續匹配。例如，例如，/w+(?!/d) 與後面不跟數字的單字匹配，而不與該數字匹配。
(?<=X)	#零寬度正後發斷言。僅當子表達式 X 在此位置的左側匹配時才繼續匹配。例如，(?<=19)99 與跟在 19 後面的 99 的實例相符。此構造不會回溯。
(?	#零寬度負後發斷言。僅當子表達式 X 不在此位置的左側匹配時才繼續匹配。例如，(?

從斷言的表達形式可以看出，它用的就是分組符號，只不過開頭都加了一個問號，這個問號就是在說這是一個非捕獲組，這個組沒有編號，不能用來後向引用，只能當做斷言。

以上是javascript正規表示式的分組以及斷言的詳細介紹的詳細內容。更多資訊請關注PHP中文網其他相關文章！

本網站聲明

本文內容由網友自願投稿，版權歸原作者所有。本站不承擔相應的法律責任。如發現涉嫌抄襲或侵權的內容，請聯絡admin@php.cn

熱AI工具

熱工具

熱門話題

Java教學

1665

CakePHP 教程

1424

Laravel 教程

1321

PHP教程

1269

C# 教程

1249

Related knowledge

PHP正規表示式驗證：數位格式偵測 Mar 21, 2024 am 09:45 AM

PHP正規表示式驗證：數位格式偵測在編寫PHP程式時，經常需要對使用者輸入的資料進行驗證，其中一個常見的驗證是檢查資料是否符合指定的數字格式。在PHP中，可以使用正規表示式來實現這種驗證。本文將介紹如何使用PHP正規表示式來驗證數字格式，並提供具體的程式碼範例。首先，讓我們來看看常見的數字格式驗證要求：整數：只包含數字0-9，可以以正負號開頭，不包含小數點。浮點

如何在 Go 中使用正規表示式匹配時間戳記？ Jun 02, 2024 am 09:00 AM

在Go中，可以使用正規表示式比對時間戳記：編譯正規表示式字串，例如用於匹配ISO8601時間戳記的表達式：^\d{4}-\d{2}-\d{2}T \d{2}:\d{2}:\d{2}(\.\d+)?(Z|[+-][0-9]{2}:[0-9]{2})$ 。使用regexp.MatchString函數檢查字串是否與正規表示式相符。

如何使用正規表示式在 Golang 中驗證電子郵件地址？ May 31, 2024 pm 01:04 PM

若要使用正規表示式在Golang中驗證電子郵件地址，請執行下列步驟：使用regexp.MustCompile建立正規表示式模式，以符合有效的電子郵件地址格式。使用MatchString函數檢查字串是否與模式相符。此模式涵蓋了大多數有效的電子郵件地址格式，包括：局部使用者名稱可以包含字母、數字和特殊字元：!.#$%&'*+/=?^_{|}~-`網域至少包含一個字母，後面可以跟字母、數字或連字符頂級域名（TLD）不能超過63個字符長

簡易JavaScript教學：取得HTTP狀態碼的方法 Jan 05, 2024 pm 06:08 PM

JavaScript教學：如何取得HTTP狀態碼，需要具體程式碼範例前言：在Web開發中，經常會涉及到與伺服器進行資料互動的場景。在與伺服器進行通訊時，我們經常需要取得傳回的HTTP狀態碼來判斷操作是否成功，並根據不同的狀態碼來進行對應的處理。本篇文章將教你如何使用JavaScript來取得HTTP狀態碼，並提供一些實用的程式碼範例。使用XMLHttpRequest

如何在 Go 中使用正規表示式驗證密碼？ Jun 02, 2024 pm 07:31 PM

Go中使用正規表示式驗證密碼的方法如下：定義正規表示式模式，符合最低密碼要求：至少8個字符，包含小寫字母、大寫字母、數字和特殊字符。使用regexp套件中的MustCompile函式編譯正規表示式模式。使用MatchString方法測試輸入字串是否與正規表示式模式相符。

中文字元過濾：PHP正規表示式實踐 Mar 24, 2024 pm 04:48 PM

PHP是一種廣泛應用的程式語言，特別在Web開發領域中非常流行。在網路開發過程中，經常會遇到需要對使用者輸入的文字進行過濾、驗證等操作，其中字元過濾是一項十分重要的操作。本文將介紹如何使用PHP中的正規表示式來實現中文字元過濾的功能，並給出具體的程式碼範例。首先，我們要先明確一下中文字元的Unicode範圍是從u4e00到u9fa5，也就是所有的漢字都處於這個範圍

如何在JavaScript中取得HTTP狀態碼的簡單方法 Jan 05, 2024 pm 01:37 PM

JavaScript中的HTTP狀態碼取得方法簡介：在進行前端開發中，我們常常需要處理與後端介面的交互，而HTTP狀態碼就是其中非常重要的一部分。了解並取得HTTP狀態碼有助於我們更好地處理介面傳回的資料。本文將介紹使用JavaScript取得HTTP狀態碼的方法，並提供具體程式碼範例。一、什麼是HTTP狀態碼HTTP狀態碼是指當瀏覽器向伺服器發起請求時，服務

PHP正規表示式：精確匹配與排除模糊包含 Feb 28, 2024 pm 01:03 PM

PHP正規表示式：精確匹配與排除模糊包含正規表示式是一種強大的文字匹配工具，能夠幫助程式設計師在處理文字時進行高效的搜尋、替換和篩選。在PHP中，正規表示式也被廣泛應用於字串處理和資料匹配。本文將重點介紹在PHP中如何進行精確配對和排除模糊包含的操作，同時結合具體的程式碼範例進行說明。精確匹配精確匹配意味著只匹配符合完全條件的字串，不匹配任何變種或包含額外字

See all articles

javascript正規表示式的分組以及斷言的詳細介紹

熱AI工具

Undresser.AI Undress

AI Clothes Remover

Undress AI Tool

Clothoff.io

Video Face Swap

熱門文章

熱工具

記事本++7.3.1

SublimeText3漢化版

禪工作室 13.0.1

Dreamweaver CS6

SublimeText3 Mac版

熱門話題