经常用到的PHP正则表达达式-php手册-php.cn

Heim

php教程

php手册

经常用到的PHP正则表达达式

WBOYWBOYWBOYWBOYWBOYWBOYWBOYWBOYWBOYWBOYWBOYWBOYWB

Jun 21, 2016 am 08:51 AM

quot regex str

　　思维导图

　　介绍

　　正则表达式，大家在开发中应该是经常用到，现在很多开发语言都有正则表达式的应用，比如javascript，java，.net,php等等，我今天就把我对正则表达式的理解跟大家唠唠，不当之处，请多多指教!

　　需要知道的术语——下面的术语你知道多少?

　　定界符;字符域;修饰符;限定符;脱字符;通配符(正向预查，反向预查);反向引用;惰性匹配;注释;零字符宽

　　定位

　　我们什么时候使用正则表达式呢?不是所有的字符操作都用正则就好了，php在某些方面用正则反而影响效率。当我们遇到复杂文本数据的解析时候，用正则是比较好的选择。

　　优点

　　正则表达式在处理复杂字符操作的时候，可以提高工作效率，也在一定程度节省你的代码量。

　　缺点

　　我们在使用正则表达式的时候，复杂的正则表达式会加大代码的复杂度，让人很难理解。所以我们有的时候需要在正则表达式内部添加注释。

　　通用模式

　　定界符，通常使用 "/"做为定界符开始和结束,也可以使用"#"。

　　什么时候使用"#"呢?一般是在你的字符串中有很多"/"字符的时候，因为正则的时候这种字符需要转义，比如uri。

　　使用"/"定界符的代码如下.

　　$regex = '/^http:\/\/([\w.]+)\/([\w]+)\/([\w]+)\.html$/i';

　　$str = 'http://www.youku.com/show_page/id_ABCDEFG.html';

　　$matches = array();

　　if(preg_match($regex, $str, $matches)){

　　var_dump($matches);

　　}

　　echo "\n";

　　preg_match中的$matches[0]将包含与整个模式匹配的字符串。

　　使用"#"定界符的代码如下.这个时候对"/"就不转义!

　　$regex = '#^http://([\w.]+)/([\w]+)/([\w]+)\.html$#i';

　　$str = 'http://www.youku.com/show_page/id_ABCDEFG.html';

　　$matches = array();

　　if(preg_match($regex, $str, $matches)){

　　var_dump($matches);

　　}

　　echo "\n";

　　修饰符:用于改变正则表达式的行为。

　　我们看到的('/^http:\/\/([\w.]+)\/([\w]+)\/([\w]+)\.html/i')中的最后一个"i"就是修饰符,表示忽略大小写，还有一个我们经常用到的是"x"表示忽略空格。

　　贡献代码:

　　$regex = '/HELLO/';

　　$str = 'hello word';

　　$matches = array();

　　if(preg_match($regex, $str, $matches)){

　　echo 'No i:Valid Successful!',"\n";

　　}

　　if(preg_match($regex.'i', $str, $matches)){

　　echo 'YES i:Valid Successful!',"\n";

　　}

　　字符域:[\w]用方括号扩起来的部分就是字符域。

　　限定符:如[\w]{3,5}或者[\w]*或者[\w]+这些[\w]后面的符号都表示限定符。现介绍具体意义。

　　{3,5}表示3到5个字符。{3,}超过3个字符，{,5}最多5个，{3}三个字符。* 表示0到多个，+ 表示1到多个。

　　脱字符号

　　放在字符域(如:[^\w])中表示否定(不包括的意思)——“反向选择”

　　放在表达式之前，表示以当前这个字符开始。(/^n/i,表示以n开头)。

　　注意，我们经常管"\"叫"跳脱字符"。用于转义一些特殊符号，如".","/"

　　通配符(lookarounds):断言某些字符串中某些字符的存在与否!

　　lookarounds分两种:lookaheads(正向预查 ?=)和lookbehinds(反向预查?

　　格式:

　　正向预查:(?=) 相对应的 (?!)表示否定意思;反向预查:(?

　　前后紧跟字符

　　$regex = '/(?

　　$str = 'abcdefgk';

　　$matches = array();

　　if(preg_match($regex, $str, $matches)){

　　var_dump($matches);

　　}

　　echo "\n";

　　否定意义:

　　$regex = '/(?

　　$str = 'abcdefgk';

　　$matches = array();

　　if(preg_match($regex, $str, $matches)){

　　var_dump($matches);

　　}

　　echo "\n";

　　字符宽度:零

　　验证零字符代

　　$regex = '/HE(?=L)LO/i';

　　$str = 'HELLO';

　　$matches = array();

　　if(preg_match($regex, $str, $matches)){

　　var_dump($matches);

　　}

　　echo "\n";

　　打印不出结果!

　　$regex = '/HE(?=L)LLO/i';

　　$str = 'HELLO';

　　$matches = array();

　　if(preg_match($regex, $str, $matches)){

　　var_dump($matches);

　　}

　　echo "\n";

　　能打印出结果!

　　说明:(?=L)意思是HE后面紧跟一个L字符。但是(?=L)本身不占字符，要与(L)区分，(L)本身占一个字符。

　　捕获数据

　　没有指明类型而进行的分组,将会被获取,供以后使用。

　　指明类型指的是通配符。所以只有圆括号起始位置没有问号的才能被捕捉。

　　在同一个表达式内的引用叫做反向引用。

　　调用格式: \编号(如\1)。

　　$regex = '/^(Chuanshanjia)[\w\s!]+\1$/';

　　$str = 'Chuanshanjia thank Chuanshanjia';

　　$matches = array();

　　if(preg_match($regex, $str, $matches)){

　　var_dump($matches);

　　}

　　echo "\n";

　　避免捕获数据

　　格式:(?:pattern)

　　优点:将使有效反向引用数量保持在最小，代码更加、清楚。

　　命名捕获组

　　格式:(?P) 调用方式 (?P=组名)

　　$regex = '/(?Pchuanshanjia)[\s]Is[\s](?P=author)/i';

　　$str = 'author:chuanshanjia Is chuanshanjia';

　　$matches = array();

　　if(preg_match($regex, $str, $matches)){

　　var_dump($matches);

　　}

　　echo "\n";

　　运行结果

　　惰性匹配(记住：会进行两部操作,请看下面的原理部分)

　　格式:限定符?

　　原理:"?"：如果前面有限定符，会使用最小的数据。如“*”会取0个，而“+”会取1个，如过是{3,5}会取3个。

　　先看下面的两个代码:

　　代码1.

　　$regex = '/heL*/i';

　　$str = 'heLLLLLLLLLLLLLLLL';

　　if(preg_match($regex, $str, $matches)){

　　var_dump($matches);

　　}

　　echo "\n";

　　结果1.

　　代码2

　　$regex = '/heL*?/i';

　　$str = 'heLLLLLLLLLLLLLLLL';

　　if(preg_match($regex, $str, $matches)){

　　var_dump($matches);

　　}

　　echo "\n";

　　结果2

　　代码3,使用“+”

　　$regex = '/heL+?/i';

　　$str = 'heLLLLLLLLLLLLLLLL';

　　if(preg_match($regex, $str, $matches)){

　　var_dump($matches);

　　}

　　echo "\n";

　　结果3

　　代码4,使用{3,5}

　　$regex = '/heL{3,10}?/i';

　　$str = 'heLLLLLLLLLLLLLLLL';

　　if(preg_match($regex, $str, $matches)){

　　var_dump($matches);

　　}

　　echo "\n";

　　结果4

　　正则表达式的注释

　　格式:(?# 注释内容)

　　用途:主要用于复杂的注释

　　贡献代码:是一个用于连接MYSQL数据库的正则表达式

　　 $regex = '/
　　 ^host=(?
　　 \
　　 ([\w!@#$%^&*()_+\-]+) (?#用户名)
　　 \
　　 ([\w!@#$%^&*()_+\-]+) (?#密码)
　　 (?!\)$/ix';

　　 $str = 'host=192.168.10.221root123456';
　　 $matches = array();

　　 if(preg_match($regex, $str, $matches)){
　　 var_dump($matches);
　　 }

　　 echo "\n";

　　原文链接：http://www.cnblogs.com/baochuan/archive/2012/03/12/2391135.html

Erklärung dieser Website

Der Inhalt dieses Artikels wird freiwillig von Internetnutzern beigesteuert und das Urheberrecht liegt beim ursprünglichen Autor. Diese Website übernimmt keine entsprechende rechtliche Verantwortung. Wenn Sie Inhalte finden, bei denen der Verdacht eines Plagiats oder einer Rechtsverletzung besteht, wenden Sie sich bitte an admin@php.cn

Heiße KI -Werkzeuge

Undresser.AI Undress

KI-gestützte App zum Erstellen realistischer Aktfotos

AI Clothes Remover

Online-KI-Tool zum Entfernen von Kleidung aus Fotos.

Undress AI Tool

Ausziehbilder kostenlos

Clothoff.io

KI-Kleiderentferner

Video Face Swap

Tauschen Sie Gesichter in jedem Video mühelos mit unserem völlig kostenlosen KI-Gesichtstausch-Tool aus!

Heißer Artikel

Assassin's Creed Shadows: Seashell Riddle -Lösung

3 Wochen vor By DDD

Was ist neu in Windows 11 KB5054979 und wie Sie Update -Probleme beheben

2 Wochen vor By DDD

Wo kann man die Kransteuerungsschlüsselkarten in Atomfall finden

3 Wochen vor By DDD

Assassins Creed Shadows - So finden Sie den Schmied und entsperren Sie die Waffen- und Rüstungsanpassung

1 Monate vor By DDD

<🎜>: Dead Rails - wie man jede Herausforderung abschließt

3 Wochen vor By DDD

Heiße Werkzeuge

Notepad++7.3.1

Einfach zu bedienender und kostenloser Code-Editor

SublimeText3 chinesische Version

Chinesische Version, sehr einfach zu bedienen

Senden Sie Studio 13.0.1

Leistungsstarke integrierte PHP-Entwicklungsumgebung

Dreamweaver CS6

Visuelle Webentwicklungstools

SublimeText3 Mac-Version

Codebearbeitungssoftware auf Gottesniveau (SublimeText3)

Heiße Themen

Wo ist der Login-Zugang für Gmail-E-Mail?

7629

CakePHP-Tutorial

1389

Wie lautet das Format des Kontonamens von Steam?

Win11 -Aktivierungsschlüssel dauerhaft

NYT -Verbindungen Hinweise und Antworten

141

Related knowledge

php提交表单通过后,弹出的对话框怎样在当前页弹出,该如何解决 Jun 13, 2016 am 10:23 AM

php提交表单通过后,弹出的对话框怎样在当前页弹出php提交表单通过后,弹出的对话框怎样在当前页弹出而不是在空白页弹出？想实现这样的效果：而不是空白页弹出:------解决方案--------------------如果你的验证用PHP在后端，那么就用Ajax；仅供参考：HTML code

In Python integrierte Quellcodeanalyse vom Typ str May 09, 2023 pm 02:16 PM

1Die Grundeinheit des Unicode-Computerspeichers ist das Byte, das aus 8 Bits besteht. Da Englisch nur aus 26 Buchstaben plus einer Reihe von Symbolen besteht, können englische Zeichen direkt in Bytes gespeichert werden. Andere Sprachen (wie Chinesisch, Japanisch, Koreanisch usw.) müssen jedoch aufgrund der großen Anzahl von Zeichen mehrere Bytes für die Codierung verwenden. Mit der Verbreitung der Computertechnologie entwickelt sich die Technologie zur Kodierung nicht-lateinischer Zeichen weiter, es gibt jedoch immer noch zwei wesentliche Einschränkungen: keine Unterstützung mehrerer Sprachen: Das Kodierungsschema einer Sprache kann nicht in einer anderen Sprache verwendet werden und es gibt keinen einheitlichen Standard: Beispielsweise gibt es auf Chinesisch viele Codierungsstandards wie GBK, GB2312, GB18030 usw. Da die Codierungsmethoden nicht einheitlich sind, müssen Entwickler zwischen verschiedenen Codierungen hin und her konvertieren, und es treten zwangsläufig viele Fehler auf.

Was sind die Gemeinsamkeiten und Unterschiede zwischen __str__ und __repr__ in Python? Apr 29, 2023 pm 07:58 PM

Was sind die Gemeinsamkeiten und Unterschiede zwischen __str__ und __repr__? Wir alle wissen, dass die in Python integrierte Funktion repr() Objekte in Form von Zeichenfolgen ausdrücken kann, um unsere Identifizierung zu erleichtern. Dies ist die „String-Darstellung“. repr() erhält die String-Darstellung eines Objekts über die spezielle Methode __repr__. Wenn __repr__ nicht implementiert ist und wir eine Instanz eines Vektors auf der Konsole ausgeben, kann die resultierende Zeichenfolge sein. >>>classExample:pass>>>print(str(Example()))>>>

So verwenden Sie den regulären RegEx-Ausdruck von Python May 19, 2023 pm 08:49 PM

RegEx oder regulärer Ausdruck ist eine Zeichenfolge, die ein Suchmuster bildet. Mit RegEx kann überprüft werden, ob eine Zeichenfolge ein bestimmtes Suchmuster enthält. RegEx-Modul Python bietet ein integriertes Paket namens re, mit dem reguläre Ausdrücke verarbeitet werden können. Importieren Sie das re-Modul: importre RegEx in Python Sobald Sie das re-Modul importiert haben, können Sie mit der Verwendung regulärer Ausdrücke beginnen: Beispiel Rufen Sie eine Zeichenfolge ab, um zu sehen, ob sie mit „China“ beginnt und mit „country“ endet: importretxt="Chinaisagreatcountry" x =re .search("^China.*country$&

不用数据库来实现用户的简单的下载，代码如下，但是却不能下载，请高手找下原因，文件路劲什么的没有关问题 Jun 13, 2016 am 10:15 AM

不用数据库来实现用户的简单的下载，代码如下，但是却不能下载，请高手找下原因，文件路劲什么的没问题。

图片消失怎么解决 Apr 07, 2024 pm 03:02 PM

图片消失如何解决先是图片文件上传$file=$_FILES['userfile']; if(is_uploaded_file($file['tmp_name'])){$query=mysql_query("INSERT INTO gdb_banner(image_src ) VALUES ('images/{$file['name'

图片消失怎么解决 Jun 13, 2016 am 10:09 AM

图片消失如何解决先是图片文件上传$file=$_FILES['userfile']; if(is_uploaded_file($file['tmp_name'])){$query=mysql_query("INSERT INTO gdb_banner(image_src ) VALUES ('images/{$file['name'

Enthüllung des Geheimnisses von str in der Go-Sprache Mar 29, 2024 am 11:27 AM

Die Go-Sprache ist eine schnelle, prägnante und effiziente Open-Source-Programmiersprache, die bei Programmierern immer beliebter wird. String (String) ist einer der in Programmen häufig verwendeten Datentypen und verfügt auch über eine einzigartige Verarbeitungsmethode in der Go-Sprache. Dieser Artikel führt die Leser dazu, das Geheimnis der Zeichenfolgen (str) in der Go-Sprache aufzudecken und ihre Verwendung und Eigenschaften anhand spezifischer Codebeispiele zu analysieren. Definition und Initialisierung von Zeichenfolgen In der Go-Sprache ist eine Zeichenfolge eine in doppelte Anführungszeichen eingeschlossene Zeichenfolge „“, zum Beispiel: str

See all articles