PHP敏感词过滤

Jul 25, 2016 am 08:44 AM

  1. /**
  2. * 禁词过滤
  3. * 执行效率:每篇用时0.05秒
  4. * @author liuxu
  5. *
  6. */
  7. class Logic_BlackWord
  8. {
  9. const APP_FORUM = 1;
  10. const APP_BLOG = 2;
  11. const APP_VOTE = 3;
  12. /**
  13. * 过滤得到禁词
  14. * @param unknown $txt
  15. * @return Ambigous
  16. */
  17. public function getHitList($txt)
  18. {
  19. $hitList = array();
  20. //对禁词分批过滤
  21. $max = $this->getMax();
  22. if($max)
  23. {
  24. $size = 1000;
  25. $last = ceil($max/$size);
  26. for($page=1;$page {
  27. $result = $this->getHitListByPage($txt,$page,$size);
  28. if($result) $hitList = array_merge($hitList,$result);
  29. }
  30. }
  31. $hitList2 = array();
  32. foreach($hitList as $hit=>$type)
  33. {
  34. $hitList2[$type][] = $hit;
  35. }
  36. return $hitList2;
  37. }
  38. private function getMax()
  39. {
  40. $redis = Rds::factory();
  41. $memKey = 'blackWord_max';
  42. $max = $redis->get($memKey);
  43. if($max===false)
  44. {
  45. $max = 0;
  46. $blackWord = new Model_BlackWord_BlackWord();
  47. $para['field'] = "MAX(id) AS max";
  48. $result = $blackWord->search($para);
  49. if(isset($result[0]['max'])) $max = $result[0]['max'];
  50. $redis->setex($memKey,300,$max);
  51. }
  52. return $max;
  53. }
  54. /**
  55. * 分批过滤得到禁词
  56. * @param unknown $txt
  57. * @param number $page
  58. * @param number $size
  59. * @return multitype:Ambigous
  60. */
  61. private function getHitListByPage($txt,$page=1,$size=1000)
  62. {
  63. $hitList = array();
  64. //分批得到禁词树
  65. $wordTree = $this->getWordTreeByPage($page,$size);
  66. $txt = strip_tags($txt);
  67. $txt = preg_replace('/[^a-zA-Z0-9\\x{4e00}-\\x{9fa5}]/iu','',$txt);
  68. $len = mb_strlen($txt,'UTF-8');
  69. for($i=0;$i {
  70. $char = mb_substr($txt,$i,1,'UTF-8');
  71. if(isset($wordTree[$char]))
  72. {
  73. $result = $this->getHitListByTree(mb_substr($txt,$i,50,'UTF-8'),$wordTree);
  74. if($result)
  75. {
  76. foreach($result as $hit=>$type)
  77. {
  78. $hitList[$hit] = $type;
  79. }
  80. }
  81. }
  82. }
  83. return $hitList;
  84. }
  85. /**
  86. * 是否禁词
  87. * @param str $txt
  88. * @param arr $wordTree
  89. * @return multitype:unknown
  90. */
  91. private function getHitListByTree($txt,&$wordTree)
  92. {
  93. $len = mb_strlen($txt,'UTF-8');
  94. $point = & $wordTree;
  95. $hit = '';
  96. $hitList = array();
  97. for($i=0;$i {
  98. $char = mb_substr($txt,$i,1,'UTF-8');
  99. if(isset($point[$char]))
  100. {
  101. $hit .= $char;
  102. $point = & $point[$char];
  103. if(isset($point['type']))//匹配成功
  104. {
  105. $hitList[$hit] = $point['type'];
  106. }
  107. }
  108. else
  109. {
  110. break;
  111. }
  112. }
  113. return $hitList;
  114. }
  115. /**
  116. * 分批得到禁词树
  117. * @param int $page
  118. * @param int $size
  119. * @return arr:
  120. */
  121. private function getWordTreeByPage($page=1,$size=1000)
  122. {
  123. $redis = Rds::factory();
  124. $memKey = 'blackWord_tree_'.$page.'_'.$size;
  125. $wordTree = $redis->get($memKey);
  126. if($wordTree===false)
  127. {
  128. $wordTree = array();
  129. $blackWord = new Model_BlackWord_BlackWord();
  130. $start = ($page-1)*$size;
  131. $end = $start + $size;
  132. $para['where'] = "status=1 AND id>".$start." AND id $result = $blackWord->search($para);
  133. if($result)
  134. {
  135. foreach($result as $value)
  136. {
  137. if($value['word'])
  138. {
  139. $value['word'] = preg_split('/(? $point = & $wordTree;
  140. foreach($value['word'] as $char)
  141. {
  142. $point = & $point[$char];
  143. }
  144. $point['type'] = $value['type'];
  145. }
  146. }
  147. }
  148. $redis->setex($memKey,300,$wordTree);
  149. }
  150. return $wordTree;
  151. }
  152. }
复制代码

PHP


Erklärung dieser Website
Der Inhalt dieses Artikels wird freiwillig von Internetnutzern beigesteuert und das Urheberrecht liegt beim ursprünglichen Autor. Diese Website übernimmt keine entsprechende rechtliche Verantwortung. Wenn Sie Inhalte finden, bei denen der Verdacht eines Plagiats oder einer Rechtsverletzung besteht, wenden Sie sich bitte an admin@php.cn

Heiße KI -Werkzeuge

Undresser.AI Undress

Undresser.AI Undress

KI-gestützte App zum Erstellen realistischer Aktfotos

AI Clothes Remover

AI Clothes Remover

Online-KI-Tool zum Entfernen von Kleidung aus Fotos.

Undress AI Tool

Undress AI Tool

Ausziehbilder kostenlos

Clothoff.io

Clothoff.io

KI-Kleiderentferner

AI Hentai Generator

AI Hentai Generator

Erstellen Sie kostenlos Ai Hentai.

Heiße Werkzeuge

Notepad++7.3.1

Notepad++7.3.1

Einfach zu bedienender und kostenloser Code-Editor

SublimeText3 chinesische Version

SublimeText3 chinesische Version

Chinesische Version, sehr einfach zu bedienen

Senden Sie Studio 13.0.1

Senden Sie Studio 13.0.1

Leistungsstarke integrierte PHP-Entwicklungsumgebung

Dreamweaver CS6

Dreamweaver CS6

Visuelle Webentwicklungstools

SublimeText3 Mac-Version

SublimeText3 Mac-Version

Codebearbeitungssoftware auf Gottesniveau (SublimeText3)

Erklären Sie JSON Web Tokens (JWT) und ihren Anwendungsfall in PHP -APIs. Erklären Sie JSON Web Tokens (JWT) und ihren Anwendungsfall in PHP -APIs. Apr 05, 2025 am 12:04 AM

JWT ist ein offener Standard, der auf JSON basiert und zur sicheren Übertragung von Informationen zwischen Parteien verwendet wird, hauptsächlich für die Identitätsauthentifizierung und den Informationsaustausch. 1. JWT besteht aus drei Teilen: Header, Nutzlast und Signatur. 2. Das Arbeitsprinzip von JWT enthält drei Schritte: Generierung von JWT, Überprüfung von JWT und Parsingnayload. 3. Bei Verwendung von JWT zur Authentifizierung in PHP kann JWT generiert und überprüft werden, und die Funktionen und Berechtigungsinformationen der Benutzer können in die erweiterte Verwendung aufgenommen werden. 4. Häufige Fehler sind Signaturüberprüfungsfehler, Token -Ablauf und übergroße Nutzlast. Zu Debugging -Fähigkeiten gehört die Verwendung von Debugging -Tools und Protokollierung. 5. Leistungsoptimierung und Best Practices umfassen die Verwendung geeigneter Signaturalgorithmen, das Einstellen von Gültigkeitsperioden angemessen.

Beschreiben Sie die soliden Prinzipien und wie sie sich für die PHP -Entwicklung anwenden. Beschreiben Sie die soliden Prinzipien und wie sie sich für die PHP -Entwicklung anwenden. Apr 03, 2025 am 12:04 AM

Die Anwendung des soliden Prinzips in der PHP -Entwicklung umfasst: 1. Prinzip der Einzelverantwortung (SRP): Jede Klasse ist nur für eine Funktion verantwortlich. 2. Open and Close Principle (OCP): Änderungen werden eher durch Erweiterung als durch Modifikation erreicht. 3.. Lischs Substitutionsprinzip (LSP): Unterklassen können Basisklassen ersetzen, ohne die Programmgenauigkeit zu beeinträchtigen. 4. Schnittstellen-Isolationsprinzip (ISP): Verwenden Sie feinkörnige Schnittstellen, um Abhängigkeiten und nicht verwendete Methoden zu vermeiden. 5. Abhängigkeitsinversionsprinzip (DIP): Hoch- und niedrige Module beruhen auf der Abstraktion und werden durch Abhängigkeitsinjektion implementiert.

Wie setze ich nach dem Neustart des Systems automatisch Berechtigungen von Unixsocket fest? Wie setze ich nach dem Neustart des Systems automatisch Berechtigungen von Unixsocket fest? Mar 31, 2025 pm 11:54 PM

So setzen Sie die Berechtigungen von Unixsocket automatisch nach dem Neustart des Systems. Jedes Mal, wenn das System neu startet, müssen wir den folgenden Befehl ausführen, um die Berechtigungen von Unixsocket: sudo ...

Erklären Sie das Konzept der späten statischen Bindung in PHP. Erklären Sie das Konzept der späten statischen Bindung in PHP. Mar 21, 2025 pm 01:33 PM

In Artikel wird die in PHP 5.3 eingeführte LSB -Bindung (LSB) erörtert, die die Laufzeitauflösung der statischen Methode ermöglicht, um eine flexiblere Vererbung zu erfordern. Die praktischen Anwendungen und potenziellen Perfo von LSB

Wie debugge ich den CLI -Modus in PhpStorm? Wie debugge ich den CLI -Modus in PhpStorm? Apr 01, 2025 pm 02:57 PM

Wie debugge ich den CLI -Modus in PhpStorm? Bei der Entwicklung mit PHPSTORM müssen wir manchmal den PHP im CLI -Modus (COMS -Zeilenschnittstellen) debuggen ...

Wie sende ich eine Postanforderung mit JSON -Daten mithilfe der Curl -Bibliothek von PHP? Wie sende ich eine Postanforderung mit JSON -Daten mithilfe der Curl -Bibliothek von PHP? Apr 01, 2025 pm 03:12 PM

Senden von JSON -Daten mithilfe der Curl -Bibliothek von PHP in der PHP -Entwicklung müssen häufig mit externen APIs interagieren. Eine der gängigen Möglichkeiten besteht darin, die Curl Library zu verwenden, um Post � ...

Rahmensicherheitsmerkmale: Schutz vor Schwachstellen. Rahmensicherheitsmerkmale: Schutz vor Schwachstellen. Mar 28, 2025 pm 05:11 PM

In Artikel werden wichtige Sicherheitsfunktionen in Frameworks erörtert, um vor Schwachstellen zu schützen, einschließlich Eingabevalidierung, Authentifizierung und regelmäßigen Aktualisierungen.

See all articles