Home > Java > javaTutorial > Example of java regular matching of Chinese characters in a tag in HTML

Example of java regular matching of Chinese characters in a tag in HTML

高洛峰
Release: 2017-01-22 14:27:35
Original
1381 people have browsed it

本文实例讲述了java正则匹配HTML中a标签里的中文字符。分享给大家供大家参考,具体如下:

今天群里一位朋友问到了一个正则表达式的问题,有如下内容:

<a href=&#39;www.baidu.comds=id32434#comment&#39;rewr>特432</a>
453543
<a guhll,,l>a1特123你好123吗?</a>
<a href=id=32434#comment&#39;ewrer>特2</a>
<a>标签中的文字</a>
Copy after login

现在要匹配出内容包含中文但标签的属性中不包含comment的标签中的汉字。

解决思路如下:

1、首先匹配出不包括comment的标签;

2、在匹配结果中进行二次匹配出中文;

代码如下:

输出结果如下:

这里做一下解释:

这个匹配内容包含中文但标签的属性中不包含comment的标签的正则中,不能使用向后查找?<=,因为向后查找只能是固定长度的内容,这里标签中属性不确定,所以不能使用;[\\u4e00-\\u9fa5]+匹配中文字符串;而(?=)使用向前查找?=,在结果中不会包含结束标签。

这个问题就这样得到解决了。如果说要匹配指定标签中的指定内容,那么也是很容易改进的了。若有更好的正则,还请留言相互学习。

希望本文所述对大家java程序设计有所帮助。

更多java正则匹配HTML中a标签里的中文字符示例相关文章请关注PHP中文网!

source:php.cn
Statement of this Website
The content of this article is voluntarily contributed by netizens, and the copyright belongs to the original author. This site does not assume corresponding legal responsibility. If you find any content suspected of plagiarism or infringement, please contact admin@php.cn
Popular Tutorials
More>
Latest Downloads
More>
Web Effects
Website Source Code
Website Materials
Front End Template