处置获取到的大量html数据
dom
html
simple
处理获取到的大量html数据
获取到一大堆的html数据,大概有3万个字符的大小。但是前面没用的,只有后面几千字符是有用的,想从里面提取数据。如果直接用正则去处理就浪费了很多资源,有没有什么方法可以从字符串的最后面开始正则,然后取到某个地方就停止。
刚刚一开始尝试用simple_html_dom类来处理,但是后来卡住了...
因为每次去到的东西都不一定长短,所以直接截取固定数量的长度的字符这个方法不太好。
------解决思路----------------------
既然你并不能准确的你需要的内容从什么位置开始,那么就不存在资源浪费的问题
------解决思路----------------------
获取html
file_get_contents
curl
正则解析html,可以获取想要的文本。
------解决思路----------------------
没什么好办法,因为你要过滤数据,要么正则匹配,要么用你用的那个类。
本站声明
本文内容由网友自发贡献,版权归原作者所有,本站不承担相应法律责任。如您发现有涉嫌抄袭侵权的内容,请联系admin@php.cn

热AI工具

Undresser.AI Undress
人工智能驱动的应用程序,用于创建逼真的裸体照片

AI Clothes Remover
用于从照片中去除衣服的在线人工智能工具。

Undress AI Tool
免费脱衣服图片

Clothoff.io
AI脱衣机

Video Face Swap
使用我们完全免费的人工智能换脸工具轻松在任何视频中换脸!

热门文章
刺客信条阴影:贝壳谜语解决方案
1 个月前
By DDD
Windows 11 KB5054979中的新功能以及如何解决更新问题
3 周前
By DDD
在哪里可以找到原子中的起重机控制钥匙卡
1 个月前
By DDD
如何修复KB5055523无法在Windows 11中安装?
2 周前
By DDD
Inzoi:如何申请学校和大学
3 周前
By DDD

热工具

记事本++7.3.1
好用且免费的代码编辑器

SublimeText3汉化版
中文版,非常好用

禅工作室 13.0.1
功能强大的PHP集成开发环境

Dreamweaver CS6
视觉化网页开发工具

SublimeText3 Mac版
神级代码编辑软件(SublimeText3)