抓取源码 - php有没有功能完整的网页数据采集开源项目呢

WBOY
发布: 2023-03-01 18:24:01
原创
1425 人浏览过

请问有没有开源的工具来采集网页的数据

比如要包含连续规则抓取,例如先抓取分页信息,从中获取详情页,从详情页抓取真正需要的dom字段

包含最后自定义存到数据库,

包含可以伪造ip等

包含自动队列机制,自动延迟

等等

谢谢

回复内容:

请问有没有开源的工具来采集网页的数据

比如要包含连续规则抓取,例如先抓取分页信息,从中获取详情页,从详情页抓取真正需要的dom字段

包含最后自定义存到数据库,

包含可以伪造ip等

包含自动队列机制,自动延迟

等等

谢谢

有,你可以试试【神箭手云爬虫开发平台。】
神箭手云爬虫是一个帮助JS开发者快速开发爬虫系统的SaaS服务平台。神箭手提供上手简单,灵活开放的云爬虫开发框架,让开发者只需要在线写几行js代码就可以实现一个爬虫。并且爬虫将自动运行在云服务器上,爬取速度更快,效率更高。

phpcrawler,php爬虫,php采集器,多进程,多线程

phpQuery

相关标签:
来源:php.cn
本站声明
本文内容由网友自发贡献,版权归原作者所有,本站不承担相应法律责任。如您发现有涉嫌抄袭侵权的内容,请联系admin@php.cn
最新问题
热门教程
更多>
最新下载
更多>
网站特效
网站源码
网站素材
前端模板
关于我们 免责声明 Sitemap
PHP中文网:公益在线PHP培训,帮助PHP学习者快速成长!