> 백엔드 개발 > PHP 튜토리얼 > php如何抓取网页数据?

php如何抓取网页数据?

PHPz
풀어 주다: 2020-06-05 12:43:06
원래의
4113명이 탐색했습니다.

php如何抓取网页数据?

php抓取网页数据

header("Content-type: text/html; charset=utf-8");
//$url = "https://www.cnblogs.com/chenliyang/p/6554647.html";
//$html = file_get_contents($url);
////如果出现中文乱码使用下面代码
////$getcontent = iconv("gb2312", "utf-8",$html);
//echo "<textarea style=&#39;width:800px;height:600px;&#39;>".$html."</textarea>"; //获取整个内容
로그인 후 복사

第一种 file_get_contents 抓取

file_get_contents() 把整个文件读入一个字符串中。

该函数是用于把文件的内容读入到一个字符串中的首选方法。如果服务器操作系统支持,还会使用内存映射技术来增强性能。

$url = &#39;http://www.baidu.com&#39;; //这儿填页面地址
$info=file_get_contents($url);
//preg_match(&#39;|<title>(.*?)<\/title>|i&#39;,$info,$m);
$m1=preg_match(&#39;|<title>(.*?)<\/title>|&#39;,$info,$m);
//var_dump($m1);
 echo $m[1]; //获取标题
 echo &#39;<br/>&#39;;
로그인 후 복사

第二种 curl抓取,

$url = "http://www.baidu.com";
$ch = curl_init();
curl_setopt($ch, CURLOPT_URL, $url);
curl_setopt($ch, CURLOPT_RETURNTRANSFER, 1);
curl_setopt($ch, CURLOPT_CONNECTTIMEOUT, 10);
curl_setopt($ch, CURLOPT_FOLLOWLOCATION, 1);
$html = curl_exec($ch);
curl_close($ch);
 
$m1=preg_match(&#39;|<title>(.*?)<\/title>|&#39;,$html,$ms);
//echo "<textarea style=&#39;width:800px;height:600px;&#39;>".$html."</textarea>";  //获取整个内容
//curl_setopt($ch, CURLOPT_FOLLOWLOCATION, 1);
echo $ms[1]; //获取标题
echo &#39;<br/>&#39;;
로그인 후 복사

更多相关知识,请访问 PHP中文网!!

관련 라벨:
원천:php.cn
본 웹사이트의 성명
본 글의 내용은 네티즌들의 자발적인 기여로 작성되었으며, 저작권은 원저작자에게 있습니다. 본 사이트는 이에 상응하는 법적 책임을 지지 않습니다. 표절이나 침해가 의심되는 콘텐츠를 발견한 경우 admin@php.cn으로 문의하세요.
인기 튜토리얼
더>
최신 다운로드
더>
웹 효과
웹사이트 소스 코드
웹사이트 자료
프론트엔드 템플릿