怎么抓取网页实时内容

WBOY
发布: 2016-06-13 12:47:41
原创
1081 人浏览过

如何抓取网页实时内容

<br />
#网址:http://data.shishicai.cn/cqssc/haoma/<br />
#Demo:<br />
<?php<br />
/* Created on [2013-5-1] Author[Newton] Filename[action.php]*/<br />
#编码转换<br />
function convToUtf8($str) {<br />
	if (mb_detect_encoding($str, "UTF-8, ISO-8859-1, GBK") != "UTF-8") {<br />
		return iconv("GBK", "utf-8", $str);<br />
	} else {<br />
		return $str;<br />
	}<br />
}<br />
<br />
header("content-type:text/html;charset:utf-8");<br />
error_reporting(E_ERROR);<br />
$pages = file_get_contents('http://data.shishicai.cn/cqssc/haoma/');<br />
//$pages = htmlspecialchars($pages);<br />
$pages = convToUtf8($pages);<br />
echo "pages-->>".print_r($pages);echo PHP_EOL;<br />
$doc = new DOMDocument();<br />
$new_doc = new DOMDocument('1.0', 'utf-8');<br />
<br />
echo "doc-->>".print_r($doc);echo PHP_EOL;<br />
$dom = $doc->getElementsByTagName('table');<br />
<br />
$newdoc = $new_doc->loadhtml($dom->item(2)->nodeValue);<br />
$table = $new_doc->saveHTML();<br />
echo "table-->>{$table}".PHP_EOL;<br />
<br />
#result:<br />
#……乱码……<br />
#pages-->>1 DOMDocument Object ( ) doc-->>1 table-->><br />
#table是空的……<br />
?><br />
登录后复制

PHP DOM
相关标签:
来源:php.cn
本站声明
本文内容由网友自发贡献,版权归原作者所有,本站不承担相应法律责任。如您发现有涉嫌抄袭侵权的内容,请联系admin@php.cn
热门教程
更多>
最新下载
更多>
网站特效
网站源码
网站素材
前端模板