怎么抓取网页实时内容

WBOY
發布: 2016-06-13 12:47:41
原創
1080 人瀏覽過

如何抓取网页实时内容

<br />
#网址:http://data.shishicai.cn/cqssc/haoma/<br />
#Demo:<br />
<?php<br />
/* Created on [2013-5-1] Author[Newton] Filename[action.php]*/<br />
#编码转换<br />
function convToUtf8($str) {<br />
	if (mb_detect_encoding($str, "UTF-8, ISO-8859-1, GBK") != "UTF-8") {<br />
		return iconv("GBK", "utf-8", $str);<br />
	} else {<br />
		return $str;<br />
	}<br />
}<br />
<br />
header("content-type:text/html;charset:utf-8");<br />
error_reporting(E_ERROR);<br />
$pages = file_get_contents('http://data.shishicai.cn/cqssc/haoma/');<br />
//$pages = htmlspecialchars($pages);<br />
$pages = convToUtf8($pages);<br />
echo "pages-->>".print_r($pages);echo PHP_EOL;<br />
$doc = new DOMDocument();<br />
$new_doc = new DOMDocument('1.0', 'utf-8');<br />
<br />
echo "doc-->>".print_r($doc);echo PHP_EOL;<br />
$dom = $doc->getElementsByTagName('table');<br />
<br />
$newdoc = $new_doc->loadhtml($dom->item(2)->nodeValue);<br />
$table = $new_doc->saveHTML();<br />
echo "table-->>{$table}".PHP_EOL;<br />
<br />
#result:<br />
#……乱码……<br />
#pages-->>1 DOMDocument Object ( ) doc-->>1 table-->><br />
#table是空的……<br />
?><br />
登入後複製

PHP DOM
相關標籤:
來源:php.cn
本網站聲明
本文內容由網友自願投稿,版權歸原作者所有。本站不承擔相應的法律責任。如發現涉嫌抄襲或侵權的內容,請聯絡admin@php.cn
熱門教學
更多>
最新下載
更多>
網站特效
網站源碼
網站素材
前端模板