php抓取百度邮编搜索结果，应改如何写正则表达式？-php教程-PHP中文網

回复内容：

首頁

後端開發

php教程

php抓取百度邮编搜索结果，应改如何写正则表达式？

WBOYWBOYWBOYWBOYWBOYWBOYWBOYWBOYWBOYWBOYWBOYWBOYWB

Jun 06, 2016 pm 08:41 PM

php 正規表示式

本人小白，想通过百度邮编搜索截取一个地址的邮编，在自己的网站空间里放了个php脚本。
因为要求不是很高，试图通过正则匹配找到第一组“首位不为0的六位数字”，作为结果输出，但是不管怎么尝试，得到的始终是一个空数组……
正则表达式是我从网上找的，也是过不同的形式，但是始终都得不到任何值

<code><?php $final_url = 'http://opendata.baidu.com/post/s?wd=%C9%BD%B6%AB%CA%A1%BC%C3%C4%CF%CA%D0%C0%FA%CF%C2%C7%F8&p=mini&rn=20';
$search_result = file_get_contents($final_url);
$clear_result = strip_tags($search_result);
echo mb_detect_encoding($search_result);
echo("</br>");
echo($clear_result);
echo("");
$zipcodes = search_for_zipcodes($clear_result);
print_r($zipcodes);

function search_for_zipcodes($test) {
    $rule = '/^[1-9]\d{5}$/';
    preg_match_all($rule,$test,$result);
    return $result;
}    ?>
</code>

登入後複製

mb_detect_encoding($search_result)，写这一句是想看看返回回来的页面的编码，但是这个函数似乎也得不到任何结果……

如果漏洞百出烦请诸位大神耐心指教，本人真的是小白一只……

回复内容：

<code><?php $final_url = 'http://opendata.baidu.com/post/s?wd=%C9%BD%B6%AB%CA%A1%BC%C3%C4%CF%CA%D0%C0%FA%CF%C2%C7%F8&p=mini&rn=20';
$search_result = file_get_contents($final_url);
$clear_result = strip_tags($search_result);
echo mb_detect_encoding($search_result);
echo("</br>");
echo($clear_result);
echo("");
$zipcodes = search_for_zipcodes($clear_result);
print_r($zipcodes);

function search_for_zipcodes($test) {
    $rule = '/^[1-9]\d{5}$/';
    preg_match_all($rule,$test,$result);
    return $result;
}    ?>
</code>

登入後複製

mb_detect_encoding($search_result)，写这一句是想看看返回回来的页面的编码，但是这个函数似乎也得不到任何结果……

如果漏洞百出烦请诸位大神耐心指教，本人真的是小白一只……

题主啊, 你好.

我觉得, 你这个任务, 用不到正则.

为什么呢?

请看里面的搜索结果是什么?

<code>        <table class="table-list" cellspacing="0">
<tr>
<th class="head-postcode">邮编</th>
<th class="head-region">行政区域</th>
</tr>
<tr>
<td>250102</td>
<td>
<em>山东省</em> <em>济南市</em> <em>历下区</em> 经十路双号2218-5150</td>
</tr>
<tr>
<td>250102</td>
<td>
<em>山东省</em> <em>济南市</em> <em>历下区</em> 经十东路双号33188-33688</td>
</tr>
<tr>
<td>250102</td>
<td>
<em>山东省</em> <em>济南市</em> <em>历下区</em> 经十路单号177-3799</td>
</tr>
<tr>
<td>250102</td>
<td>
<em>山东省</em> <em>济南市</em> <em>历下区</em> 旅游路港沟水利站机关公寓</td>
</tr>
</table> 
</code>

登入後複製

好完整的结果, 这已经是一个列表了.

因为具体还没有看, 一会我来告诉你怎么处理.我先php试一下.

<code>  <?php //有单独邮编的网址
$url = 'http://opendata.baidu.com/post/s?wd=%C9%BD%CE%F7&p=mini&rn=20';  

// 没有单独邮编的网址
//$url= 'http://opendata.baidu.com/post/s?wd=%C9%BD%B6%AB%CA%A1%BC%C3%C4%CF%CA%D0%C0%FA%CF%C2%C7%F8%C6%BD%B0%B2%BA%FA%CD%AC&p=mini&rn=20';


// xpath 解析文档
$dom = new DOMDocument;
libxml_use_internal_errors(TRUE);
$dom->loadHTMLFile($url);
libxml_clear_errors();
$xPath = new DOMXPath($dom);

//起作用的语句
$trs = $xPath->query('//li/a/text()|//tr/td');

//输出结果
foreach($trs as $tr) {
     $str= $tr->nodeValue;

    if(strlen($str)>6){
    $str =  array_pop( explode(' ', $str));

    }
    echo $str;
    break;
}



?>
</code>

登入後複製

http://phpfiddle.org/

你去phpfiddle 试一下吧, 还行. 做这种工作, xpath方便点.

<code><?php $final_url = 'http://opendata.baidu.com/post/s?wd=%C9%BD%B6%AB%CA%A1%BC%C3%C4%CF%CA%D0%C0%FA%CF%C2%C7%F8&p=mini&rn=20';
$search_result = file_get_contents($final_url);
$search_result = iconv('gbk', 'utf-8', $search_result);
preg_match_all("@<td>(\d+)<td>(.*?)</td>@is", $search_result, $match);
$area = array_map("strip_tags", $match[2]);
print_r($match[1]);
print_r($area);
</code>

登入後複製

把$rule = '/^[1-9]\d{5}$/';换成
$rule = '/[1-9]\d{5}/';试试
因为，你用了strip_tags.所以，很多内容，都直接合并成“一行”了。再用^,$应该是匹配不到的

本網站聲明

本文內容由網友自願投稿，版權歸原作者所有。本站不承擔相應的法律責任。如發現涉嫌抄襲或侵權的內容，請聯絡admin@php.cn

熱AI工具

熱工具

熱門話題

Java教學

1666

CakePHP 教程

1425

Laravel 教程

1323

PHP教程

1272

C# 教程

1251

Related knowledge

PHP和Python：比較兩種流行的編程語言 Apr 14, 2025 am 12:13 AM

PHP和Python各有優勢，選擇依據項目需求。 1.PHP適合web開發，尤其快速開發和維護網站。 2.Python適用於數據科學、機器學習和人工智能，語法簡潔，適合初學者。

PHP行動：現實世界中的示例和應用程序 Apr 14, 2025 am 12:19 AM

PHP在電子商務、內容管理系統和API開發中廣泛應用。 1)電子商務：用於購物車功能和支付處理。 2)內容管理系統：用於動態內容生成和用戶管理。 3)API開發：用於RESTfulAPI開發和API安全性。通過性能優化和最佳實踐，PHP應用的效率和可維護性得以提升。

PHP：網絡開發的關鍵語言 Apr 13, 2025 am 12:08 AM

PHP是一種廣泛應用於服務器端的腳本語言，特別適合web開發。 1.PHP可以嵌入HTML，處理HTTP請求和響應，支持多種數據庫。 2.PHP用於生成動態網頁內容，處理表單數據，訪問數據庫等，具有強大的社區支持和開源資源。 3.PHP是解釋型語言，執行過程包括詞法分析、語法分析、編譯和執行。 4.PHP可以與MySQL結合用於用戶註冊系統等高級應用。 5.調試PHP時，可使用error_reporting()和var_dump()等函數。 6.優化PHP代碼可通過緩存機制、優化數據庫查詢和使用內置函數。 7

PHP與Python：了解差異 Apr 11, 2025 am 12:15 AM

PHP和Python各有優勢，選擇應基於項目需求。 1.PHP適合web開發，語法簡單，執行效率高。 2.Python適用於數據科學和機器學習，語法簡潔，庫豐富。

PHP的持久相關性：它還活著嗎？ Apr 14, 2025 am 12:12 AM

PHP仍然具有活力，其在現代編程領域中依然佔據重要地位。 1)PHP的簡單易學和強大社區支持使其在Web開發中廣泛應用；2)其靈活性和穩定性使其在處理Web表單、數據庫操作和文件處理等方面表現出色；3)PHP不斷進化和優化，適用於初學者和經驗豐富的開發者。

PHP與其他語言：比較 Apr 13, 2025 am 12:19 AM

PHP適合web開發，特別是在快速開發和處理動態內容方面表現出色，但不擅長數據科學和企業級應用。與Python相比，PHP在web開發中更具優勢，但在數據科學領域不如Python；與Java相比，PHP在企業級應用中表現較差，但在web開發中更靈活；與JavaScript相比，PHP在後端開發中更簡潔，但在前端開發中不如JavaScript。