ホームページ バックエンド開発 PHPチュートリアル phpQuery を使用して Web ページを収集する方法_PHP チュートリアル

phpQuery を使用して Web ページを収集する方法_PHP チュートリアル

Jul 13, 2016 am 10:25 AM
phpquery

phpQuery は、PHP に基づいたサーバー側のオープン ソース プロジェクトであり、PHP 開発者がニュース Web サイトの見出し情報を取得するなど、DOM ドキュメントのコンテンツを簡単に処理できるようにします。さらに興味深いのは、jQuery の考え方を使用していることです。jQuery を使用するのと同じようにページのコンテンツを処理して、必要なページ情報を取得できます。
見出しを収集する
まず例を見てみましょう。 Sina から国内ニュースの見出しを収集したいと思います。 コードは次のとおりです。

コードをコピーします。 コードは次のとおりです:
include ' phpQuery/phpQuery.php';
phpQuery:: newDocumentFile('http://www.jb51.net');
echo pq(".blkTop h1:eq(0)");


わずか 3 行のコード内容で見出しを取得できます。まず、プログラムに phpQuery.php コア プログラムを組み込み、次に対象の Web ページを呼び出して読み取り、最後に対応するタグの下にコンテンツを出力します。
pq() は、jQuery の $() と同じように、基本的に phpQuery で使用できる強力なメソッドです。「.」を「->」に変更するだけです。上の例のように、pq(".blkTop h1:eq(0)") は、ページ上のクラス属性が blkTop である DIV 要素を取得し、DIV 内の最初の h1 タグを見つけて、html() メソッドを使用してh1 タグの取得 コンテンツ (html タグ付き) は、取得したい見出し情報です。 text() メソッドを使用すると、見出しのテキスト コンテンツのみが取得されます。もちろん、phpQuery をうまく使用するには、ドキュメント内で対応するコンテンツを持つノードを見つけることが重要です。
記事リストを収集する
helloweba.com Web サイトのブログ リストを取得する別の例を見てみましょう。コードを参照してください:


コードをコピーする コードは次のとおりです:
include 'phpQuery/phpQuery. php';
phpQuery: :newDocumentFile('http://www.jb51.net');
$artlist = pq(".blog_li"){
echo pq($li) )->find( 'h2')->html()."";
}


リスト内の DIV をループして記事のタイトルを見つけて出力するのはとても簡単です。
XML ドキュメントを解析します
次のような test.xml ドキュメントがあるとします。



コードをコピーします
コードは次のとおりです:

张三
lt;name>王五
18
< ;/contact>



ここで、Zhang San という名前の連絡先の年齢を取得したいと思います。コードは次のとおりです:



コードをコピーします

コードは次のとおりです:
include 'phpQuery/phpQuery.php'; phpQuery::newDocumentFile('test.xml'); echo pq('contact > age:eq(0)'); 結果出力: 22

jQueryは、ドキュメント ノードを正確に検索し、そのノードの下にあるコンテンツを出力します。XML ドキュメントを解析するのは非常に簡単です。 phpQuery を使用すると、Web サイトのコンテンツを収集するために、面倒な通常のアルゴリズム、コンテンツ置換、その他の面倒なコードを使用する必要がなくなります。
phpqueryプロジェクト公式Webサイトアドレス:http://code.google.com/p/phpquery/


http://www.bkjia.com/PHPjc/825181.html

www.bkjia.com

tru​​e

技術記事 phpQuery は、PHP に基づいたサーバー側のオープン ソース プロジェクトであり、PHP 開発者がニュース Web サイトの見出し情報を取得するなど、DOM ドキュメントのコンテンツを簡単に処理できるようにします。さらに興味深いのは、...を使用していることです。
このウェブサイトの声明
この記事の内容はネチズンが自主的に寄稿したものであり、著作権は原著者に帰属します。このサイトは、それに相当する法的責任を負いません。盗作または侵害の疑いのあるコンテンツを見つけた場合は、admin@php.cn までご連絡ください。

ホットAIツール

Undresser.AI Undress

Undresser.AI Undress

リアルなヌード写真を作成する AI 搭載アプリ

AI Clothes Remover

AI Clothes Remover

写真から衣服を削除するオンライン AI ツール。

Undress AI Tool

Undress AI Tool

脱衣画像を無料で

Clothoff.io

Clothoff.io

AI衣類リムーバー

AI Hentai Generator

AI Hentai Generator

AIヘンタイを無料で生成します。

ホットツール

メモ帳++7.3.1

メモ帳++7.3.1

使いやすく無料のコードエディター

SublimeText3 中国語版

SublimeText3 中国語版

中国語版、とても使いやすい

ゼンドスタジオ 13.0.1

ゼンドスタジオ 13.0.1

強力な PHP 統合開発環境

ドリームウィーバー CS6

ドリームウィーバー CS6

ビジュアル Web 開発ツール

SublimeText3 Mac版

SublimeText3 Mac版

神レベルのコード編集ソフト(SublimeText3)

Laravelでフラッシュセッションデータを使用します Laravelでフラッシュセッションデータを使用します Mar 12, 2025 pm 05:08 PM

Laravelは、直感的なフラッシュメソッドを使用して、一時的なセッションデータの処理を簡素化します。これは、アプリケーション内に簡単なメッセージ、アラート、または通知を表示するのに最適です。 データは、デフォルトで次の要求のためにのみ持続します。 $リクエスト -

PHPロギング:PHPログ分析のベストプラクティス PHPロギング:PHPログ分析のベストプラクティス Mar 10, 2025 pm 02:32 PM

PHPロギングは、Webアプリケーションの監視とデバッグ、および重要なイベント、エラー、ランタイムの動作をキャプチャするために不可欠です。システムのパフォーマンスに関する貴重な洞察を提供し、問題の特定に役立ち、より速いトラブルシューティングをサポートします

PHPのカール:REST APIでPHPカール拡張機能を使用する方法 PHPのカール:REST APIでPHPカール拡張機能を使用する方法 Mar 14, 2025 am 11:42 AM

PHPクライアントURL(CURL)拡張機能は、開発者にとって強力なツールであり、リモートサーバーやREST APIとのシームレスな対話を可能にします。尊敬されるマルチプロトコルファイル転送ライブラリであるLibcurlを活用することにより、PHP Curlは効率的なexecuを促進します

Laravelテストでの簡略化されたHTTP応答のモッキング Laravelテストでの簡略化されたHTTP応答のモッキング Mar 12, 2025 pm 05:09 PM

Laravelは簡潔なHTTP応答シミュレーション構文を提供し、HTTP相互作用テストを簡素化します。このアプローチは、テストシミュレーションをより直感的にしながら、コード冗長性を大幅に削減します。 基本的な実装は、さまざまな応答タイプのショートカットを提供します。 Illuminate \ support \ facades \ httpを使用します。 http :: fake([[ 'google.com' => 'hello world'、 'github.com' => ['foo' => 'bar']、 'forge.laravel.com' =>

Codecanyonで12の最高のPHPチャットスクリプト Codecanyonで12の最高のPHPチャットスクリプト Mar 13, 2025 pm 12:08 PM

顧客の最も差し迫った問題にリアルタイムでインスタントソリューションを提供したいですか? ライブチャットを使用すると、顧客とのリアルタイムな会話を行い、すぐに問題を解決できます。それはあなたがあなたのカスタムにより速いサービスを提供することを可能にします

PHPにおける後期静的結合の概念を説明します。 PHPにおける後期静的結合の概念を説明します。 Mar 21, 2025 pm 01:33 PM

記事では、PHP 5.3で導入されたPHPの後期静的結合(LSB)について説明し、より柔軟な継承を求める静的メソッドコールのランタイム解像度を可能にします。 LSBの実用的なアプリケーションと潜在的なパフォーマ

フレームワークのカスタマイズ/拡張:カスタム機能を追加する方法。 フレームワークのカスタマイズ/拡張:カスタム機能を追加する方法。 Mar 28, 2025 pm 05:12 PM

この記事では、フレームワークにカスタム機能を追加し、アーキテクチャの理解、拡張ポイントの識別、統合とデバッグのベストプラクティスに焦点を当てています。

See all articles