목차
준비 작업
Programming
Program Test
프로그램 최적화
참조
백엔드 개발 PHP 튜토리얼 실제 크롤러 연습: PHP를 사용하여 주식 정보 크롤링

실제 크롤러 연습: PHP를 사용하여 주식 정보 크롤링

Jun 13, 2023 pm 05:32 PM
php 비열한 재고

주식시장은 언제나 큰 관심사였습니다. 매일의 주식 상승, 하락 및 변동은 투자자의 결정에 직접적인 영향을 미칩니다. 주식 시장의 최신 동향을 이해하려면 적시에 주식 정보를 얻고 분석해야 합니다. 전통적인 방법은 주요 금융 웹사이트를 수동으로 열어 주식 데이터를 하나씩 보는 것이었습니다. 이 방법은 확실히 너무 번거롭고 비효율적입니다. 현재 크롤러는 매우 효율적이고 자동화된 솔루션이 되었습니다.

다음으로, PHP를 사용하여 간단한 주식 크롤러 프로그램을 작성하여 주식 데이터를 얻는 방법을 보여드리겠습니다.

준비 작업

크롤러 프로그램을 작성하기 전에 다음 작업을 준비해야 합니다.

  1. PHP 개발 환경 설치
  2. PHP 관련 HTTP 요청 라이브러리 설치
  3. HTML DOM에 대한 기본 지식 이해
  4. Be XPath 구문에 익숙함

그 중 HTTP 요청 라이브러리는 대상 웹사이트의 HTML 소스 코드를 얻기 위해 HTTP 요청을 보내는 데 사용됩니다. HTML DOM은 HTML 페이지를 구문 분석하고 탐색하는 데 사용됩니다. XML 및 HTML 문서.

Programming

크롤러 프로그램 작성을 시작하기 전에 대상 웹사이트의 URL과 획득해야 하는 스톡 코드를 알아야 합니다. Sina Finance를 예로 들면 주식 데이터의 URL은 다음과 같습니다.

http://finance.sina.com.cn/realstock/company/sh600000/nc.shtml
로그인 후 복사

그중 sh600000은 상하이 증권 거래소의 주식 코드를 나타냅니다. 마찬가지로 심천 증권 거래소의 주식 코드는 sz로 시작합니다. 우리는 얻어야 하는 스톡 코드를 기반으로 URL을 구축하고 HTTP 요청 라이브러리를 사용하여 HTML 소스 코드를 얻을 수 있습니다.

HTML 소스 코드를 얻은 후에는 HTML DOM 파서를 사용하여 HTML 페이지를 구문 분석하고 XPath 구문을 사용하여 필수 주식 데이터를 필터링해야 합니다. 이 예에서는 주식의 이름과 현재 가격을 필터링해야 합니다.

마지막으로 획득한 주식 데이터를 인쇄할 수 있습니다. 구체적인 코드는 다음과 같습니다.

$code = 'sh600000'; // 股票代码
$url = 'http://finance.sina.com.cn/realstock/company/' . $code . '/nc.shtml'; // 构建URL

$html = file_get_contents($url); // 获取HTML源码
$dom = new DOMDocument();
@$dom->loadHTML($html); // 解析HTML

$xpath = new DOMXPath($dom);
$name = $xpath->query('//h1[@class="name"]/text()')->item(0)->nodeValue; // 筛选股票名称
$price = $xpath->query('//span[@class="price"]/text()')->item(0)->nodeValue; // 筛选当前价格

echo $name . '的当前价格为' . $price;
로그인 후 복사

Program Test

테스트를 실행하기 전에 HTTP 요청 라이브러리 및 관련 확장 프로그램이 로컬 PHP 환경에 설치되어 있는지 확인해야 합니다. Windows 시스템을 예로 들면 다음 명령을 사용하여 설치할 수 있습니다.

composer require php-http/guzzle6-adapter
composer require php-http/message
로그인 후 복사

다음으로 Shanghai Composite Index(주식 코드 sh000001)의 주식 데이터를 가져올 수 있습니다.

$code = 'sh000001'; // 上证指数
$url = 'http://finance.sina.com.cn/realstock/company/' . $code . '/nc.shtml';

$client = new HttpAdapterGuzzle6Client();
$request = new HttpMessageRequest('GET', $url);
$response = $client->sendRequest($request);

$html = $response->getBody()->getContents();
$dom = new DOMDocument();
@$dom->loadHTML($html); // 解析HTML

$xpath = new DOMXPath($dom);
$name = $xpath->query('//h1[@class="name"]/text()')->item(0)->nodeValue;
$price = $xpath->query('//span[@class="price"]/text()')->item(0)->nodeValue;

echo $name . '的当前价格为' . $price;
로그인 후 복사

코드를 실행한 후, 콘솔에서 Shanghai Composite Index의 출력을 볼 수 있습니다. 해당 지수의 현재 가격 정보.

프로그램 최적화

위 코드는 단순한 예시일 뿐 실제 응용에서는 최적화를 위해 다음 요소를 고려해야 합니다.

  1. 네트워크로 인해 HTML 소스 코드를 얻을 수 없는 상황을 처리하기 위해 오류 처리를 추가합니다. 또는 다른 이유.
  2. 프로그램이 실행될 때마다 HTTP 요청을 보내는 것을 방지하기 위해 최근 액세스 시점을 기준으로 캐시할 수 있습니다.
  3. 무한 루프를 통해 여러 주식을 모니터링할 수 있으며, 주가가 변동되면 자동으로 이메일 알림이 전송됩니다.

간단히 말하면, 스톡 크롤러 프로그램 작성은 보안, 효율성, 실용성 등 여러 측면을 고려해야 하며 최상의 결과를 얻을 수 있도록 설계하고 구현해야 합니다.

참조

  1. [PHP HTTP 클라이언트 · php-http.org](http://docs.php-http.org/en/latest/)
  2. [HTML DOM · w3school.com.cn](https: //www.w3school.com.cn/php/php_ref_dom.asp)
  3. [XPath · zh.wikipedia.org](https://zh.wikipedia.org/wiki/XPath)

위 내용은 실제 크롤러 연습: PHP를 사용하여 주식 정보 크롤링의 상세 내용입니다. 자세한 내용은 PHP 중국어 웹사이트의 기타 관련 기사를 참조하세요!

본 웹사이트의 성명
본 글의 내용은 네티즌들의 자발적인 기여로 작성되었으며, 저작권은 원저작자에게 있습니다. 본 사이트는 이에 상응하는 법적 책임을 지지 않습니다. 표절이나 침해가 의심되는 콘텐츠를 발견한 경우 admin@php.cn으로 문의하세요.

핫 AI 도구

Undresser.AI Undress

Undresser.AI Undress

사실적인 누드 사진을 만들기 위한 AI 기반 앱

AI Clothes Remover

AI Clothes Remover

사진에서 옷을 제거하는 온라인 AI 도구입니다.

Undress AI Tool

Undress AI Tool

무료로 이미지를 벗다

Clothoff.io

Clothoff.io

AI 옷 제거제

AI Hentai Generator

AI Hentai Generator

AI Hentai를 무료로 생성하십시오.

인기 기사

R.E.P.O. 에너지 결정과 그들이하는 일 (노란색 크리스탈)
3 몇 주 전 By 尊渡假赌尊渡假赌尊渡假赌
R.E.P.O. 최고의 그래픽 설정
3 몇 주 전 By 尊渡假赌尊渡假赌尊渡假赌
R.E.P.O. 아무도들을 수없는 경우 오디오를 수정하는 방법
3 몇 주 전 By 尊渡假赌尊渡假赌尊渡假赌
WWE 2K25 : Myrise에서 모든 것을 잠금 해제하는 방법
4 몇 주 전 By 尊渡假赌尊渡假赌尊渡假赌

뜨거운 도구

메모장++7.3.1

메모장++7.3.1

사용하기 쉬운 무료 코드 편집기

SublimeText3 중국어 버전

SublimeText3 중국어 버전

중국어 버전, 사용하기 매우 쉽습니다.

스튜디오 13.0.1 보내기

스튜디오 13.0.1 보내기

강력한 PHP 통합 개발 환경

드림위버 CS6

드림위버 CS6

시각적 웹 개발 도구

SublimeText3 Mac 버전

SublimeText3 Mac 버전

신 수준의 코드 편집 소프트웨어(SublimeText3)

Ubuntu 및 Debian용 PHP 8.4 설치 및 업그레이드 가이드 Ubuntu 및 Debian용 PHP 8.4 설치 및 업그레이드 가이드 Dec 24, 2024 pm 04:42 PM

PHP 8.4는 상당한 양의 기능 중단 및 제거를 통해 몇 가지 새로운 기능, 보안 개선 및 성능 개선을 제공합니다. 이 가이드에서는 Ubuntu, Debian 또는 해당 파생 제품에서 PHP 8.4를 설치하거나 PHP 8.4로 업그레이드하는 방법을 설명합니다.

CakePHP 날짜 및 시간 CakePHP 날짜 및 시간 Sep 10, 2024 pm 05:27 PM

cakephp4에서 날짜와 시간을 다루기 위해 사용 가능한 FrozenTime 클래스를 활용하겠습니다.

CakePHP 토론 CakePHP 토론 Sep 10, 2024 pm 05:28 PM

CakePHP는 PHP용 오픈 소스 프레임워크입니다. 이는 애플리케이션을 훨씬 쉽게 개발, 배포 및 유지 관리할 수 있도록 하기 위한 것입니다. CakePHP는 강력하고 이해하기 쉬운 MVC와 유사한 아키텍처를 기반으로 합니다. 모델, 뷰 및 컨트롤러 gu

CakePHP 파일 업로드 CakePHP 파일 업로드 Sep 10, 2024 pm 05:27 PM

파일 업로드 작업을 위해 양식 도우미를 사용할 것입니다. 다음은 파일 업로드의 예입니다.

CakePHP 유효성 검사기 만들기 CakePHP 유효성 검사기 만들기 Sep 10, 2024 pm 05:26 PM

컨트롤러에 다음 두 줄을 추가하면 유효성 검사기를 만들 수 있습니다.

PHP 개발을 위해 Visual Studio Code(VS Code)를 설정하는 방법 PHP 개발을 위해 Visual Studio Code(VS Code)를 설정하는 방법 Dec 20, 2024 am 11:31 AM

VS Code라고도 알려진 Visual Studio Code는 모든 주요 운영 체제에서 사용할 수 있는 무료 소스 코드 편집기 또는 통합 개발 환경(IDE)입니다. 다양한 프로그래밍 언어에 대한 대규모 확장 모음을 통해 VS Code는

CakePHP 빠른 가이드 CakePHP 빠른 가이드 Sep 10, 2024 pm 05:27 PM

CakePHP는 오픈 소스 MVC 프레임워크입니다. 이를 통해 애플리케이션 개발, 배포 및 유지 관리가 훨씬 쉬워집니다. CakePHP에는 가장 일반적인 작업의 과부하를 줄이기 위한 여러 라이브러리가 있습니다.

PHP에서 HTML/XML을 어떻게 구문 분석하고 처리합니까? PHP에서 HTML/XML을 어떻게 구문 분석하고 처리합니까? Feb 07, 2025 am 11:57 AM

이 튜토리얼은 PHP를 사용하여 XML 문서를 효율적으로 처리하는 방법을 보여줍니다. XML (Extensible Markup Language)은 인간의 가독성과 기계 구문 분석을 위해 설계된 다목적 텍스트 기반 마크 업 언어입니다. 일반적으로 데이터 저장 AN에 사용됩니다

See all articles