Java java지도 시간 Java에서 HTML 구문 분석을 위해 JSoup 함수를 사용하는 방법

Java에서 HTML 구문 분석을 위해 JSoup 함수를 사용하는 방법

Jun 26, 2023 pm 01:41 PM
java jsoup HTML 파싱

HTML은 웹페이지의 기본 표현입니다. Java로 HTML 문서의 내용을 얻고 조작하려면 JSoup 함수와 같은 오픈 소스 구문 분석 도구를 사용해야 합니다. JSoup은 HTML 문서를 처리하기 위한 Java 라이브러리로 HTML 문서에서 특정 데이터와 요소를 추출하는 매우 간단한 방법을 제공합니다. 이 기사에서는 Java에서 JSoup을 사용하는 방법을 소개합니다.

  1. JSoup 가져오기

먼저 Java 프로젝트에서 JSoup 라이브러리를 가져와야 합니다. Maven 중앙 저장소에서 JSoup을 찾아 다운로드할 수 있습니다. 다운로드가 완료되면 JSoup.jar 파일의 압축을 풀고 Java 프로젝트로 가져옵니다.

  1. JSoup의 Document 개체 만들기

Java 코드에서 HTML 문서를 읽고 구문 분석하기 위한 Document 개체를 만듭니다. JSoup 라이브러리의 connect() 메소드를 사용하여 구문 분석할 URL 경로를 지정할 수 있습니다. 그러면 JSoup이 자동으로 다운로드하여 HTML 문서를 구문 분석하고 문서 객체를 반환합니다. 예:

String url = "https://www.example.com";
Document doc = Jsoup.connect(url).get();
로그인 후 복사
  1. Extract HTML elements

Document 객체를 사용하면 HTML 문서에서 특정 HTML 요소를 추출할 수 있습니다. Document 개체의 select() 메서드를 사용하고 CSS 선택기 구문을 전달하여 원하는 요소를 필터링할 수 있습니다. 예:

Element elementById = doc.select("#example-id").first();
Elements elementsByClass = doc.select(".example-class");
로그인 후 복사

위 코드는 각각 ID와 클래스 이름을 통해 해당 요소를 가져옵니다. 태그 이름, 속성 값 또는 속성 이름과 같은 다른 선택기를 사용할 수도 있습니다.

  1. HTML 요소 조작

HTML 문서에서 해당 요소를 얻은 후에는 이러한 요소를 추가로 조작할 수 있습니다. Element 개체의 text() 메서드를 사용하여 요소의 텍스트 콘텐츠를 가져올 수 있습니다. 예:

String textById = elementById.text();
String textByClass = elementsByClass.text();
로그인 후 복사

Element 개체의 attribute() 메서드를 사용하여 요소의 속성 값을 가져올 수도 있습니다. .

Element element = doc.select("a").first();
String href = element.attributes().get("href");
로그인 후 복사
  1. HTML 양식 처리

JSoup은 HTML 요소를 얻는 것 외에도 HTML 양식을 처리하는 편리한 도구도 제공합니다. select(), attr() 및 text() 메서드와 같은 Document 개체의 메서드를 사용하여 양식 요소의 값을 수정할 수 있습니다.

Document doc = Jsoup.parse("<form action='/my-url' method='post'>"
        + "<input type='text' name='username'/>"
        + "<input type='password' name='password'/>"
        + "<input type='submit' value='Login'/>"
        + "</form>");

Element formElement = doc.select("form").first();
formElement.attr("action", "login.jsp");
formElement.select("[name=username]").attr("value", "myUsername");
formElement.select("[name=password]").attr("value", "myPassword");
로그인 후 복사
  1. 오류 처리

JSoup을 사용하여 HTML 문서를 구문 분석할 때 가끔 예외가 발생합니다. 따라서 Java 코드에서는 JSoup에서 발생한 IOException 및 ParseException 예외를 처리해야 합니다. 이러한 예외는 Try-catch 블록을 사용하여 포착할 수 있습니다.

try {
    Document doc = Jsoup.connect("http://example.com").get();
} catch (IOException e) {
    e.printStackTrace();
} catch (ParseException e) {
    e.printStackTrace();
}
로그인 후 복사

요약

위는 HTML 파싱을 위해 JSoup 함수를 사용하는 방법입니다. JSoup을 통해 Java로 HTML 문서를 쉽게 얻고 운영할 수 있습니다. Java 프로젝트에 JSoup 라이브러리를 포함하고 요소 조작을 위해 JSoup의 문서 개체, 선택기 및 API를 올바르게 사용하면 데이터 가져오기 및 HTML 양식 수정과 같은 작업을 쉽게 완료할 수 있습니다.

위 내용은 Java에서 HTML 구문 분석을 위해 JSoup 함수를 사용하는 방법의 상세 내용입니다. 자세한 내용은 PHP 중국어 웹사이트의 기타 관련 기사를 참조하세요!

본 웹사이트의 성명
본 글의 내용은 네티즌들의 자발적인 기여로 작성되었으며, 저작권은 원저작자에게 있습니다. 본 사이트는 이에 상응하는 법적 책임을 지지 않습니다. 표절이나 침해가 의심되는 콘텐츠를 발견한 경우 admin@php.cn으로 문의하세요.

핫 AI 도구

Undresser.AI Undress

Undresser.AI Undress

사실적인 누드 사진을 만들기 위한 AI 기반 앱

AI Clothes Remover

AI Clothes Remover

사진에서 옷을 제거하는 온라인 AI 도구입니다.

Undress AI Tool

Undress AI Tool

무료로 이미지를 벗다

Clothoff.io

Clothoff.io

AI 옷 제거제

AI Hentai Generator

AI Hentai Generator

AI Hentai를 무료로 생성하십시오.

뜨거운 도구

메모장++7.3.1

메모장++7.3.1

사용하기 쉬운 무료 코드 편집기

SublimeText3 중국어 버전

SublimeText3 중국어 버전

중국어 버전, 사용하기 매우 쉽습니다.

스튜디오 13.0.1 보내기

스튜디오 13.0.1 보내기

강력한 PHP 통합 개발 환경

드림위버 CS6

드림위버 CS6

시각적 웹 개발 도구

SublimeText3 Mac 버전

SublimeText3 Mac 버전

신 수준의 코드 편집 소프트웨어(SublimeText3)

자바의 제곱근 자바의 제곱근 Aug 30, 2024 pm 04:26 PM

자바의 제곱근 안내 여기서는 예제와 코드 구현을 통해 Java에서 Square Root가 어떻게 작동하는지 설명합니다.

자바의 완전수 자바의 완전수 Aug 30, 2024 pm 04:28 PM

Java의 완전수 가이드. 여기서는 정의, Java에서 완전 숫자를 확인하는 방법, 코드 구현 예제에 대해 논의합니다.

Java의 난수 생성기 Java의 난수 생성기 Aug 30, 2024 pm 04:27 PM

Java의 난수 생성기 안내. 여기서는 예제를 통해 Java의 함수와 예제를 통해 두 가지 다른 생성기에 대해 설명합니다.

자바의 웨카 자바의 웨카 Aug 30, 2024 pm 04:28 PM

Java의 Weka 가이드. 여기에서는 소개, weka java 사용 방법, 플랫폼 유형 및 장점을 예제와 함께 설명합니다.

자바의 암스트롱 번호 자바의 암스트롱 번호 Aug 30, 2024 pm 04:26 PM

자바의 암스트롱 번호 안내 여기에서는 일부 코드와 함께 Java의 Armstrong 번호에 대한 소개를 논의합니다.

Java의 스미스 번호 Java의 스미스 번호 Aug 30, 2024 pm 04:28 PM

Java의 Smith Number 가이드. 여기서는 정의, Java에서 스미스 번호를 확인하는 방법에 대해 논의합니다. 코드 구현의 예.

Java Spring 인터뷰 질문 Java Spring 인터뷰 질문 Aug 30, 2024 pm 04:29 PM

이 기사에서는 가장 많이 묻는 Java Spring 면접 질문과 자세한 답변을 보관했습니다. 그래야 면접에 합격할 수 있습니다.

Java 8 Stream foreach에서 나누거나 돌아 오시겠습니까? Java 8 Stream foreach에서 나누거나 돌아 오시겠습니까? Feb 07, 2025 pm 12:09 PM

Java 8은 스트림 API를 소개하여 데이터 컬렉션을 처리하는 강력하고 표현적인 방법을 제공합니다. 그러나 스트림을 사용할 때 일반적인 질문은 다음과 같은 것입니다. 기존 루프는 조기 중단 또는 반환을 허용하지만 스트림의 Foreach 메소드는이 방법을 직접 지원하지 않습니다. 이 기사는 이유를 설명하고 스트림 처리 시스템에서 조기 종료를 구현하기위한 대체 방법을 탐색합니다. 추가 읽기 : Java Stream API 개선 스트림 foreach를 이해하십시오 Foreach 메소드는 스트림의 각 요소에서 하나의 작업을 수행하는 터미널 작동입니다. 디자인 의도입니다

See all articles